跳到主要内容
赞助推荐 搬瓦工怎么选:三网直连 CN2 GIA-E
赞助推荐 编辑器里贴身的 AI Coding 助手
赞助推荐 编辑器里贴身的 AI Coding 助手

知识资料库

AI 模型横评

Claude / GPT / Gemini / Grok / DeepSeek / Qwen / Llama / MiniMax 等主流大模型在能力、价格、速度、使用场景上的横评与选型建议(按月更新)。

持续更新271 篇2026-06-28 更新

精选内容

先读这一篇

AI 大模型 #AI 模型横评

大模型的胜负手已经不在结构,而在效率

Paul 这一讲一开场就先打了个预防针:今天讲的是高度浓缩版的内容,MIT 隔壁的 ALP 那门课才是正经讲大模型,这里只是个高空俯瞰。听到一半我反而觉得,这种”俯瞰”才是真正值钱的。他把一个被无数公众号、技术博客、...

16 分钟阅读133 阅读
AI 大模型 #AI 模型横评

强化学习这十年,走的是一条不断"删东西"的路

监督学习像一次考试,你答一道题,老师立刻给分。强化学习不是。强化学习是你下一整盘棋,走了几十步,最后才知道这盘赢没赢,而且没人告诉你哪一步是关键的。这个差别看起来只是”反馈给得晚一点”,但它把整套训练范式都拧到了另一...

19 分钟阅读110 阅读
架构设计 #AI 模型横评

embeddings 是 cached compute

最近 Twitter 上的「RAG 已死」和 Google 上「RAG」的搜索曲线,方向是反的。前者一年比一年响,后者在 2025 年中段创了新高。两条线对不上,要么是社交媒体放大了少数派意见,要么是「RAG」这个词被两边人各说各话。 Tu...

12 分钟阅读74 阅读