赞助推荐 Claude Team 合租,少折腾账号
>80aj_
赞助推荐 开放可编程的智能路由

标签索引 / 第 4 页

大模型

这个标签下有 2410 篇文章。按时间回看相关判断与实践记录。

标签精选

相关内容

工程实践

AI 写代码,人退到了两头

有个概念我最近一直在用,叫”聪明区”和”笨蛋区”。提出它的是 Human Layer 的 Dex Hardy:一个大模型刚开始一段新对话时最聪明,因为这时注意力关系最松弛;你每往上下文里塞一个...

19 分钟阅读59 阅读
AI 大模型

Agent 上不了网,却告诉你它查过

我先给一种失败模式起个名字:隐性失败。没有报错,没有警告,没有任何异常提示,你拿到的只是一个错答案。 这是 Bright Data 的 Rafael Levi 在 AI Engineer 大会上一场演讲的主题。他做的是帮 agent 大规模...

10 分钟阅读81 阅读
架构设计

1M 上下文,难点已经换了地方

一年前,模型支持 100 万 token 上下文还是发布会上的高光环节。现在它更像手机快充,人人都有,没有反而奇怪。Claude、OpenAI、Gemini 在海外,DeepSeek、MiniMax、Kimi、智谱在国内,新发布的模型几乎默...

8 分钟阅读142 阅读
AI 大模型 #AI 模型横评

大模型的胜负手已经不在结构,而在效率

Paul 这一讲一开场就先打了个预防针:今天讲的是高度浓缩版的内容,MIT 隔壁的 ALP 那门课才是正经讲大模型,这里只是个高空俯瞰。听到一半我反而觉得,这种”俯瞰”才是真正值钱的。他把一个被无数公众号、技术博客、...

16 分钟阅读105 阅读
AI 大模型 #AI 模型横评

强化学习这十年,走的是一条不断"删东西"的路

监督学习像一次考试,你答一道题,老师立刻给分。强化学习不是。强化学习是你下一整盘棋,走了几十步,最后才知道这盘赢没赢,而且没人告诉你哪一步是关键的。这个差别看起来只是”反馈给得晚一点”,但它把整套训练范式都拧到了另一...

19 分钟阅读93 阅读