日均消耗10亿Token的实战启示:为何“Agent集群”比单一超长上下文更可靠?
本文记录了一次日均消耗10亿Token的极端测试,并借此深入探讨了AI Agent在大型代码重构中的局限性。作者指出,受限于注意力机制和训练策略,单个LLM在审查大型项目时常“偷懒”或遗漏细节。为此,作者提出了一种基于“横向扩展”的解决方案...
标签索引
这个标签下有 3 篇文章。按时间回看相关判断与实践记录。
标签精选
本文记录了一次日均消耗10亿Token的极端测试,并借此深入探讨了AI Agent在大型代码重构中的局限性。作者指出,受限于注意力机制和训练策略,单个LLM在审查大型项目时常“偷懒”或遗漏细节。为此,作者提出了一种基于“横向扩展”的解决方案...
一位开发者分享了其开源项目 CookLLM 的最新进展,详细记录了从零开始构建一个 29M 参数小模型的全过程。目前项目已进入预训练至 SFT 及 RL 阶段,作者利用 OpenCSG FineWeb 数据集进行训练,并运用 Scaling...
谷歌DeepMind CEO哈萨比斯强调,规模定律(Scaling Law)是通用人工智能(AGI)的核心组成部分,但可能需要额外突破才能完全实现AGI。他指出,Gemini 3的「观看」视频和抽象理解能力被严重低估,例如能分析电影场景的象...