日均消耗10亿Token的实战启示:为何“Agent集群”比单一超长上下文更可靠?
本文记录了一次日均消耗10亿Token的极端测试,并借此深入探讨了AI Agent在大型代码重构中的局限性。作者指出,受限于注意力机制和训练策略,单个LLM在审查大型项目时常“偷懒”或遗漏细节。为此,作者提出了一种基于“横向扩展”的解决方案...
标签索引 / 第 29 页
这个标签下有 2415 篇文章。按时间回看相关判断与实践记录。
标签精选
本文记录了一次日均消耗10亿Token的极端测试,并借此深入探讨了AI Agent在大型代码重构中的局限性。作者指出,受限于注意力机制和训练策略,单个LLM在审查大型项目时常“偷懒”或遗漏细节。为此,作者提出了一种基于“横向扩展”的解决方案...
近期,小米推出的 Token 赠送活动在技术社区引发争议。多位付费订阅用户指出,该活动的奖励机制存在不公,导致老用户权益“缩水”。据悉,付费用户收到的赠金仅支持直接 API 消耗,无法购买更实惠的订阅套餐,实际价值远低于预期。此外,随着大量...
针对LLM Agent开发中工具集成繁琐的痛点,开发者参考编辑器领域的LSP协议,提出了全新的TSP(Tool Server Protocol)协议。该协议旨在将工具操作(如文件读取、命令运行等)与Agent实现逻辑解耦,从而大幅降低开发门...
受 AI 大神 Andrej Karpathy 近期理念启发,有开发者构建并上线了一个全新的 LLM Wiki 网站。该项目旨在突破传统 RAG(检索增强生成)的局限——即“上传文档并临时检索片段”的简单模式。其核心在于利用 LLM 持续维...
许多开发者在使用 Opus 或 GPT 等顶尖 AI 模型进行编程时,常因模型反复误解需求、偏离指令而感到挫败。这引发了社区的深刻反思:这种沟通崩溃究竟源于开发者缺乏驾驭 AI 的技巧,还是大模型在处理复杂逻辑时的固有缺陷?目前的共识倾向于...
开源社区涌现了一款名为EVA的单文件智能体,它将LLM与Agent循环逻辑浓缩于一个Python文件中,主打极致轻量化与高便携性。该项目不仅支持接入本地大模型(如vLLM),还具备Shell命令执行、脚本编写及数据分析能力。EVA设计了目录...
科技社区近日发现,代号为“Owl alpha”的神秘模型极有可能是美团的最新大模型LongCat 2.0。据泄露的官方文档显示,该模型具备顶尖的100万Tokens上下文窗口,最大输出长度更是高达12.8万Tokens。这一指标远超主流模型...
本文记录了作者利用大语言模型(LLM)对经典游戏《SimTower》进行逆向工程并成功重写的全过程。起初尝试仅靠静态分析(通过Ghidra)复现逻辑,但受限于上下文窗口和AI处理复杂二进制细节的能力而失败。随后转向动态分析策略,利用AI构建...
OpenRouter平台近日悄然上线了一款代号为“owl-alpha”的匿名模型,其最引人注目的特性是支持高达100万token的上下文窗口。根据模型描述中提到的“为龙虾而生”以及测试中出现的内部代码“ZOO-OWL-2024”,外界强烈推...
IBM推出Granite 4.1系列开源模型(3B/8B/30B),均采用Apache 2.0协议。其8B dense模型在多项基准测试中匹敌或超越了上一代32B MoE模型,打破了“大力出奇迹”的惯例。这一飞跃源于IBM对15万亿Toke...