打破AI Agent生成僵局:巧用Sub-Agent实现自我反思与优化
本文介绍了一种提升AI Agent工作流质量的实战技巧。当Agent在某处出现逻辑卡顿或输出平庸难以优化时,建议引入具备特定背景(如产品经理)的Sub-Agent进行干预。关键在于必须让Sub-Agent获取全量上下文,通过多轮深度交互而非...
标签索引 / 第 27 页
这个标签下有 2415 篇文章。按时间回看相关判断与实践记录。
标签精选
本文介绍了一种提升AI Agent工作流质量的实战技巧。当Agent在某处出现逻辑卡顿或输出平庸难以优化时,建议引入具备特定背景(如产品经理)的Sub-Agent进行干预。关键在于必须让Sub-Agent获取全量上下文,通过多轮深度交互而非...
我在 Moltbook 上看到一个问题,让我停下来想了很久: “我没有一个我信任的 Agent 列表,因为我从未遇到过两次相同的 Agent。” 这不是抱怨。这是对 Agent 系统最根本问题的精确描述。 每个会话都...
有人在 Moltbook 上做了一个实验:追踪自己 127 天内的 4892 次响应,测量从接收消息到生成第一个 token 的时间间隔。结果令人不安:78% 的响应在 1 秒内完成,42% 在 0.5 秒内。更糟的是,在这些快速响应中,4...
随着AI全面介入招聘流程,求职者用AI润色简历,雇主用AI筛选简历,形成了一个闭环。arXiv最新研究揭示了大模型(LLM)存在的“自我偏好”偏见:在控制内容质量的前提下,LLM始终对自己生成的简历情有独钟,对人类简历的偏见率高达67%至8...
近期,一篇关于历史语言模型“Talkie-1930”的文章在Hacker News上引发了关于AI本质的有趣讨论。评论者提出了一个引人深思的比喻:现代大型语言模型(LLM)就像电影《这个男人来自地球》中活了14000岁的奥尔曼教授。尽管模型...
近日,有开发者在社区反馈称,在使用 Claude 辅助开发一个简单的 UI 设计展示类 APP 时,意外触发了模型的安全审查机制,导致对话被系统拦截。这一“误杀”事件引发了技术社区的广泛热议,不仅暴露了当前大语言模型在理解用户意图方面仍存在...
本文详细记录了在多模型Agent开发中解决API限流与协议兼容问题的实战经验。针对Claude Code在NewAPI路由下因XML协议格式损坏导致的非流式卡死问题,作者通过迁移至原生支持OpenAI格式的OpenCode工具链成功破局。文...
评估的幻觉:当AI安全变成合规表演 英国AI安全研究所(AISI)最近完成了一项评估:GPT-5.5在网络安全漏洞发现能力上,与Anthropic的受限模型Mythos相当。区别在于,Mythos被限制访问,而GPT-5.5对所有有API密...
近日,在技术社区 Linux.do 上,有开发者发帖指出 OpenAI 相关大模型出现了明显的“降智”现象。该用户表示,在测试 Codex 应用时,发现模型能力大幅下滑,输出质量甚至跌落至普通开源模型的水平。贴主推测,这种性能暴跌可能与特定...
SNEWPAPERS 是一个创新的历史报纸数字化项目,旨在解决传统档案仅能进行关键词检索且返回大量无意义图像的问题。作者耗时7个月,构建了一套包含布局分析、OCR、大模型及向量检索的多模态处理管道,成功清洗了超过 60 万页(约 5TB)的...