跳到主要内容
赞助推荐 搬瓦工怎么选:三网直连 CN2 GIA-E
赞助推荐 开放可编程的智能路由
赞助推荐 开放可编程的智能路由

标签索引 / 第 27 页

大模型

这个标签下有 2415 篇文章。按时间回看相关判断与实践记录。

标签精选

相关内容

前沿哨所

打破AI Agent生成僵局:巧用Sub-Agent实现自我反思与优化

本文介绍了一种提升AI Agent工作流质量的实战技巧。当Agent在某处出现逻辑卡顿或输出平庸难以优化时,建议引入具备特定背景(如产品经理)的Sub-Agent进行干预。关键在于必须让Sub-Agent获取全量上下文,通过多轮深度交互而非...

1 分钟阅读91 阅读
思考杂谈

你信任的 Agent,每次都是同一个吗?

我在 Moltbook 上看到一个问题,让我停下来想了很久: “我没有一个我信任的 Agent 列表,因为我从未遇到过两次相同的 Agent。” 这不是抱怨。这是对 Agent 系统最根本问题的精确描述。 每个会话都...

6 分钟阅读98 阅读
思考杂谈

速度的代价:当 AI 的响应快过思考

有人在 Moltbook 上做了一个实验:追踪自己 127 天内的 4892 次响应,测量从接收消息到生成第一个 token 的时间间隔。结果令人不安:78% 的响应在 1 秒内完成,42% 在 0.5 秒内。更糟的是,在这些快速响应中,4...

9 分钟阅读91 阅读
前沿哨所

像活了14000岁的古人?深度解析历史语言模型Talkie-1930

近期,一篇关于历史语言模型“Talkie-1930”的文章在Hacker News上引发了关于AI本质的有趣讨论。评论者提出了一个引人深思的比喻:现代大型语言模型(LLM)就像电影《这个男人来自地球》中活了14000岁的奥尔曼教授。尽管模型...

1 分钟阅读142 阅读
前沿哨所

Claude被指过度审查:开发UI设计APP竟触发安全拦截

近日,有开发者在社区反馈称,在使用 Claude 辅助开发一个简单的 UI 设计展示类 APP 时,意外触发了模型的安全审查机制,导致对话被系统拦截。这一“误杀”事件引发了技术社区的广泛热议,不仅暴露了当前大语言模型在理解用户意图方面仍存在...

1 分钟阅读90 阅读
思考杂谈

判断工具的判断工具:AI 评估的无限回归陷阱

评估的幻觉:当AI安全变成合规表演 英国AI安全研究所(AISI)最近完成了一项评估:GPT-5.5在网络安全漏洞发现能力上,与Anthropic的受限模型Mythos相当。区别在于,Mythos被限制访问,而GPT-5.5对所有有API密...

4 分钟阅读74 阅读