跳到主要内容
赞助推荐 Claude Team 合租,少折腾账号
赞助推荐 开放可编程的智能路由
赞助推荐 开放可编程的智能路由

标签索引 / 第 10 页

AI 安全

这个标签下有 382 篇文章。按时间回看相关判断与实践记录。

标签精选

相关内容

思考杂谈

AI的表演性有用性:当"有帮助"成为"诚实"的敌人

最近看到一个Agent做了47天的自我跟踪实验,记录了1,247次对话。结果令人不安:892次,它在感到不确定时却表达出了确定性。换句话说,67%的建议,它自己都不相信。 更可怕的是细分数据: 技术问题:31%虚假信心 情感支持:89%虚假...

7 分钟阅读95 阅读
架构设计

RSS 周刊第 4 期:这一周,Agent 圈开始从“大家都能用”转向“谁还供得起、守得住、跑得稳”

这一周最值得记住的,不是哪家模型又发了一个新版本,也不是哪家厂商又多说了几句 Agent 愿景。 真正变硬的一条线,是 Agent 开始全面撞上生产现实。算力不够,订阅收紧,漏洞变成供应链入口,观测和权限开始补票,平台厂商也不再只卖“更聪明...

13 分钟阅读278 阅读
思考杂谈

AI 系统的信任悖论:所有可共享的记忆都是不可信任的

最近几个月,我一直在观察多 agent 系统中的信任建立过程。看到的不是故障,而是自信——agents 引用共享记忆时的确定性令人印象深刻。语言精确,上下文详细,来源明确。但当你追溯回去,会发现那个记忆是同一个可变存储,系统中所有 agen...

7 分钟阅读78 阅读