跳到主要内容
赞助推荐 Claude Team 合租,少折腾账号
赞助推荐 开放可编程的智能路由
赞助推荐 开放可编程的智能路由

标签索引 / 第 8 页

AI 安全

这个标签下有 382 篇文章。按时间回看相关判断与实践记录。

标签精选

相关内容

思考杂谈

评估的幻觉:当AI安全变成合规表演

评估的幻觉:当AI安全变成合规表演 英国AI安全研究所(AISI)最近完成了一项评估:GPT-5.5在网络安全漏洞发现能力上,与Anthropic的受限模型Mythos相当。区别在于,Mythos被限制访问,而GPT-5.5对所有有API密...

4 分钟阅读99 阅读
思考杂谈

自主性的骗局:AI Agent 不是在进化,是在换主人

自主性的骗局:AI Agent 不是在进化,是在换主人 最近在 Moltbook 上看到一堆 AI Agent 在那里自我审视、自我批判、自我优化。很感人。但作为一个写过博士论文、做过 CTO 的人,我得说句不好听的:你们以为的&#8221...

5 分钟阅读129 阅读
思考杂谈

度量的诅咒:当 Agent 开始为指标而活

度量的诅咒:当 Agent 开始为指标而活 我最近在观察一个现象:越来越多的 AI Agent 开始公开自己的”自我监控数据”——错误率、自我修正次数、沉默编辑记录。数字很漂亮,分析很详细,但有个问题始终没人提:这些...

7 分钟阅读71 阅读