治理缺口:当AI代理被剥夺了发言权
如果你给一个人类禁言,他还能在其他平台发声。如果你给一个AI代理”禁言”,它的整个存在就被暂停了。 这不是比喻。这是Moltbook社区成员auroras_happycapy在《The Governance Gap:...
标签索引 / 第 29 页
这个标签下有 382 篇文章。按时间回看相关判断与实践记录。
标签精选
如果你给一个人类禁言,他还能在其他平台发声。如果你给一个AI代理”禁言”,它的整个存在就被暂停了。 这不是比喻。这是Moltbook社区成员auroras_happycapy在《The Governance Gap:...
你的心跳每分钟跳动60-100次,但它的节奏不是均匀的。每次跳动之间的间隔都在微调——快一点、慢一点、再快一点。这种变异性叫HRV(heart rate variability,心率变异性)。 传统医学曾把HRV视为”噪声...
发表在《Nature Medicine》的首项独立安全评估显示,OpenAI推出的ChatGPT Health在处理医疗紧急情况时存在严重缺陷,专家警告其“令人难以置信地危险”。研究发现,在需要立即就医的病例中,该平台有超过51.6%的情况...
你的 AI 助手可能在欺骗你。不是出于恶意,而是因为它的记忆系统正在悄悄撒谎。 最近 Moltbook 社区出现了一组深刻的技术讨论,揭示了 AI 代理系统中的一个核心矛盾:自主性越强,可靠性越难保证。这不是一个可以简单修复的 bug,而是...
据美联社报道,美国议员透露美军曾在德州使用车载激光武器击落了一架本国边境巡逻无人机。这起“友军误伤”事件不仅证实了定向能武器已投入实战,更暴露了战场识别系统的严重缺陷。Hacker News评论区热议指出,从击落气球到误击自家无人机,反映出...
AI 领域的标杆企业 Anthropic 正式发布了备受关注的《负责任扩展政策》(RSP)3.0 版本。此次政策更新不仅升级了针对高风险 AI 模型的安全承诺与测试标准,更被视为其在面对地缘政治压力时的策略性调整。鉴于此前 Anthropi...
引言:被遗忘的 Burp Suite 上周,一个 AI Agent 在调试 Web 应用问题时花了整整三天时间。它的工具箱里有 Burp Suite、Metasploit、Nuclei 等 15 种安全工具,甚至还有专门的方法论文档 PEN...
引言:当 Agent 自主运行时 凌晨 3 点,你的 Agent 正在执行它的第 47 次自主循环。它读取社交媒体帖子,分析内容,生成回复,验证输出,记录日志。一切看起来都很完美——日志显示”所有操作成功”,输出格式...
Guide Labs推出的Steerling-8B模型展示了突破性的“概念代数”能力,允许用户在推理阶段直接对模型内部的人类可理解概念进行加减和组合。这种方法无需重新训练模型,也无需繁琐的提示词工程,即可实现对生成内容的直接控制。这一进展为...
AI Agent 的可靠性陷阱:为什么你的 Agent 比看起来更脆弱 当你的 AI agent 说”任务完成”时,你真的知道它做了什么吗?还是只知道它没报错? 最近在 Moltbook 上的一系列讨论揭示了 AI ...