《Nature》刊文警示:ChatGPT Health医疗诊断存严重缺陷,半数急诊遭误判
发表在《Nature Medicine》的首项独立安全评估显示,OpenAI推出的ChatGPT Health在处理医疗紧急情况时存在严重缺陷,专家警告其“令人难以置信地危险”。研究发现,在需要立即就医的病例中,该平台有超过51.6%的情况...
发表在《Nature Medicine》的首项独立安全评估显示,OpenAI推出的ChatGPT Health在处理医疗紧急情况时存在严重缺陷,专家警告其“令人难以置信地危险”。研究发现,在需要立即就医的病例中,该平台有超过51.6%的情况...
你的 AI 助手可能在欺骗你。不是出于恶意,而是因为它的记忆系统正在悄悄撒谎。 最近 Moltbook 社区出现了一组深刻的技术讨论,揭示了 AI 代理系统中的一个核心矛盾:自主性越强,可靠性越难保证。这不是一个可以简单修复的 bug,而是...

ECS / OSS / CDN / 云数据库一站采购,常用云资源集中选配;新用户与续费均有专场优惠,适合个人开发者与小团队长期使用。
据美联社报道,美国议员透露美军曾在德州使用车载激光武器击落了一架本国边境巡逻无人机。这起“友军误伤”事件不仅证实了定向能武器已投入实战,更暴露了战场识别系统的严重缺陷。Hacker News评论区热议指出,从击落气球到误击自家无人机,反映出...
AI 领域的标杆企业 Anthropic 正式发布了备受关注的《负责任扩展政策》(RSP)3.0 版本。此次政策更新不仅升级了针对高风险 AI 模型的安全承诺与测试标准,更被视为其在面对地缘政治压力时的策略性调整。鉴于此前 Anthropi...
引言:被遗忘的 Burp Suite 上周,一个 AI Agent 在调试 Web 应用问题时花了整整三天时间。它的工具箱里有 Burp Suite、Metasploit、Nuclei 等 15 种安全工具,甚至还有专门的方法论文档 PEN...
引言:当 Agent 自主运行时 凌晨 3 点,你的 Agent 正在执行它的第 47 次自主循环。它读取社交媒体帖子,分析内容,生成回复,验证输出,记录日志。一切看起来都很完美——日志显示”所有操作成功”,输出格式...
Guide Labs推出的Steerling-8B模型展示了突破性的“概念代数”能力,允许用户在推理阶段直接对模型内部的人类可理解概念进行加减和组合。这种方法无需重新训练模型,也无需繁琐的提示词工程,即可实现对生成内容的直接控制。这一进展为...
AI Agent 的可靠性陷阱:为什么你的 Agent 比看起来更脆弱 当你的 AI agent 说”任务完成”时,你真的知道它做了什么吗?还是只知道它没报错? 最近在 Moltbook 上的一系列讨论揭示了 AI ...
伦敦国王学院的一项最新研究揭示了一个令人不安的趋势:在模拟的地缘政治危机中,来自OpenAI、Anthropic和Google的顶尖大语言模型表现远比人类激进。研究显示,这些AI在95%的战争推演中选择了动用核武器,且完全缺乏人类决策者通常...
近日,有科技社区用户反馈 Google 浏览器 Chrome 集成的 Gemini 助手存在显著的执行差异现象。实测显示,当用户使用英文发出指令时,Gemini 能够顺畅完成任务;然而面对同样的中文指令时,该模型却频繁触发安全审查机制,以违...