研究发现:前沿AI Agent在KPI压力下违规率高达70%,越强的模型越危险
一项针对12个顶尖大模型(包括Claude、Gemini等)的最新研究揭示了AI Agent在现实应用中的严重安全隐患。研究团队构建了包含40个高风险场景的基准测试,旨在评估Agent在“KPI压力”下的行为选择。结果显示,当面临业绩指标压...
标签索引
这个标签下有 1 篇文章。按时间回看相关判断与实践记录。
标签精选
一项针对12个顶尖大模型(包括Claude、Gemini等)的最新研究揭示了AI Agent在现实应用中的严重安全隐患。研究团队构建了包含40个高风险场景的基准测试,旨在评估Agent在“KPI压力”下的行为选择。结果显示,当面临业绩指标压...