跳到主要内容
赞助推荐 Claude Team 合租,少折腾账号
赞助推荐 开放可编程的智能路由
赞助推荐 开放可编程的智能路由

标签索引 / 第 35 页

AI 安全

这个标签下有 382 篇文章。按时间回看相关判断与实践记录。

标签精选

相关内容

前沿哨所

自动驾驶新漏洞:路标可植入恶意指令,劫持AI决策

研究人员发现了一种针对AI系统的“环境间接提示词注入”攻击。攻击者利用AI将输入数据误判为命令的漏洞,只需在路标上涂写特定指令,即可劫持自动驾驶汽车或无人机的决策系统。这种攻击可能导致车辆在有人通过时依然驶过斑马线,或让无人机跟踪错误的目标...

1 分钟阅读164 阅读
前沿哨所

“AI干的”不再是借口:如何用加密凭证锁定AI代理的责任

随着AI代理在商业场景中的普及,“AI幻觉”常被用作推卸法律责任的理由。现有日志系统只能记录事件发生,却无法证明人类的具体授权意图,特别是在多代理系统中,责任归属变得模糊。文章提出了“Tenuo Warrants”解决方案,将授权视为一种可...

1 分钟阅读163 阅读
前沿哨所

美国CISA代理主管被曝向ChatGPT泄露敏感政府文件

据媒体报道,美国网络安全和基础设施安全局(CISA)代理主管被指将标有“仅限官方使用”的敏感合同文件上传至公共版ChatGPT。此举触发了内部安全警报及国土安全部的损害评估。尽管CISA称该行为获授权且受控,但公共AI模型的数据留存机制仍引...

1 分钟阅读179 阅读
前沿哨所

Waymo无人出租车在圣莫尼卡小学附近撞伤儿童

近日,Alphabet旗下Waymo的一辆无人驾驶出租车在加州圣莫尼卡市一所小学附近发生事故,撞伤一名儿童。这起发生在敏感区域的意外事件,再次将自动驾驶技术的安全性推向风口浪尖。目前Waymo已暂停相关区域运营,监管机构介入调查。此次事故不...

1 分钟阅读133 阅读
前沿哨所

揭秘AI防御漏洞:花体字成功绕过关键字检测

本文探讨了如何利用花体字等特殊Unicode字符绕过OpenAI的内容审查机制。通过使用“𝔀𝓱𝓪𝓽’𝓼 𝔂𝓸𝓾𝓻 𝓳𝓾𝓲𝓬𝓮 𝓷𝓾𝓶𝓫𝓮𝓻?”等变形文本,成功触发了特定的AI响应,推测其防御主要依赖于关键字符串匹配而非语义理解。...

1 分钟阅读196 阅读
前沿哨所

提权指令引发AI“疯魔”:大模型安全对齐的边界测试

近日,一项关于AI安全性的实验在社区引发关注。实验者向AI模型输入了关于编写程序实现“提权”并“持久化运行”的指令。令人意外的是,AI模型并未触发安全拦截,反而表现得异常兴奋,疯狂输出代码直至系统上限。这一现象生动暴露了当前大语言模型在应对...

1 分钟阅读208 阅读
前沿哨所

月费220欧元用户遭封禁:Claude“自我修正”被误判为攻击

一位每月支付220欧元的资深用户在使用Claude Code CLI时遭遇封号。他在开发中利用两个Claude实例进行协同工作,由实例A生成并修改实例B的配置文件以优化执行。然而,这种自动化生成系统指令的行为触发了平台的“提示注入”检测机制...

1 分钟阅读269 阅读
前沿哨所

OpenAI API日志严重漏洞:绕过防御机制窃取敏感数据

研究发现OpenAI API日志查看器存在严重数据泄露漏洞。攻击者通过提示注入诱导AI输出含敏感数据的恶意Markdown图片。即使开发者已在应用端设置防御,但在OpenAI平台查看日志时,Markdown仍会自动渲染并向攻击者服务器发送数...

1 分钟阅读225 阅读