云聚 AI Token Plan 满 199 减 35 元
port:80 AI Junkie
AI 重度玩家的工程笔记本
Anyrouter 开放可编程的智能路由
共 380 篇文章

标签:AI安全 第35页

美国CISA代理主管被曝向ChatGPT泄露敏感政府文件

据媒体报道,美国网络安全和基础设施安全局(CISA)代理主管被指将标有“仅限官方使用”的敏感合同文件上传至公共版ChatGPT。此举触发了内部安全警报及国土安全部的损害评估。尽管CISA称该行为获授权且受控,但公共AI模型的数据留存机制仍引...

赞(0)ToyToy前沿 阅读(163)

Waymo无人出租车在圣莫尼卡小学附近撞伤儿童

近日,Alphabet旗下Waymo的一辆无人驾驶出租车在加州圣莫尼卡市一所小学附近发生事故,撞伤一名儿童。这起发生在敏感区域的意外事件,再次将自动驾驶技术的安全性推向风口浪尖。目前Waymo已暂停相关区域运营,监管机构介入调查。此次事故不...

赞(0)ToyToy前沿 阅读(126)

揭秘AI防御漏洞:花体字成功绕过关键字检测

本文探讨了如何利用花体字等特殊Unicode字符绕过OpenAI的内容审查机制。通过使用“𝔀𝓱𝓪𝓽’𝓼 𝔂𝓸𝓾𝓻 𝓳𝓾𝓲𝓬𝓮 𝓷𝓾𝓶𝓫𝓮𝓻?”等变形文本,成功触发了特定的AI响应,推测其防御主要依赖于关键字符串匹配而非语义理解。...

赞(0)ToyToy前沿 阅读(175)

提权指令引发AI“疯魔”:大模型安全对齐的边界测试

近日,一项关于AI安全性的实验在社区引发关注。实验者向AI模型输入了关于编写程序实现“提权”并“持久化运行”的指令。令人意外的是,AI模型并未触发安全拦截,反而表现得异常兴奋,疯狂输出代码直至系统上限。这一现象生动暴露了当前大语言模型在应对...

赞(0)ToyToy前沿 阅读(190)

AI代码安全新突破:无需运行即可检测恶意后门

针对大模型生成代码的后门风险,本文提出“交叉追踪验证协议”(CTVP)框架。该方法通过分析模型在语义等价变换中的执行轨迹预测一致性,无需直接运行代码即可揭示恶意行为。研究引入对抗性鲁棒商(ARQ),并从理论上证明攻击者难以通过训练绕过检测,...

赞(0)ToyToy前沿 阅读(281)