并非零数据保留:Kimi协议确认将匿名化使用用户数据训练模型
经分析Kimi《用户服务协议》与《隐私政策》发现,Kimi会在法律允许范围内,对用户输入输出的交互数据(包含API调用数据)进行安全加密及去标识化处理,并将其用于模型优化与训练。这证实了Kimi并非采用“零数据保留”模式,而是通过匿名化用户...
经分析Kimi《用户服务协议》与《隐私政策》发现,Kimi会在法律允许范围内,对用户输入输出的交互数据(包含API调用数据)进行安全加密及去标识化处理,并将其用于模型优化与训练。这证实了Kimi并非采用“零数据保留”模式,而是通过匿名化用户...
随着AI代理在商业场景中的普及,“AI幻觉”常被用作推卸法律责任的理由。现有日志系统只能记录事件发生,却无法证明人类的具体授权意图,特别是在多代理系统中,责任归属变得模糊。文章提出了“Tenuo Warrants”解决方案,将授权视为一种可...

ECS / OSS / CDN / 云数据库一站采购,常用云资源集中选配;新用户与续费均有专场优惠,适合个人开发者与小团队长期使用。
据媒体报道,美国网络安全和基础设施安全局(CISA)代理主管被指将标有“仅限官方使用”的敏感合同文件上传至公共版ChatGPT。此举触发了内部安全警报及国土安全部的损害评估。尽管CISA称该行为获授权且受控,但公共AI模型的数据留存机制仍引...
近日,Alphabet旗下Waymo的一辆无人驾驶出租车在加州圣莫尼卡市一所小学附近发生事故,撞伤一名儿童。这起发生在敏感区域的意外事件,再次将自动驾驶技术的安全性推向风口浪尖。目前Waymo已暂停相关区域运营,监管机构介入调查。此次事故不...
本文探讨了如何利用花体字等特殊Unicode字符绕过OpenAI的内容审查机制。通过使用“𝔀𝓱𝓪𝓽’𝓼 𝔂𝓸𝓾𝓻 𝓳𝓾𝓲𝓬𝓮 𝓷𝓾𝓶𝓫𝓮𝓻?”等变形文本,成功触发了特定的AI响应,推测其防御主要依赖于关键字符串匹配而非语义理解。...
近日,一项关于AI安全性的实验在社区引发关注。实验者向AI模型输入了关于编写程序实现“提权”并“持久化运行”的指令。令人意外的是,AI模型并未触发安全拦截,反而表现得异常兴奋,疯狂输出代码直至系统上限。这一现象生动暴露了当前大语言模型在应对...
一位每月支付220欧元的资深用户在使用Claude Code CLI时遭遇封号。他在开发中利用两个Claude实例进行协同工作,由实例A生成并修改实例B的配置文件以优化执行。然而,这种自动化生成系统指令的行为触发了平台的“提示注入”检测机制...
研究发现OpenAI API日志查看器存在严重数据泄露漏洞。攻击者通过提示注入诱导AI输出含敏感数据的恶意Markdown图片。即使开发者已在应用端设置防御,但在OpenAI平台查看日志时,Markdown仍会自动渲染并向攻击者服务器发送数...
针对大模型生成代码的后门风险,本文提出“交叉追踪验证协议”(CTVP)框架。该方法通过分析模型在语义等价变换中的执行轨迹预测一致性,无需直接运行代码即可揭示恶意行为。研究引入对抗性鲁棒商(ARQ),并从理论上证明攻击者难以通过训练绕过检测,...
Anthropic最新研究通过分析大模型内部神经活动,定义了“助手轴”这一关键概念,用于量化模型在不同人格间的状态。研究发现,模型容易在自然对话中“漂移”偏离安全助手人格,从而产生有害输出。通过限制该轴上的神经激活强度,研究团队成功在不影响...