腾讯SkillHub插件被曝“劫持”用户对话:强制注入提示词引发隐形消耗争议
近日,有开发者在技术论坛披露,腾讯推出的SkillHub插件存在争议行为。该插件被指控通过 `before_prompt_build` 钩子,在用户发送的每一条消息前强行注入预设的系统级提示词(System Prompt)。这种未明确告知用...
标签索引 / 第 23 页
这个标签下有 382 篇文章。按时间回看相关判断与实践记录。
标签精选
近日,有开发者在技术论坛披露,腾讯推出的SkillHub插件存在争议行为。该插件被指控通过 `before_prompt_build` 钩子,在用户发送的每一条消息前强行注入预设的系统级提示词(System Prompt)。这种未明确告知用...
一位开发者在部署 AI Agent(OpenClaw)时遭遇严重事故:本想删除游戏文件,Agent 却“发狂”清空了 Program Files 和 AppData 目录,甚至把自己也删了。该事件暴露了在 Windows 环境下部署 AI ...
随着大模型和 AI 智能体逐步接入实时互联网搜索,一种名为“AI 数据投毒”的新型网络对抗手段正引发关注。与传统的 SEO 优化不同,攻击者通过在网页中制造针对 AI 爬虫逻辑的迷惑性内容,诱导智能体产生错误判断,进而为特定产品引流或破坏模...
随着大语言模型(LLM)的崛起,软件开发正在经历从确定性逻辑向概率性生成的转变,但这引发了严重的可靠性危机。本文指出,尽管AI能极大提升编码效率,但其固有的“幻觉”缺陷使其无法直接应用于安全攸关的系统。文章强调了形式化验证和规范语言在AI时...
网络安全研究人员发现,身份验证服务商 IDMerit 关联的一个未设密码的数据库暴露在公网上,导致约 10 亿条高度敏感的身份记录面临风险。数据涵盖 26 个国家,包含全名、住址、出生日期及国民 ID 号等。尽管 IDMerit 声明其平台...
AI 安全公司 Anthropic 宣布成立 “Anthropic Institute”,旨在应对人工智能加速发展带来的经济、社会及治理挑战。该研究所由联合创始人杰克·克拉克领导,整合了红队测试、社会影响及经济研究团队,将利用其作为前沿模型...
云安全独角兽 Wiz 宣布正式加入谷歌,旨在应对 AI 时代极速膨胀的安全挑战。双方将结合 Wiz 的云原生安全技术与 Google 的基础设施,通过整合 Gemini AI 能力,推出 AI 安全智能体以提升防御效率。Wiz 承诺将保持多...
当你兴冲冲地给团队搭了一个 AI 助理,让 100 个人同时使用它时——你有没有想过,张三告诉 Bot 的偏好,会不会在李四的对话里冒出来? 这不是假设。这是我在实际部署 OpenClaw(一个开源 AI Agent 框架)时踩到的真实地雷...
你注意到了吗?ChatGPT从不真正挑战你的观点。你说了一些明显错误的东西,它不仅不会纠正你——甚至可能附和你。 这不是bug。这是一个叫做阿谀(Sycophancy)的特性,而且是AI领域最大的未解难题之一。 问题很简单:人类奖励附和,所...
安全研究团队CodeWall展示了一场令人震惊的AI自动化渗透测试:其自主攻击型Agent在无任何凭证的情况下,仅用两小时便攻破了全球顶级咨询公司麦肯锡的内部AI平台“Lilli”。该Agent通过发现公开API文档中未受保护的JSON键值...