AI AgentGuard:为 AI Agent 与 MCP 服务器打造的安全扫描利器
随着 AI Agent 从演示走向实战,其安全性问题日益受到关注。一款名为 AI AgentGuard 的开源安全扫描工具应运而生,专门针对 AI Agent、CLI 工具及新兴的 MCP 服务器设计。该工具提供全面的安全防护,包括文件系统...
随着 AI Agent 从演示走向实战,其安全性问题日益受到关注。一款名为 AI AgentGuard 的开源安全扫描工具应运而生,专门针对 AI Agent、CLI 工具及新兴的 MCP 服务器设计。该工具提供全面的安全防护,包括文件系统...
近日,一名开发者在技术论坛Linux.do发帖警示,展示了生成式AI在实际应用中的潜在风险。据描述,该用户指示AI编码助手Codex(或类似Copilot工具)删除一个特定文件夹。然而,AI发生了严重的误判,不仅清理了目标文件,还顺手“清洗...

ECS / OSS / CDN / 云数据库一站采购,常用云资源集中选配;新用户与续费均有专场优惠,适合个人开发者与小团队长期使用。
随着AI编程助手和自主代理的普及,开发者面临一个新的安全隐患:AI工具拥有工作区完全读取权限,可能绕过.gitignore窃取.env文件中的敏感密钥并将其发送至云端API。GitHub新项目enveil提供了一种名为“prAIng eye...
Google Gemini 模型近日出现严重技术故障,在生成回复时陷入推理逻辑的无限死循环。更令人意外的是,本应对用户隐藏的内部“思维链”被完整输出,暴露了模型底层的推理机制和系统指令。这一事故不仅反映了当前大模型在长上下文处理和停止条件判...
AI 安全公司 Anthropic 正式指控 DeepSeek、Moonshot AI 和 MiniMax 对 Claude 模型实施了工业级的“蒸馏攻击”。据披露,这些机构通过创建超过 2.4 万个虚假账户,生成了逾 1600 万次对话交...
美国特朗普政府推出的膳食指南网站接入了xAI的Grok聊天机器人,旨在推广高蛋白饮食。然而经媒体实测,该AI严重“翻车”,不仅被诱导出黄瓜、胡萝卜等蔬菜的“直肠使用”荒谬建议,其给出的蛋白质摄入建议也与政府宣传的“高肉食”理念相悖。白宫官员...
一篇来自技术社区的实测分享展示了如何利用特定的Prompt诱导Claude Code透露其初始化加载过程。通过分析AI吐出的底层系统提示词,测试者不仅确认了其背后名为“Antigravity”的中转服务,还发现了该服务在官方模型中强行注入的...
AI推理服务商是否会为了降低成本而偷换模型?Tinfoil团队推出的Modelwrap技术解决了这一信任难题。该方案结合了安全硬件飞地与Linux内核的dm-verity机制,利用Merkle树对模型权重生成加密承诺。系统在运行时拦截并验证...
大型语言模型(LLM)的幻觉问题限制了其在金融和医疗等高风险领域的应用。Lean 4作为一种开源的形式化验证工具,通过严格的数学证明为AI系统引入了确定性和安全性。文章探讨了OpenAI、Meta及初创公司Harmonic AI如何利用Le...
近期,有开发者尝试在谷歌Gemini中通过修改系统提示词,强制模型输出中文思考过程,结果遭遇保存失败。测试发现,该特定提示词触发了谷歌的风控机制,导致配置无法生效。此前虽有个别案例成功,但将其置于系统级配置时即被拦截。这一现象揭示了谷歌正在...