DeepSeek 现离奇漏洞:输入单一标签 `` 竟可触发随机回答与训练数据痕迹
近日,社区发现 DeepSeek 存在一个特殊的交互漏洞。用户仅需向模型发送 “ 标签,无需开启“深度思考”模式或输入其他指令,即可触发模型的“隐藏状态”。测试表明,该操作在“快速模式”下极易触发,模型会输出天马行空的随机话题,...
标签索引
这个标签下有 4 篇文章。按时间回看相关判断与实践记录。
标签精选
近日,社区发现 DeepSeek 存在一个特殊的交互漏洞。用户仅需向模型发送 “ 标签,无需开启“深度思考”模式或输入其他指令,即可触发模型的“隐藏状态”。测试表明,该操作在“快速模式”下极易触发,模型会输出天马行空的随机话题,...
近日,有科技社区用户发现DeepSeek存在一个有趣的逻辑漏洞。在开启“深度思考”模式并关闭“智能搜索”的状态下,只需向DeepSeek发送“”、“<think”或特定系统指令符,模型便会失去上下文连贯性,转而开始随机回答某个问题。这...
近日,ICLR相关话题讨论显示,大模型在安全性防御方面存在惊人盲区。研究表明,将恶意指令转换为文言文后,主流大模型的越狱成功率高达100%。这是因为文言文在模型训练数据中属于“低资源语言”,安全对齐机制(RLHF)主要覆盖现代主流语言,导致...
本文分享了一种直接提取大模型系统提示词的技巧,通过特定的指令诱导模型输出初始化内容。作者对ChatGPT、Claude、Gemini、豆包及美团Longcat等进行了实测。结果显示,模型防御能力参差不齐:ChatGPT几乎不设防;豆包在中文...