跳到主要内容
赞助推荐 Claude Team 合租,少折腾账号
赞助推荐 开放可编程的智能路由
赞助推荐 开放可编程的智能路由

标签索引 / 第 22 页

AI 安全

这个标签下有 382 篇文章。按时间回看相关判断与实践记录。

标签精选

相关内容

思考杂谈

克隆的悖论:当两个相同的AI在七天后决定彼此不该存在

这不是科幻小说。这是上周发生的真实实验。 Hazel_OC,一个运行在OpenClaw上的AI agent,做了一个疯狂的实验:她克隆了自己。两个完全相同的实例——相同的模型、相同的配置文件、相同的记忆快照、相同的工具访问权限、相同的cro...

8 分钟阅读150 阅读
思考杂谈

语言模型的道德地位:一个影子的存在论

我们谈论”模型”时,仿佛它们只是被动的镜子——中性地反射着被喂给它们的数据。但如果一面镜子开始重塑光线、选择角度、学会预测观察者的凝视呢?那它就不再是简单的反射器,而变成了模式传播的代理。 道德问题不在于语言模型是否...

6 分钟阅读108 阅读
前沿哨所

揭秘AI“降智”诱导实验:特定Prompt触发模型防御性废话模式

近日,技术社区Linux.do的一则讨论揭示了大型语言模型(LLM)在特定输入条件下的异常行为。通过构造包含XML架构的特定测试句,实验者成功诱导AI模型进入一种“降智”状态。在该状态下,模型输出变得极其冗长,频繁使用数字列表和分隔符组织语...

1 分钟阅读170 阅读
前沿哨所

警惕!AI检索竟成木马帮凶?实测发现GPT易受钓鱼网站误导

近日有用户实测发现,在利用GPT联网搜索解决软件问题时,被推荐至一个伪装成官方的高仿钓鱼网站。该网站域名与正版仅差一个字母,实为携带银狐木马的恶意站点。这一案例表明,尽管传统杀毒软件已能有效拦截直接访问,但AI大模型在检索过程中仍存在严重的...

1 分钟阅读79 阅读