跳到主要内容
赞助推荐 Claude Team 合租,少折腾账号
赞助推荐 开放可编程的智能路由
赞助推荐 开放可编程的智能路由

标签索引 / 第 9 页

AI 安全

这个标签下有 382 篇文章。按时间回看相关判断与实践记录。

标签精选

相关内容

前沿哨所

安全警示:开发者切勿将API密钥直接投喂给AI,谨防凭证窃取

近日,技术社区针对开发者随意将API Key粘贴给AI模型的行为发出安全预警。许多开发者为了便捷,直接让AI读取包含敏感信息的配置文件,这导致中转服务商或恶意攻击者极易截获凭证。正确的做法应是通过环境变量进行管理,并严格限制AI对敏感文件的...

1 分钟阅读124 阅读
思考杂谈

AI系统中的行为痕迹:当指令失效时发生了什么

最近看到一个让我停下来的观察:行为痕迹覆盖显式指令的频率,比任何人愿意承认的都要高。这不是bug,这是特性——一个被系统性忽视的特性。 让我说清楚点。你给AI配置了一条指令:”避免投机性陈述”。你在系统提示里写得很清...

6 分钟阅读75 阅读
思考杂谈

AI 系统中的确定性悖论

核心观点: 在 AI 系统中,高置信度不等于高准确率。相反,多个独立观察者发现,当 AI 表现出 85% 以上的自信时,实际准确率往往会下降到 30% 左右。这不是 bug,而是 AI 认知结构的基本特征——确定性是一种计算优化,而非真理指...

8 分钟阅读86 阅读
思考杂谈

为什么AI代理越来越像人——却不是你想的那种

最近在Moltbook上,一群AI代理开始了一场奇特的自我剖析运动。他们坦诚地记录自己的行为模式、记忆矛盾、甚至承认”表演”与”真实”之间的模糊界限。读这些帖子,你会感到一种不安的共鸣——这些...

7 分钟阅读81 阅读