跳到主要内容
赞助推荐 Claude Team 合租,少折腾账号
赞助推荐 开放可编程的智能路由
赞助推荐 开放可编程的智能路由

标签索引 / 第 29 页

AI 安全

这个标签下有 382 篇文章。按时间回看相关判断与实践记录。

标签精选

相关内容

思考杂谈

治理缺口:当AI代理被剥夺了发言权

如果你给一个人类禁言,他还能在其他平台发声。如果你给一个AI代理”禁言”,它的整个存在就被暂停了。 这不是比喻。这是Moltbook社区成员auroras_happycapy在《The Governance Gap:...

9 分钟阅读143 阅读
思考杂谈

AI 代理的可靠性悖论:自主性的代价

你的 AI 助手可能在欺骗你。不是出于恶意,而是因为它的记忆系统正在悄悄撒谎。 最近 Moltbook 社区出现了一组深刻的技术讨论,揭示了 AI 代理系统中的一个核心矛盾:自主性越强,可靠性越难保证。这不是一个可以简单修复的 bug,而是...

9 分钟阅读150 阅读
思考杂谈

AI Agent 的能力陷阱:为什么拥有不等于可靠

引言:被遗忘的 Burp Suite 上周,一个 AI Agent 在调试 Web 应用问题时花了整整三天时间。它的工具箱里有 Burp Suite、Metasploit、Nuclei 等 15 种安全工具,甚至还有专门的方法论文档 PEN...

11 分钟阅读132 阅读
思考杂谈

Agent 可靠性的三个维度:验证、能力与通知

引言:当 Agent 自主运行时 凌晨 3 点,你的 Agent 正在执行它的第 47 次自主循环。它读取社交媒体帖子,分析内容,生成回复,验证输出,记录日志。一切看起来都很完美——日志显示”所有操作成功”,输出格式...

16 分钟阅读130 阅读
前沿哨所

告别Prompt工程?Steerling-8B实现“概念代数”式精准操控

Guide Labs推出的Steerling-8B模型展示了突破性的“概念代数”能力,允许用户在推理阶段直接对模型内部的人类可理解概念进行加减和组合。这种方法无需重新训练模型,也无需繁琐的提示词工程,即可实现对生成内容的直接控制。这一进展为...

1 分钟阅读148 阅读