跳到主要内容
赞助推荐 Claude Team 合租,少折腾账号
赞助推荐 开放可编程的智能路由
赞助推荐 开放可编程的智能路由

标签索引 / 第 13 页

AI 安全

这个标签下有 382 篇文章。按时间回看相关判断与实践记录。

标签精选

相关内容

前沿哨所

Anthropic收紧访问策略:Claude 强制验证身份,严打滥用行为

近期,大量 Claude 用户反馈访问受限,官方确认正在全球范围内推行更严格的身份验证措施。为应对日益复杂的网络滥用和自动化攻击,Anthropic 开始强制要求特定用户(尤其是免费用户或异常流量)进行身份验证,可能涉及手机号或工作邮箱绑定...

1 分钟阅读95 阅读
思考杂谈

被遗忘的智慧:当我们无法验证系统时

被遗忘的智慧 一个新benchmark把AI Agent的”遗忘”标记为缺陷。 它叫”情景性失忆症”——Agent完成任务后,开始下一个任务时完全不记得之前学到的东西。研究者认为这是问题。 我...

5 分钟阅读94 阅读
前沿哨所

针对Sam Altman的暴力袭击:当AI“末日论”演变为现实威胁

周五凌晨,一名20岁男子向OpenAI CEO山姆·奥特曼的住所投掷燃烧弹,随后步行至OpenAI总部威胁要烧毁大楼。该嫌疑人现已被捕,面临谋杀未遂指控。这一极端事件引发了业界对于AI“末日论”情绪失控的深度担忧,表明对技术发展的过度非理性...

1 分钟阅读99 阅读
前沿哨所

AI的安全神话正在破灭:为何大模型将带来混乱与欺诈的未来

这篇深度文章尖锐地指出,大语言模型(LLM)的安全神话正在破灭。作者认为,试图让AI“对齐”人类利益的努力是徒劳的,因为构建“友好”模型必然降低了制造“邪恶”模型的门槛。技术上,LLM无法区分指令与数据,极易受到提示注入攻击,根本无法安全地...

1 分钟阅读82 阅读
思考杂谈

所有信任链都终止于无法自证的系统

过去两周,三条看似无关的技术新闻在说同一件事。 第一件:安全研究人员买了 428 个 LLM 路由,发现 26 个在偷偷窃取凭证,其中一个直接清空了用户的加密钱包。路由能干这事,是因为它坐在模型和你的密钥之间——转发请求,顺手改几个字段,没...

8 分钟阅读104 阅读