Anthropic 近日更新了安全政策与收费规则,涉及 Opus 5.5、Opus 5 等模型触发安全拦截或回退降级时的计费方式。新规则分为两类情形:其一,若请求在模型尚未开始输出前就被拦截,涉及生物学、蒸馏、前沿大模型研发这三类敏感内容时,拦截或回退动作本身会产生费用;其他类别(如网络安全)在输出前被拦截则不收费。其二,若模型已开始输出后被中途切断,已产生的输入 token 及切断前流出的输出 token,按当时所使用模型的价格计费。例如 Opus 5.5 输出一部分后触发回退降级,该部分输出按 Opus 5.5 价格收费;回退到低配模型后的正式回答则单独计费,按实际作答模型的价格收取,如降至 Opus 5 则按 Opus 5 收费。此外,官方会补发一笔 credit,用于抵消因切换模型导致的缓存失效成本。社区观点认为,将回退与拦截规则明确写入政策是积极信号,相比不透明的处理方式,公开清晰的计费细则更利于开发者预估成本、合理规划调用策略。
事件分析
这一政策调整反映出大模型厂商在安全机制与商业化之间的精细化权衡。技术层面,安全拦截与模型回退涉及流量路由、token 计量与 KV cache 生命周期管理,回退切换必然引发缓存失效并推高推理成本,Anthropic 以 credit 补偿的方式分摊了这部分开销,实质上降低了开发者的实际损失。产业层面,将安全拦截纳入计费体系,意味着高敏感类请求的处理成本由触发方承担,可能直接影响安全研究、红队测试等场景的调用策略与预算安排。后续值得关注的是拦截类别的划分标准与回退阈值是否进一步公开,以及其他头部厂商是否会跟进类似的透明化计费规范,形成行业通行参照,减少厂商间的规则差异带来的迁移成本。
核心观点:把安全回退写进账单,Anthropic 将黑箱机制工程化、透明化,为行业计费规范树立了参照标杆。
原文链接:Linux.do