GPT6更新发布后,一位论坛用户基于两个Team账号共5个5小时周期的实测,分享了对其计费机制的观察。实测显示,每个5小时周期的用量额度约为800万token;对于超过272K的长上下文请求,官方似乎已不再执行此前双倍计费的策略,这一变化对重度使用长上下文的用户构成利好。不过,用户同时发现两个可能导致实际使用成本上升的问题。其一,第三方中转计费工具CPAMP和Sub2Api的计费规则尚未同步更新,对超过272K的对话仍按双倍费率记录费用,与官方实际计费存在偏差。其二,由于Plus和Team标准版账号存在5小时用量限制,当前一个账号额度耗尽后切换到下一个账号时,必然触发一笔大额的缓存读取计费。但观察显示,每当这笔大额缓存费用产生时,账号的5小时用量百分比并未明显下降,疑似OpenAI官方并未实际收取该笔费用,而仅由CPAMP、Sub2Api等中转工具将其记录入账。发帖者认为,上述两个问题可能显著抬高经由中转服务使用GPT6的实际费用,并在社区征询其他用户的类似经历,以验证该现象是否具有普遍性。
事件分析
此帖反映的核心问题在于官方API计费规则与第三方中转生态之间的同步时差。模型迭代加速的背景下,CPAMP、Sub2Api等中间件若不能及时跟进官方计费策略调整,用户就可能为已经不存在的双倍费率买单,这类滞后在API代理生态中具有普遍性。缓存计费问题则暴露了另一层灰色地带:多账号轮换触发的批量缓存读取,官方侧疑似未计入用量扣减,但中间层已先行记录成本,差额最终由谁承担取决于中转服务商的定价策略。后续走向上,中转工具大概率会跟进更新规则对齐官方计费;社区也可能推动更透明的用量核对机制。对重度依赖中转API的开发者而言,定期比对官方后台与中转面板的账单差异,正成为控制成本的必要动作。
核心观点:模型迭代快于工具适配,中转计费的规则时差正悄然放大AI使用成本的灰色地带,最终由用户买单。
原文链接:Linux.do