Codex幽灵扣费:Token不翼而飞

Codex中文版一键安装,送1000万token,国内大模型

一夜醒来,额度被“偷”了

明明已经合上电脑,甚至休假两周,一条提示词都没发过,账户里的周额度却在悄悄蒸发。最近,不少海外开发者在社区里反映,OpenAI的编程智能体Codex存在“幽灵扣费”:没有操作,额度照掉。

为了验证这不是错觉,建筑师兼AI从业者Osvaldo Chávez做了一次极端测试。他关闭了ChatGPT Work、Codex和网页版ChatGPT的所有自动化与后台任务,只用竞品工具干活,设备仅留一台MacBook和一部iPhone。8小时静默后,他的周额度仍然下降了约2%,数据面板显示当天消耗了830万个Token。这个体量相当于十几部《红楼梦》的文字量。

更蹊跷的是第二轮测试。他对GPT-5.3 Spark发了一句“审计我今天用过的Token”,模型只输出几千字符,5小时额度却从100%跌到96%,周额度再降2%。

并非个例:休假回来,30%额度没了

类似投诉早就存在。GitHub的openai/codex仓库里,有开发者发帖称休假两周几乎没开电脑,额度少了约30%;回来后发一条普通消息,瞬间吃掉5小时窗口的46%。OpenAI开发者社区中,Business订阅用户反映轻度使用一小时就撞上5小时封顶线;还有人发现GPT-5.6做同样的活,额度消耗却是GPT-5.5的两到三倍。

这些案例有一个共同点:用户无法从后台看到清晰的消耗明细,只能靠体感猜。有人甚至通过断网、抓包、极限停用来“破案”。这种自证方式本身就很说明问题——当用户需要像侦探一样验证官方账单,信任已经亮起红灯。

官方回应:从“怀疑黑产”到“缓存命中率下降”

舆论发酵后,Codex负责人Tibo先宣布活跃用户突破2000万,同时暗示有人把订阅套餐转成API流量倒卖,触发了风控。这番回应让付费用户更不满。知名推主Deepu直言:几天涌入500万用户,成本压力可以理解,但很多付费用户在没有通知的情况下被腰斩50%以上额度,连基本尊重都没有。

眼看争议失控,官方宣布给ChatGPT Work和Codex付费用户发放“Banked Reset”重置券,随后又给出技术解释:部分用户缓存命中率下降,导致额度消耗加快。

用一张重置券安抚情绪,看似大方,实则回避了核心问题:为什么账单会失真?如果只是缓存问题,为什么用户完全无操作时也会扣费?

Codex不是聊天框,而是一个“数字员工”

要理解扣费异常,得先分清ChatGPT和Codex的区别。网页聊天是一问一答的线性交互;Codex则是带自主执行权限的状态机。它会自动读取代码仓库、派生多个子代理去检索规划、调用终端跑测试、触发自动审查,再把所有上下文打包回传给模型继续推理。整个过程不需要用户逐条下达指令。

有开发者抓包发现,修改默认模型配置后,底层代理会在历史记录里反复自我调用;一次自动审批甚至可能把几十万Token的上下文完整打包,只为让模型输出一个“yes”。

OpenAI的计费机制放大了这种消耗。官方费率表里的缓存输入本意是降低成本:命中缓存时,费用只有正常输入的十分之一甚至更低。但一旦缓存机制出Bug,或同步发生扰动,原本10个信用点的任务就可能按100个信用点全额扣取。再加上后台记忆整理、子代理反思、失败重试,用户的编辑器虽然静止,云端的“数字员工”却可能还在空转。

更值得警惕的是,这种黑盒扣费并非Codex独有,而是智能体AI商业化必须回答的考题。传统软件时代,账单是确定性的:点一下滤镜算一次,开几个核收几个核的钱。智能体时代,AI自己决定查多少次文件、跑多少个子代理,用户却看不到“电表”。

用户需要的不是一张重置券,而是一本明白账:哪个任务消耗了多少Token?哪次调用命中了缓存?哪个子代理在后台空转?如果厂商一边宣称AI能接管复杂工作,一边让用户在睡梦中被偷光额度,那么再大的用户增长数字,也换不来真正的信任。