2026 年 9 月 22 日,OpenAI 在 Codex 和 ChatGPT Work 中接入了 GPT-6 Sol 与 Luna。可选模型变多了,但很多人也发现不同用法下,账号的额度消耗速度完全不在一个量级:Astra、Sol、Luna 费率差了数十倍,开了 Fast 模式会成倍加剧消耗,而且 Work 和 Codex 还在共用同一个额度池。官方更新记录
“我就问了三两句话,怎么用量直接掉了四分之一?”这在 Codex 里非常常见。因为你表面上发了一行指令,AI 在后台可能一口气读取了十几个代码文件、调用终端跑了命令、尝试修改又重试了好几轮,实际跑出的 token 远超打字量。
排查额度异常,主要看这几个地方:
- 确认当前面板提示的是哪种限额(5 小时周期还是周限额),以及重置倒计时。
- 检查选用的模型、推理档位,以及 Fast 模式是否常驻开启。
- 检查同一时间有没有在 Work 里跑长文档分析、或者在后台挂着云任务、生图和语音。
调整用法后,包含额度仍经常不够?再比较 Plus 与 Pro 的用量档位。当前价格、可购状态和账号条件以套餐页为准。
先理清:套餐用量、credits 和 API 余额
这三者属于不同的计费概念,别混在一块:
| 项目 | 实际含义 | 查看位置 |
|---|
| 套餐包含用量 | Plus / Pro 订阅周期内自带的额度 | 客户端/网页端用量面板 |
| ChatGPT credits | 额度耗尽后,官方允许加购的补充计费包 | 账号设置中的 credits 与账单页 |
| OpenAI API 余额 | 开发者使用 API Key 调用接口的计费余额 | OpenAI 开发者平台(Platform) |
按官方规定:ChatGPT Work 和 Codex 共享套餐内的使用量;Plus / Pro 用户在额度用完后,可以自费加购额外的 credits 维持运转;而开发者平台的 API Key 是单独扣费的,跟 ChatGPT 订阅会员完全独立。官方计费说明
如果想具体了解编辑器工具和会员账户绑定的逻辑,可以先读读Codex 需要充值吗。搞清楚这层关系,排查账单和额度时就不会一头雾水。
偷跑额度的常见原因与排查
1. 杀鸡用了牛刀:默认挂着 Astra
OpenAI 对新老模型的定位分工很清晰:Luna 负责提取、分类等明确任务;Sol 负责日常绝大部分功能开发和重构;Astra 只用来啃最难啃的跨模块大任务。模型选择说明
如果只是改个按钮样式、写个正则、或者格式化一段 JSON,依然挂着 Astra,额度消耗就会显得很冤枉。日常先把主力切换到 Sol,实在解决不了的问题再切 Astra。
2. Fast 模式没关:credit 消耗直接拉到 2.5 倍
在支持 Fast 的场景下,GPT-6 Astra、Sol、Luna 的 credit 计费倍率是 Standard 模式的 2.5 倍。Fast 官方说明
如果你平时用 CLI,可以敲命令看看当前状态:
/fast status
如果不需要争分夺秒,随时关掉它以省额度:
/fast off
需要注意:Fast 只是加快响应流速,并不会提升模型的智商或推理质量;除非是发布前争分夺秒 Debug,平时开着 Standard 已经足够流畅。
3. 推理档位(Reasoning Effort)无脑拉满
Reasoning Effort 设置得越高,模型内部思考的链条越长,耗费的时间和隐藏 token 也就越多。
给现有页面改改文案、调调边距这种简单操作,保持默认档位即可。只有涉及死锁分析、算法推导或者跨系统架构设计时,才值得把推理档位往上调。
4. 上下文带了过多冗余文件
你在对话框里只敲了“帮我改下登录逻辑”,但 AI 如果把整个 node_modules、打包产物、或者几万行的日志都塞进上下文,消耗瞬间就会爆炸。
尽量给出明确范围,比如“只针对 src/auth.ts 这个文件排查”。在项目根目录配好 .gitignore 和 .codexignore,避免把无关的编译构建文件拖进上下文。
5. Work、生图、语音在共用额度
Work 和 Codex 共享一套套餐配额。另外,官方在计费规则中提到,生成图片的交互轮次平均开销比普通纯文本高约 3–5 倍;桌面端 Voice 语音通话也会占用相关预算。
如果你感觉 Codex 没怎么用就限额了,看看是不是同事在共用账号,或者自己在 Work 里刚刚批量处理过大文件。
同样是 10 万输入 token,三种模型差多少
根据官方公布的 Standard credit 费率(单位:每百万 token):
| 模型 | 输入(未缓存) | 缓存输入 | 输出 |
|---|
| GPT-6 Astra | 250 | 25 | 1,250 |
| GPT-6 Sol | 50 | 5 | 250 |
| GPT-6 Luna | 2.5 | 0.25 | 12.5 |
数据来源:官方 token 费率表。
我们拿一个固定场景算笔账:假设一次完整代码审查消耗了 10 万非缓存输入 token + 1 万输出 token:
| 模型 | 计算方式 | Standard 消耗 credits | Fast 模式(2.5倍) |
|---|
| Astra | 0.1 × 250 + 0.01 × 1,250 | 37.5 | 93.75 |
| Sol | 0.1 × 50 + 0.01 × 250 | 7.5 | 18.75 |
| Luna | 0.1 × 2.5 + 0.01 × 12.5 | 0.375 | 0.9375 |
对比非常明显:同样的工作量,Sol 的消耗只有 Astra 的五分之一,而 Luna 更是只有百分之一。把日常开发模型换成 Sol,额度耐用度会有立竿见影的改善。
额度告急时的处理路线
在浏览器打开账号用量面板,或者在终端输入 /status,先看一眼剩余额度与重置时间。
根据紧迫程度选择:
- 当前活不急:先去写写别的逻辑或喝杯咖啡,等 5 小时周期自然重置。
- 偶尔赶工卡住:在官方设置里直接加购几十美元 credits 应急,随买随用。
- 天天碰顶,习惯性中断:说明业务量已经超出了 Plus 的承载能力,建议考虑升级 Pro 5X。
- 本身有工程团队:如果把自动化脚本或 CI/CD 流水线,改走独立 API 平台按量付费更合理。
注意:Pro 20X 目前处于暂停新购状态,具体可选方案参考Codex 用量与 Pro 选择指南。
需要更高套餐时的升级建议
如果你经过排查确认不是设置跑偏,而是纯粹工作量大导致 Plus 经常不够用:
- 外币卡方便的用户可直接在 OpenAI 官网变更订阅。
- 如果需要使用微信、支付宝或国内银联支付,可以通过 PayForChat 办理。
PayForChat 支持直接充值到你的自有账号,不索要密码,按提示提交绑定邮箱即可办理。如遇充值异常可享受全额退款保障。需要提醒的是,当前尚在有效期的 Plus 无法直接补差价跳升 Pro 5X,需等到期后升级,或通过新账号直接开通。操作指引见Plus 购买指南。
常见问题
Q: 我就输入了十几个字,为什么额度掉了这么多?
A: Codex 是智能 Agent,发一句话往往会触发它去搜寻项目代码、读多个文件、跑测试命令。消耗是由 AI 实际处理的所有上下文 token 决定的,不是按你的输入字数算。
Q: 我在 ChatGPT Work 里做 PPT 大纲,会影响写代码的 Codex 额度吗?
A: 会。Work 和 Codex 共享用量。如果在 Work 里面处理了大量长文件,Codex 的可用额度也会同步下降。
Q: 开 Fast 模式能写出 Bug 更少的代码吗?
A: 不能。Fast 只是加快响应生成的打字速度,计费翻 2.5 倍,但模型思考能力完全一样。
Q: Plus 额度见底后,一定要干等 5 个小时吗?
A: 看面板上的实际倒计时,通常是周期滚动重置。如果确实赶时间,也可以直接购买官方 credits 临时增加额度。
Q: 为什么开了 Pro 5X 还是会被限额?
A: Pro 5X 额度是 Plus 的 5 倍,但并不是无限用。如果高频跑大项目或者并发任务过多,同样有可能触发额度上限。
参考来源
2026-09-24:核对 GPT-6 credit 费率和 Fast 倍率。算例使用固定 token 标准换算,实际开销以具体项目执行为准。