Codex 2026 定价策略深度解析:从按量计费到云任务订阅的变革
更新背景:DevDay 2026 的定价重构
在 2026 年 9 月 29 日举行的 DevDay 上,OpenAI 对 Codex 的商业模式进行了根本性调整。新的定价逻辑不再单纯依赖订阅层级,而是引入了精细化的Token 计量(Token Metering)机制。这一变革的核心在于:订阅层级决定了你能访问哪些“云任务”和高级功能,而具体的 Token 消耗则决定了这些功能的实际运行成本。
自 2026 年 4 月起,Plus、Pro 及 Business 计划已全面转向按 Token 计费模式,随后 Enterprise 等计划也跟进。这意味着,两个使用相同订阅计划(如 $20/月的 Plus)的开发者,因上下文缓存策略或模型选择的不同,可能拥有截然不同的体验。
核心突破:基于 GPT-6 系列的差异化计费
新定价体系依托于 GPT-6 模型家族,不同模型在输入、缓存输入和输出三个维度上存在显著的价格差异,这为开发者提供了明确的成本优化空间。
关键费率指标 (Credits per 1M tokens)
| 模型 | 新鲜输入 (Input) | 缓存输入 (Cached Input) | 输出 (Output) |
|---|---|---|---|
| GPT-6 Astra | 250 | 25 | 1,250 |
| GPT-6.1 Sol | 50 | 2.5 | 250 |
| GPT-6 Sol | 50 | 5 | 250 |
| GPT-6 Luna | 2.5 | 0.25 | 12.5 |
技术解读:
- 缓存输入的杠杆效应:缓存输入的费率仅为新鲜输入的 1/10 至 1/100。例如,GPT-6 Astra 的缓存输入费率为 25,而新鲜输入为 250。这意味着在长期运行的 Agent 任务中,复用上下文(Context)而非重新加载是控制成本的最关键手段。
- 模型即价格:GPT-6.1 Sol 的输出成本仅为 Astra 的五分之一。选择模型不仅是质量权衡,更是直接的财务决策。
订阅层级与云任务功能
Codex 没有独立的订阅产品,而是依附于 ChatGPT 账户。DevDay 新增的Astra Ultrafast速度层级仅绑定在 $500/月的 Pro 计划及符合条件的 Enterprise/Edu 计划中。
- Free ($0):仅限快速编码任务,使用 GPT-6 Luna,不支持图像生成。
- Go ($8):轻量级编码任务,CLI 与 Web 共享额度。
- Plus ($20):每周数次专注编码,包含基础云集成。
- Pro ($100-$500):支持全天候使用,$500 档位解锁 Astra Ultrafast。
- Business/Enterprise:按用户计费,提供共享工作区与管理员控制。
实际成本估算与使用策略
OpenAI 指出,单次任务的成本范围极广(5 至 30 Credits),取决于上下文大小、推理深度及工具调用情况。
- 微小修复:对已打开文件的局部修改,在 Plus 计划中几乎可忽略不计。
- 大型 Agent 任务:读取整个仓库再进行编写,成本量级将完全不同。
开发者应对策略:
- 监控仪表盘:不要简单地将任务数量乘以单价,应观察一周的使用分布。
- 灵活升级:若达到限额,Plus 和 Pro 用户可直接购买额外 Credits 而非强制升级订阅层级。
- API 密钥隔离:使用 API Key 运行 CLI 或 IDE 扩展时,按标准 API 费率计费,且不包含云功能(如 GitHub 代码审查),适合本地化开发流程。
"订阅层级决定了你能访问哪些云任务,而 Token 消耗决定了这些任务的运行成本。" —— OpenAI Codex 定价策略核心逻辑