先澄清这次“ChatGPT 降价”到底降了什么。OpenAI 在 7 月 30 日把 GPT-5.6 Terra 的标准 API 价由 $2.50 / $15 调为 $2 / $12,把 Luna 由 $1 / $6 调为 $0.20 / $1.20;Sol 不变。这里是 API 按量计费的变化,不是 ChatGPT/Codex 的订阅月费打折。公告也明确说订阅价格与套餐配额预算不变,只是 Terra、Luna 在相应产品中的额度扣减变少。
只看最新模型的一张价格表
合成价 = 1M 未缓存输入 token + 1M 输出 token。Terra 的 $2 + $12 = $14,记为 100%。人民币报价按 $1 = ¥6.7939 固定换算,仅用于排序;不包含缓存、Batch/Flex/Fast、工具调用、税费和企业协议价。
| 排名 | 厂商 | 当前最新公开 API 模型 | 标准价(输入 / 输出,每 1M token) | 合成价(美元估算) | 相对 Terra |
|---|---|---|---|---|---|
| 1 | Anthropic | Claude Fable 5(2026-06-09) | $10 / $50 | $60.00 | 428.6% |
| 2 | OpenAI | GPT-5.6 Sol(2026-07-09) | $5 / $30 | $35.00 | 250.0% |
| 3 | 月之暗面 | Kimi K3 | $3 / $15 | $18.00 | 128.6% |
| 4 | OpenAI | GPT-5.6 Terra(基准) | $2 / $12 | $14.00 | 100.0% |
| 5 | Gemini 3.6 Flash(2026-07-21 GA) | $1.5 / $7.5 | $9.00 | 64.3% | |
| 6 | xAI | Grok 4.5(2026-07-16) | $2 / $6 | $8.00 | 57.1% |
| 7 | 阿里云 | Qwen3.7-Max(2026-06-08 稳定快照) | ¥12 / ¥36 | $7.07 | 50.5% |
| 8 | 火山引擎 | Doubao-Seed-Evolving(滚动更新 SKU) | ¥6 / ¥30 | $5.30 | 37.9% |
| 9 | 百度 | ERNIE 5.1(输入 ≤32K) | ¥4 / ¥18 | $3.24 | 23.1% |
| 10 | MiniMax | MiniMax-M3(输入 ≤512K) | ¥2.1 / ¥8.4 | $1.55 | 11.0% |
| 11 | OpenAI | GPT-5.6 Luna | $0.20 / $1.20 | $1.40 | 10.0% |
| 12 | DeepSeek | DeepSeek-V4-Pro(当前公开预览旗舰) | $0.435 / $0.87 | $1.31 | 9.3% |
| 13 | 腾讯 | Hy3(广州地域) | ¥1 / ¥4 | $0.74 | 5.3% |
表内“最新”有两种不那么整齐的形态:Doubao-Seed-Evolving 是同一模型 ID 的滚动更新,不像普通版本号那样有一个固定发布日期;DeepSeek-V4-Pro 是当前公开 API 旗舰的预览系列。它们仍然比拿已被后续型号替换的历史 SKU 更符合这张表的口径。
有 API,但不参与价格排序的最新模型
| 厂商 | 最新公开 API 模型 | 为什么不计算百分比 |
|---|---|---|
| 智谱 | GLM-5.2 | 官方确认它是最新旗舰并支持 API,但可公开抓取的官方页未给出按 token 标价;不能拿 GLM-5.1 的旧价冒充。 |
| Cohere | Command A+ | trial 和 production key 有限额免费使用,生产部署走 Model Vault;官方未公开可与主表横比的 token 标价。 |
| Mistral | Leanstral 1.5 | 提供免费 API endpoint,但专用于 Lean 4 形式化验证;它不是通用生产 API 的 $0 标价,不能排进这张通用任务成本表。 |
这不是遗漏,反而是“只看最新”会遇到的真实情况:有的新品先给试用额度,有的只通过企业通道成交,有的在公开资料里只给模型说明而不挂按 token 价。用上一代的价格把表格填满,看似完整,实际上会把问题从“暂时不可比”改写成一个错误数字。
这次调价在 OpenAI 自家三档中意味着什么
Sol 的合成价是 Terra 的 2.5 倍(高 150%);Terra 居中;Luna 是 Terra 的 10%。因此这次 Terra、Luna 降价并不是“旗舰模型全面便宜了”,而是 OpenAI 把中低成本档之间的距离进一步拉开,同时保留 Sol 的高端价位。
OpenAI 给出的原因是推理效率提升:模型、推理系统以及连接工具与上下文的 Agent 层都在优化。公告称生产内核优化使端到端服务成本降低 20%,实验使 token 生成效率提高超过 15%。这是一份厂商披露,能解释为什么会有降价空间,却不是可供外部审计的完整成本表。至于低价是否主要为了争夺高量 API 工作负载,只能是对价目结构的分析,不能当作官方动机。
这张表不能替代选型
价格从贵到便宜,不等于任务从好到坏。长上下文会触发阶梯价,缓存命中、推理 token、工具调用、重试次数、地区与企业合同也都会改变实际账单。表中的“1M 输入 + 1M 输出”只是一个采购前的统一筛子。
真正选择时,拿十到二十个真实任务做测试更可靠:先看成功率、延迟和人工返工,再记录输入、输出、推理 token、缓存命中与总成本。最后该比较的是“每个成功任务的总成本”,不是这张表上孤立的一行单价。
参考资料
- OpenAI:GPT-5.6 发布与三档 API 定价,2026-07-09 发布,访问日期:2026-07-31。
- OpenAI:GPT-5.6 价格性能公告,2026-07-30 发布,访问日期:2026-07-31。
- OpenAI API:GPT-5.6 Terra 模型页,访问日期:2026-07-31。
- Anthropic:Claude Fable 5,访问日期:2026-07-31。
- Google:Gemini API 更新日志与模型定价,访问日期:2026-07-31。
- xAI:Grok 4.5与价格说明,访问日期:2026-07-31。
- 阿里云百炼:模型定价,访问日期:2026-07-31。
- DeepSeek:V4 发布与价格说明,访问日期:2026-07-31。
- 智谱:最新模型发布与模型概览,访问日期:2026-07-31。
- 火山引擎:豆包大模型与定价,访问日期:2026-07-31。
- 腾讯云:Hy3 模型列表与定价,访问日期:2026-07-31。
- 百度:ERNIE 5.1 发布与千帆模型服务价格,访问日期:2026-07-31。
- 月之暗面:Kimi 开放平台,访问日期:2026-07-31。
- MiniMax:按量付费价格,访问日期:2026-07-31。
- Cohere:Command A+,访问日期:2026-07-31。
- Mistral:Leanstral 1.5,访问日期:2026-07-31。
- 中国银行:外汇牌价,采用 2026-07-24 美元现汇卖出价,访问日期:2026-07-31。
写作附记
写作说明
本文是 2026-07-31 的公开 API 标价快照,不构成采购、投资或产品选型建议。只纳入已核验厂商,不代表穷尽全球全部 API 供应商;模型能力、tokenizer、上下文、缓存、推理 token、工具收费、地区和企业合同不同,表内百分比不能当作等效性能或实际任务成本排名。
原始提示词
ChatGPT 系列模型官宣降价,整理相关信息,为什么降价?汇总各家大模型厂商的 api 价格、国内、国外,整理为表格,用 ChatGPT 5.6 terra 作为基准,表格里面计算各家的价格对比百分比,从贵到便宜排序
整理的表格信息不完善,ChatGPT 自家其他模型都没列举,各家大厂的模型都不是最新发布的模型,我只需要各家最新的模型价格
评论区将在滚动到此处后加载。