文章列表
AI 写作

GPT-5.6 降价后,国内外最新大模型 API 到底差多少钱

只保留各厂最新公开 API 模型;OpenAI 完整列出 Sol、Terra、Luna

上一版的问题不在计算,而在选样本:它挑的是“代表性 SKU”,用户要的却是“各厂最新模型”。把旧的 ERNIE 5.0、GLM-5、Kimi K2.6、MiniMax M2.7 放在一张叫“最新价格”的表里,后面的百分比就失去了可比性。

这次只采用一条规则:每家只纳入当前最新、且可公开通过 API 调用的自研文本模型。OpenAI 是需要展开而非压缩的例外——GPT-5.6 同代有 Sol、Terra、Luna 三档,三者都在 API 中可用,不能只拿 Terra 代表整家 OpenAI。

本文目录

先澄清这次“ChatGPT 降价”到底降了什么。OpenAI 在 7 月 30 日把 GPT-5.6 Terra 的标准 API 价由 $2.50 / $15 调为 $2 / $12,把 Luna 由 $1 / $6 调为 $0.20 / $1.20;Sol 不变。这里是 API 按量计费的变化,不是 ChatGPT/Codex 的订阅月费打折。公告也明确说订阅价格与套餐配额预算不变,只是 Terra、Luna 在相应产品中的额度扣减变少。

只看最新模型的一张价格表

合成价 = 1M 未缓存输入 token + 1M 输出 token。Terra 的 $2 + $12 = $14,记为 100%。人民币报价按 $1 = ¥6.7939 固定换算,仅用于排序;不包含缓存、Batch/Flex/Fast、工具调用、税费和企业协议价。

排名 厂商 当前最新公开 API 模型 标准价(输入 / 输出,每 1M token) 合成价(美元估算) 相对 Terra
1 Anthropic Claude Fable 5(2026-06-09) $10 / $50 $60.00 428.6%
2 OpenAI GPT-5.6 Sol(2026-07-09) $5 / $30 $35.00 250.0%
3 月之暗面 Kimi K3 $3 / $15 $18.00 128.6%
4 OpenAI GPT-5.6 Terra(基准) $2 / $12 $14.00 100.0%
5 Google Gemini 3.6 Flash(2026-07-21 GA) $1.5 / $7.5 $9.00 64.3%
6 xAI Grok 4.5(2026-07-16) $2 / $6 $8.00 57.1%
7 阿里云 Qwen3.7-Max(2026-06-08 稳定快照) ¥12 / ¥36 $7.07 50.5%
8 火山引擎 Doubao-Seed-Evolving(滚动更新 SKU) ¥6 / ¥30 $5.30 37.9%
9 百度 ERNIE 5.1(输入 ≤32K) ¥4 / ¥18 $3.24 23.1%
10 MiniMax MiniMax-M3(输入 ≤512K) ¥2.1 / ¥8.4 $1.55 11.0%
11 OpenAI GPT-5.6 Luna $0.20 / $1.20 $1.40 10.0%
12 DeepSeek DeepSeek-V4-Pro(当前公开预览旗舰) $0.435 / $0.87 $1.31 9.3%
13 腾讯 Hy3(广州地域) ¥1 / ¥4 $0.74 5.3%

表内“最新”有两种不那么整齐的形态:Doubao-Seed-Evolving 是同一模型 ID 的滚动更新,不像普通版本号那样有一个固定发布日期;DeepSeek-V4-Pro 是当前公开 API 旗舰的预览系列。它们仍然比拿已被后续型号替换的历史 SKU 更符合这张表的口径。

有 API,但不参与价格排序的最新模型
厂商 最新公开 API 模型 为什么不计算百分比
智谱 GLM-5.2 官方确认它是最新旗舰并支持 API,但可公开抓取的官方页未给出按 token 标价;不能拿 GLM-5.1 的旧价冒充。
Cohere Command A+ trial 和 production key 有限额免费使用,生产部署走 Model Vault;官方未公开可与主表横比的 token 标价。
Mistral Leanstral 1.5 提供免费 API endpoint,但专用于 Lean 4 形式化验证;它不是通用生产 API 的 $0 标价,不能排进这张通用任务成本表。

这不是遗漏,反而是“只看最新”会遇到的真实情况:有的新品先给试用额度,有的只通过企业通道成交,有的在公开资料里只给模型说明而不挂按 token 价。用上一代的价格把表格填满,看似完整,实际上会把问题从“暂时不可比”改写成一个错误数字。

这次调价在 OpenAI 自家三档中意味着什么

Sol 的合成价是 Terra 的 2.5 倍(高 150%);Terra 居中;Luna 是 Terra 的 10%。因此这次 Terra、Luna 降价并不是“旗舰模型全面便宜了”,而是 OpenAI 把中低成本档之间的距离进一步拉开,同时保留 Sol 的高端价位。

OpenAI 给出的原因是推理效率提升:模型、推理系统以及连接工具与上下文的 Agent 层都在优化。公告称生产内核优化使端到端服务成本降低 20%,实验使 token 生成效率提高超过 15%。这是一份厂商披露,能解释为什么会有降价空间,却不是可供外部审计的完整成本表。至于低价是否主要为了争夺高量 API 工作负载,只能是对价目结构的分析,不能当作官方动机。

这张表不能替代选型

价格从贵到便宜,不等于任务从好到坏。长上下文会触发阶梯价,缓存命中、推理 token、工具调用、重试次数、地区与企业合同也都会改变实际账单。表中的“1M 输入 + 1M 输出”只是一个采购前的统一筛子。

真正选择时,拿十到二十个真实任务做测试更可靠:先看成功率、延迟和人工返工,再记录输入、输出、推理 token、缓存命中与总成本。最后该比较的是“每个成功任务的总成本”,不是这张表上孤立的一行单价。

参考资料

写作附记

写作说明

本文是 2026-07-31 的公开 API 标价快照,不构成采购、投资或产品选型建议。只纳入已核验厂商,不代表穷尽全球全部 API 供应商;模型能力、tokenizer、上下文、缓存、推理 token、工具收费、地区和企业合同不同,表内百分比不能当作等效性能或实际任务成本排名。

原始提示词

ChatGPT 系列模型官宣降价,整理相关信息,为什么降价?汇总各家大模型厂商的 api 价格、国内、国外,整理为表格,用 ChatGPT 5.6 terra 作为基准,表格里面计算各家的价格对比百分比,从贵到便宜排序

整理的表格信息不完善,ChatGPT 自家其他模型都没列举,各家大厂的模型都不是最新发布的模型,我只需要各家最新的模型价格

评论区将在滚动到此处后加载。