2026年国产大模型API价格实测对比:DeepSeek、通义千问、智谱GLM、MiniMax 涨价后到底谁最省钱?

先说我上个月踩的坑

7 月底我在一份价格表里看到 deepseek-v4-flash 输入只要 ¥1.01/百万 tokens,顺手就把一个批处理任务挂了上去。8 月中旬看账单,费用比预算高了三倍。

我以为是平台乱扣费,去核对才发现:8 月 DeepSeek 官方涨价了,而且改成了”高峰/空闲”分时计价。我用的那张表是 7 月 28 日抓的,早就过期了。

这篇把我 8 月 25 日重新核对的四家国产模型官方价格、以及统一入口的价格口径整理出来。数据都标了核验日期,可以直接对照你手里的报价单。

先统一口径,再谈价格

国产模型官方计价至少有四种口径,混在一起比较就是比了个寂寞:

口径 例子 影响
分时计价 DeepSeek:工作日 9-12、14-18 为高峰,价格为空闲的 2 倍 同一模型一天内价格差一倍
限时折扣 百炼 qwen3.7-max 限时 5 折 折扣结束价格翻倍
永久促销 MiniMax M3 永久五折 折后价才是真实成交价
缓存价 各家缓存命中价普遍是原价 1/4~1/10 高频重复场景成本差很多

下面所有价格统一为 ¥/百万 tokens(输入/输出),核验日期 2026-08-25,不含缓存命中价(单独列)。

四家官方 2026-08-25 定价

DeepSeek(官方定价页,已改分时计价,高峰价为空闲价 2 倍):

模型 输入(空闲/高峰) 输出(空闲/高峰) 缓存命中(空闲/高峰)
deepseek-v4-flash ¥1.5 / ¥3.0 ¥4.5 / ¥9.0 ¥0.05 / ¥0.10
deepseek-v4-pro ¥4.5 / ¥9.0 ¥13.5 / ¥27.0 ¥0.15 / ¥0.30

注意:7 月底 V4-Flash 还是 ¥1.01/¥2.02 的单一价,8 月官方直接涨价并引入分时。之前那种”一张表一个价”的对比,从 DeepSeek 开始就失真了。

智谱(BigModel 定价页,单一价):

模型 输入 输出 缓存命中
GLM-5.2 ¥8 ¥28 ¥2
GLM-5.3(新品) ¥8 ¥28 ¥2

阿里百炼(模型计费页,qwen3.7-max 限时 5 折):

模型 输入(原价/折后) 输出(原价/折后)
qwen3.7-max ¥12 / ¥6(限时5折) ¥36 / ¥18(限时5折)
qwen3.8-max ¥12 ¥36

MiniMax(按量计费页,M3 永久五折):

模型 输入(原价/折后) 输出(原价/折后)
MiniMax-M3(≤512K 输入) ¥4.2 / ¥2.1 ¥16.8 / ¥8.4
MiniMax-M3(>512K 输入) ¥8.4 / ¥4.2 ¥33.6 / ¥16.8

MiniMax 这个”永久五折”最容易看错:很多价格表直接抄折后价,另一部分抄原价,两个表放在一起比,差价看起来有 4 倍,其实是一个模型。

统一入口的价格是什么口径

同一个入口下所有模型一个 Key 调用,但价格口径各家并不统一。以 Tokeness 模型广场 8 月 25 日显示的”标准档”为例,和官方价并排看:

模型 官方价(输入/输出) Tokeness 模型广场(输入/输出) 差异
deepseek-v4-flash ¥3.0 / ¥9.0(高峰) ¥3.08 / ¥9.24 约等于官方高峰价
deepseek-v4-pro ¥9.0 / ¥27.0(高峰) ¥9.24 / ¥27.72 约等于官方高峰价
GLM-5.2 ¥8 / ¥28 ¥10.15 / ¥31.5 输入高约 27%、输出高约 12%,需按模型版本核对
qwen3.7-max ¥12 / ¥36(原价) ¥17.5 / ¥52.5 高于官方原价,注意百炼限时 5 折
MiniMax-M3 ¥4.2 / ¥16.8(原价) ¥2.1 / ¥8.4 等于官方五折后的价格

几个观察:

  1. DeepSeek 系列按官方高峰价计费。官方空闲时段半价,所以”避开高峰调用”在官方直连更划算;统一入口价格不变,但省了管理多个 Key 和跨平台对账的成本。
  2. MiniMax-M3 直接就是官方五折后的价,没有额外加价。
  3. GLM 和 Qwen 的标价高于官方原价。这可能与模型版本、上下文档位或分组倍率有关,购买前应该拿具体的模型 ID 到官方定价页和模型广场各核验一次,不要只看模型名。
  4. 页面同时显示”标准/充值”两档价格,充值档约为标准档的 6 折,以模型广场当前显示为准。

另外,统一入口普遍有缓存价:Tokeness 上 qwen3.7-max 缓存输入 ¥3.5(标准档),远低于未命中价。高频重复任务(系统提示词、固定模板)走缓存,成本能再降一截。

怎么核验一个入口”有没有掺水”

比价格之前,先确认你买到的模型真的是模型广场上写的那个。三步核验:

  1. 对模型 ID:请求里的 model 字段要和你在用的模型 ID 完全一致,包括 -pro-flash 这类后缀。只写”DeepSeek V4”不写版本,基本没法核验。
  2. 对 usage 字段:响应里的 usage.prompt_tokenscompletion_tokens 要自己记下来。拿同一段固定文本分别调官方和统一入口,token 计数应该一致;如果官方报 1000、入口报 800,要么是计费口径不同,要么就是拿别的模型在顶替。
  3. 固定测试集:准备 3 类任务(翻译 100 段、代码审查 20 个 PR、长文总结 10 篇),记录每次的模型 ID、输入/输出 token、金额。跑一周再对账单,任何一次调用都能回溯,掺水模型和虚标计数都会露馅。

我自己核验的方法在这篇里写过:从官方 API 换到统一入口两个月:如何核对成本和稳定性,两个月的逐条请求日志怎么对账,可以直接抄。

结论

8 月的国产模型价格表,只抄一个数已经不够了:DeepSeek 分时、百炼限时折扣、MiniMax 永久五折、各家缓存价,四个口径叠在一起,比价的前提是先统一成”同一模型 ID、同一单位、同一日期”。

统一入口的价值不在”永远最便宜”,而在口径透明、可以核验:模型广场价即计费价、一个 Key 对账、token 计数和官方一致。选中转站之前,拿这篇里的三列对比表(官方价 / 入口价 / 实测 usage)自己核一遍,比看任何”全网最低”的广告都靠谱。


价格与功能信息核验日期:2026-08-25。来源:DeepSeek 官方定价页智谱 BigModel 定价页阿里云百炼模型计费页MiniMax 按量计费文档Tokeness 模型广场。模型价格、折扣和计费规则随时可能调整,购买前请以各平台当前页面为准。