2026年国产大模型API价格实测对比:DeepSeek、通义千问、智谱GLM、MiniMax 涨价后到底谁最省钱?
先说我上个月踩的坑
7 月底我在一份价格表里看到 deepseek-v4-flash 输入只要 ¥1.01/百万 tokens,顺手就把一个批处理任务挂了上去。8 月中旬看账单,费用比预算高了三倍。
我以为是平台乱扣费,去核对才发现:8 月 DeepSeek 官方涨价了,而且改成了”高峰/空闲”分时计价。我用的那张表是 7 月 28 日抓的,早就过期了。
这篇把我 8 月 25 日重新核对的四家国产模型官方价格、以及统一入口的价格口径整理出来。数据都标了核验日期,可以直接对照你手里的报价单。
先统一口径,再谈价格
国产模型官方计价至少有四种口径,混在一起比较就是比了个寂寞:
| 口径 | 例子 | 影响 |
|---|---|---|
| 分时计价 | DeepSeek:工作日 9-12、14-18 为高峰,价格为空闲的 2 倍 | 同一模型一天内价格差一倍 |
| 限时折扣 | 百炼 qwen3.7-max 限时 5 折 | 折扣结束价格翻倍 |
| 永久促销 | MiniMax M3 永久五折 | 折后价才是真实成交价 |
| 缓存价 | 各家缓存命中价普遍是原价 1/4~1/10 | 高频重复场景成本差很多 |
下面所有价格统一为 ¥/百万 tokens(输入/输出),核验日期 2026-08-25,不含缓存命中价(单独列)。
四家官方 2026-08-25 定价
DeepSeek(官方定价页,已改分时计价,高峰价为空闲价 2 倍):
| 模型 | 输入(空闲/高峰) | 输出(空闲/高峰) | 缓存命中(空闲/高峰) |
|---|---|---|---|
| deepseek-v4-flash | ¥1.5 / ¥3.0 | ¥4.5 / ¥9.0 | ¥0.05 / ¥0.10 |
| deepseek-v4-pro | ¥4.5 / ¥9.0 | ¥13.5 / ¥27.0 | ¥0.15 / ¥0.30 |
注意:7 月底 V4-Flash 还是 ¥1.01/¥2.02 的单一价,8 月官方直接涨价并引入分时。之前那种”一张表一个价”的对比,从 DeepSeek 开始就失真了。
智谱(BigModel 定价页,单一价):
| 模型 | 输入 | 输出 | 缓存命中 |
|---|---|---|---|
| GLM-5.2 | ¥8 | ¥28 | ¥2 |
| GLM-5.3(新品) | ¥8 | ¥28 | ¥2 |
阿里百炼(模型计费页,qwen3.7-max 限时 5 折):
| 模型 | 输入(原价/折后) | 输出(原价/折后) |
|---|---|---|
| qwen3.7-max | ¥12 / ¥6(限时5折) | ¥36 / ¥18(限时5折) |
| qwen3.8-max | ¥12 | ¥36 |
MiniMax(按量计费页,M3 永久五折):
| 模型 | 输入(原价/折后) | 输出(原价/折后) |
|---|---|---|
| MiniMax-M3(≤512K 输入) | ¥4.2 / ¥2.1 | ¥16.8 / ¥8.4 |
| MiniMax-M3(>512K 输入) | ¥8.4 / ¥4.2 | ¥33.6 / ¥16.8 |
MiniMax 这个”永久五折”最容易看错:很多价格表直接抄折后价,另一部分抄原价,两个表放在一起比,差价看起来有 4 倍,其实是一个模型。
统一入口的价格是什么口径
同一个入口下所有模型一个 Key 调用,但价格口径各家并不统一。以 Tokeness 模型广场 8 月 25 日显示的”标准档”为例,和官方价并排看:
| 模型 | 官方价(输入/输出) | Tokeness 模型广场(输入/输出) | 差异 |
|---|---|---|---|
| deepseek-v4-flash | ¥3.0 / ¥9.0(高峰) | ¥3.08 / ¥9.24 | 约等于官方高峰价 |
| deepseek-v4-pro | ¥9.0 / ¥27.0(高峰) | ¥9.24 / ¥27.72 | 约等于官方高峰价 |
| GLM-5.2 | ¥8 / ¥28 | ¥10.15 / ¥31.5 | 输入高约 27%、输出高约 12%,需按模型版本核对 |
| qwen3.7-max | ¥12 / ¥36(原价) | ¥17.5 / ¥52.5 | 高于官方原价,注意百炼限时 5 折 |
| MiniMax-M3 | ¥4.2 / ¥16.8(原价) | ¥2.1 / ¥8.4 | 等于官方五折后的价格 |
几个观察:
- DeepSeek 系列按官方高峰价计费。官方空闲时段半价,所以”避开高峰调用”在官方直连更划算;统一入口价格不变,但省了管理多个 Key 和跨平台对账的成本。
- MiniMax-M3 直接就是官方五折后的价,没有额外加价。
- GLM 和 Qwen 的标价高于官方原价。这可能与模型版本、上下文档位或分组倍率有关,购买前应该拿具体的模型 ID 到官方定价页和模型广场各核验一次,不要只看模型名。
- 页面同时显示”标准/充值”两档价格,充值档约为标准档的 6 折,以模型广场当前显示为准。
另外,统一入口普遍有缓存价:Tokeness 上 qwen3.7-max 缓存输入 ¥3.5(标准档),远低于未命中价。高频重复任务(系统提示词、固定模板)走缓存,成本能再降一截。
怎么核验一个入口”有没有掺水”
比价格之前,先确认你买到的模型真的是模型广场上写的那个。三步核验:
- 对模型 ID:请求里的
model字段要和你在用的模型 ID 完全一致,包括-pro、-flash这类后缀。只写”DeepSeek V4”不写版本,基本没法核验。 - 对 usage 字段:响应里的
usage.prompt_tokens、completion_tokens要自己记下来。拿同一段固定文本分别调官方和统一入口,token 计数应该一致;如果官方报 1000、入口报 800,要么是计费口径不同,要么就是拿别的模型在顶替。 - 固定测试集:准备 3 类任务(翻译 100 段、代码审查 20 个 PR、长文总结 10 篇),记录每次的模型 ID、输入/输出 token、金额。跑一周再对账单,任何一次调用都能回溯,掺水模型和虚标计数都会露馅。
我自己核验的方法在这篇里写过:从官方 API 换到统一入口两个月:如何核对成本和稳定性,两个月的逐条请求日志怎么对账,可以直接抄。
结论
8 月的国产模型价格表,只抄一个数已经不够了:DeepSeek 分时、百炼限时折扣、MiniMax 永久五折、各家缓存价,四个口径叠在一起,比价的前提是先统一成”同一模型 ID、同一单位、同一日期”。
统一入口的价值不在”永远最便宜”,而在口径透明、可以核验:模型广场价即计费价、一个 Key 对账、token 计数和官方一致。选中转站之前,拿这篇里的三列对比表(官方价 / 入口价 / 实测 usage)自己核一遍,比看任何”全网最低”的广告都靠谱。
价格与功能信息核验日期:2026-08-25。来源:DeepSeek 官方定价页、智谱 BigModel 定价页、阿里云百炼模型计费页、MiniMax 按量计费文档、Tokeness 模型广场。模型价格、折扣和计费规则随时可能调整,购买前请以各平台当前页面为准。