
8 月 13 日,DeepSeek 官方正式发布 V4‑Pro 模型,同步公布 API 调价方案,新峰谷定价将于 8 月 17 日 0 点正式生效。新方案采用峰谷定价机制,V4‑Pro 高峰时段每百万 Token 输出价格涨至 27 元,相比原有价格涨幅达 3.5 倍;缓存命中输入档位涨幅高达 11 倍(1100%)。
这几天DeepSeek涨价讨论的人还挺多的,在某音上面我都刷到好几个了,梁文锋直接从梁圣变为了梁子,于是我就让AI汇总DeepSeek、智谱GLM、Kimi、MiniMax四家厂商最新官方定价,统一按「缓存命中输入 / 缓存未命中输入 / 输出 / 上下文窗口」四个维度对齐对比,供各位参考参考。
目前我个人在使用GLM-4.7-Flash(免费)搭配Zcode来帮我用来整理知识库,还让其做了个网站用来直观的查看自己的知识库。
而NVIDIA NIM(免费)里面的nemotron-3-ultra-550b-a55b和minimax-m3则用来日常写点小网站小程序,只要按规则一个功能一个功能的制作,很少出现限流的情况,而且我突然感觉minimax-m3特别好用,官方订阅套餐也很便宜,我都有点想以后买他们家的订阅了。
而在收费方面,我个人在用火山方舟 Agent Plan 和 Codebuddy的订阅服务,不过因为现在免费API用的多(能满足我的使用),这些收费的额度现在都没用完。
如果对免费API有兴趣可以看一下下面这两篇文章:
【AI】Codebuddy Hy3模型限时免费延长至8月31日&解决免费AI API 限速思路
一、旗舰模型定价对比
| 厂商 | 模型 | 输入 缓存命中 |
输入 缓存未命中 |
输出 | 上下文 |
|---|---|---|---|---|---|
| DeepSeek | V4-Pro(高峰) | 0.30 | 9.00 | 27.00 | 1M |
| DeepSeek | V4-Pro(空闲) | 0.15 | 4.50 | 13.50 | 1M |
| 智谱 | GLM-5.2 | 2.00 | 8.00 | 28.00 | 1M |
| 智谱 | GLM-5.1(≤32K) | 1.30 | 6.00 | 24.00 | 32K |
| 智谱 | GLM-5.1(32K+) | 2.00 | 8.00 | 28.00 | 32K+ |
| 智谱 | GLM-5-Turbo(≤32K) | 1.20 | 5.00 | 22.00 | 32K |
| 智谱 | GLM-5-Turbo(32K+) | 1.80 | 7.00 | 26.00 | 32K+ |
| 智谱 | GLM-5(≤32K) | 1.00 | 4.00 | 18.00 | 32K |
| 智谱 | GLM-5(32K+) | 1.50 | 6.00 | 22.00 | 32K+ |
| 智谱 | GLM-4.7(≤32K,短输出) | 0.40 | 2.00 | 8.00 | 32K |
| Kimi | K3 | 2.00 | 20.00 | 100.00 | 1M |
| Kimi | K2.6 | 1.10 | 6.50 | 27.00 | 256K |
| MiniMax | M3 标准(≤512K) | 0.42 | 2.10 | 8.40 | 512K |
| MiniMax | M3 标准(>512K) | 0.84 | 4.20 | 16.80 | 1M |
| MiniMax | M3 优先(≤512K) | 0.42 | 3.15 | 12.60 | 512K |
注:智谱GLM-4.7另有长输出档(输出>0.2M tokens时输出14元);DeepSeek V4-Pro/Flash上下文窗口均为1M,输出长度最大384K。
二、轻量/高速模型定价对比
| 厂商 | 模型 | 输入 缓存命中 |
输入 缓存未命中 |
输出 | 上下文 |
|---|---|---|---|---|---|
| DeepSeek | V4-Flash(高峰) | 0.10 | 3.00 | 9.00 | 1M |
| DeepSeek | V4-Flash(空闲) | 0.05 | 1.50 | 4.50 | 1M |
| 智谱 | GLM-4.7-Flash | — | 免费 | 免费 | 200K |
| 智谱 | GLM-4.7-FlashX | 0.1元 | 0.50 | 3.00 | 200K |
| MiniMax | M2.7 标准 | 0.42 | 2.10 | 8.40 | — |
| MiniMax | M2.7 极速 | 0.42 | 4.20 | 16.80 | — |
三、各家定价策略差异
| 维度 | DeepSeek | 智谱GLM | Kimi | MiniMax |
|---|---|---|---|---|
| 核心策略 | 时空+缓存双杠杆 | 能力梯度+缓存普惠 | 前沿高价+缓存兜底 | 分层+促销 |
| 定价特色 | 峰谷定价(高峰/空闲差2倍) | 模型矩阵丰富(5.2/5.1/5/Turbo/4.7等) | K3输出100元,定位最高端 | 标准/优先双服务层级 |
| 缓存机制 | 命中价极低(0.05~0.30元) | 全系覆盖(GLM-5.2仅2元,GLM-4.7仅0.4元) | 命中仅2元,降幅90% | 统一0.42元,与未命中价差5倍 |
| 上下文策略 | V4-Pro/Flash均为1M,输出最大384K | 长度分档(32K/128K/1M) | 1M统一计价 | ≤512K和>512K分档 |
| 模型矩阵 | 极简(仅Pro/Flash两档) | 极丰富(旗舰+轻量多档) | 精简(K3/K2.6两档) | 中等(M3/M2.7分标准/极速) |
| 杀手锏 | 空闲+缓存双buff叠加 | GLM-4.7-Flash完全免费 | 1M上下文+始终推理 | 当前全线永久五折 |
四、关键发现
- 缓存命中维度:DeepSeek V4-Flash空闲仅0.05元,为智谱GLM-5.2(2元)的1/40,为Kimi K3(2元)的1/40。
- 旗舰输出价格:Kimi K3(100元)> 智谱GLM-5.2(28元)≈ DeepSeek V4-Pro高峰(27元)> Kimi K2.6(27元)。
- 上下文窗口:DeepSeek V4-Pro/Flash、智谱GLM-5.2、Kimi K3均支持1M上下文,长文本已成旗舰标配。
- 空闲时段性价比:DeepSeek V4-Pro空闲输出13.5元,低于智谱GLM-5-Turbo(22元)和GLM-5(18元)。
- 免费档:智谱GLM-4.7-Flash(200K上下文)完全免费,为轻量场景首选。
五、数据来源
- DeepSeek:https://api-docs.deepseek.com/zh-cn/quick_start/pricing/
- 智谱GLM:https://www.bigmodel.cn/pricing
- Kimi:https://platform.kimi.com/docs/pricing/chat-k3
- MiniMax:https://platform.minimaxi.com/subscribe/token-plan
本文价格单位均为人民币元/百万Tokens,数据截至2026年8月14日,以各厂商官方定价页为准。
