DeepSeek涨价后还能愉快的使用吗?我把18款模型价格拉了个表
可能这两AI圈最大的事儿,就是DeepSeek V4 Pro正式版上线,顺带公布了全新的“峰谷定价”方案。简单说,就是涨价了,而且最高那个档位,涨得还挺狠。
以前V4 Pro输出价格是6块钱,8月17号之后,高峰时段(工作日白天)直接干到27块,涨了3.5倍。缓存命中的输入价格更夸张,从几分钱涨到3毛,整整11倍。
你要是只盯着这个涨幅,那确实肉疼。
但换个角度,咱们把这些主流模型的价格拉出来溜溜,心里就有数了。我按输出价格从低到高排了个序,咱们一起感受下:
| 模型 | 输入 (元/MTok) | 缓存命中 (元/MTok) | 输出 (元/MTok) | 备注 |
|---|---|---|---|---|
| DeepSeek V4 Flash (闲时) | 1.5 | 0.05 | 4.5 | 8月17日生效 |
| GPT-5.6 Luna | ≈1.4 | ≈0.14 | ≈8.6 | 按7.2汇率折算 |
| MiniMax M3 | 2.2 | 0.43 | 8.6 | 标准档,永久5折后价 |
| DeepSeek V4 Flash (高峰) | 3 | 0.10 | 9 | 8月17日生效 |
| DeepSeek V4 Pro (闲时) | 4.5 | 0.15 | 13.5 | 8月17日生效 |
| DeepSeek V4 Pro (高峰) | 9 | 0.30 | 27 | 8月17日生效 |
| Google Gemini 3.7 Flash | ≈5.4 | ≈0.54 | ≈27 | 当前优惠价至2026年末 |
| GLM-5.2 | 8 | — | 28 | 火山方舟渠道价 |
| 豆包 Seed 2.1 Pro | 6 | — | 30 | 火山引擎原厂API |
| Qwen3.8-Max | 12 | 1.5 | 36 | 阿里云百炼原价 |
| xAI Grok 4.6 | ≈14.4 | ≈3.6 | ≈43.2 | 短上下文价 |
| Anthropic Claude Sonnet 5 | ≈14.4 | ≈1.44 | ≈72 | Claude API标准价 |
| GPT-5.6 Terra | ≈14.4 | ≈1.44 | ≈86.4 | 标准短上下文 |
| Google Gemini 3.1 Pro Preview | ≈14.4 | ≈1.44 | ≈86.4 | 输入不超过200K |
| Kimi K3 | 20 | 2 | 100 | 中国区原厂价 |
| Anthropic Claude Opus 4.8 | ≈36 | ≈3.6 | ≈180 | 标准模式 |
| GPT-5.6 Sol | ≈36 | ≈3.6 | ≈216 | 标准短上下文 |
| Anthropic Claude Fable 5 | ≈72 | ≈7.2 | ≈360 | 1M上下文旗舰 |
这么一排序,格局是不是瞬间清晰了?
低价区(输出70元)依然属于“钞能力”:Kimi K3(100元)、GPT-5.6 Sol(216元)、Claude Fable 5(360元)高高在上。V4 Pro哪怕涨到高峰27块,依然比Kimi K3便宜73%,比GPT-5.6 Sol便宜87%。DeepSeek只是从“降维打击”回到了“高手过招”的正常区间。
这套“峰谷电价”值得研究一番
这次引入的“峰谷定价”是亮点。这招太会了,与其说是涨价,不如说是用价格杠杆做资源调度。

以前谁管你白天黑夜,算力成本都一样。现在呢?
- 高峰时段(9-12点,14-18点):贵,但保证你随时调用不卡顿。
- 闲时时段(其他时间):直接半价,便宜大碗。
这不就是逼着我们把那些离线任务、批量处理、日志分析统统挪到后半夜去跑吗?对于成熟的团队,这哪儿是涨价,这分明是给了个用时间换预算的操作空间。以后跟老板汇报,咱也能说“通过优化算力调度,成本控制在了合理范围”,这逼格一下就上来了。
但群里也有兄弟问了个刁钻的问题:美国那边时区正好颠倒,岂不是相当于全天候“闲时”半价,让他们占便宜了?
结论是:这个便宜他们大概率占不到。
原因就一条——DeepSeek的API调用量,绝大部分来自中国开发者。官方把高峰时段定在北京时间9:00-18:00,几乎覆盖了中国开发者最集中的工作时间。说白了,这套方案就是冲着中国用户的使用习惯设计的——谁用得多,谁就得多付钱。
美国用户理论上确实能享受“错峰红利”:北京时间的闲时(晚上6点到第二天早上9点),正好是美国西海岸的凌晨2点到下午5点。如果他们的开发者都在正常工作时间调用,确实能吃到半价。
但问题是,美国开发者有几个会把DeepSeek当主力?
更扎心的真相是,这套定价的核心目的是缓解中国区白天的算力压力,不是给美国用户发福利。如果美国用户真的大量涌入,DeepSeek完全可以把“高峰时段”改成按调用量最大的时区动态调整。现在没改,说明美国区的调用量压根儿不值得他们专门调时间。
与其纠结美国用户占没占便宜,不如先算算自己团队的任务能不能挪到晚上跑。毕竟,省下来的钱是实打实的。
别再只看单价了,得看“任务完成成本”
说句实在的,咱们当技术负责人的,不能光盯着价目表上那几个数字。
以后选型,不能只看“谁最便宜”,得问自己三个问题:任务难度高不高?能不能挪到闲时跑?需不需要多模态或长上下文?
以前DeepSeek便宜,我们一股脑全切过去,但后来发现,在一些复杂的Agent任务和物理仿真上,它需要反复调试、重试好几次才能达到Kimi K3一次通过的效果。算下来,便宜的token花了三倍,总成本反而上去了,时间成本更是亏大了。
所以,这次涨价也是个提醒:选模型得回到业务本身。
- 复杂推理、高难度Coding、追求一次过:可能Kimi K3、Claude Sonnet这类“贵但准”的模型综合成本更低。
- 批量摘要、分类、非实时RAG:闲时时段的DeepSeek V4 Flash,性价比依然无敌,甚至可以考虑用缓存命中把成本压到极致。
- 长上下文、复杂Agent:多模态和长文本能力也是重要考量,比如MiniMax M3和智谱GLM各有侧重。
精打细算、按需分配的时代正式来临
DeepSeek这波操作,标志着大模型“无脑买便宜货”的时代结束了,精打细算、按需分配的时代正式来临。这对我们技术人来说,既是挑战,也是展现专业价值的机会。
毕竟,能用最少的钱,调教出最听话的模型,才是咱们的看家本领。不是吗?
问题来了:面对这波集体涨价,你手头的项目是打算“硬着头皮上贵的”,还是“调个闹钟半夜跑任务”?欢迎在评论区分享你的“省钱大法”。
评论
发表评论