今天打开DeepSeek的API文档,会发现价格表已经彻底换了。
2026年8月17日零点,DeepSeek-V4系列API的峰谷定价正式生效。这不是一次小幅调整,而是直接换了一套玩法——按时间段收费,高峰时段价格是空闲时段的两倍。
具体怎么涨的?直接看表:
| 模型 | 场景 | 输入(缓存命中) | 输入(缓存未命中) | 输出 |
|---|---|---|---|---|
| DeepSeek-V4-Flash | 空闲时段 | 0.05 元 | 1.5 元 | 4.5 元 |
| 高峰时段 | 0.10 元 | 3.0 元 | 9.0 元 | |
| DeepSeek-V4-Pro | 空闲时段 | 0.15 元 | 4.5 元 | 13.5 元 |
| 高峰时段 | 0.30 元 | 9.0 元 | 27.0 元 |
高峰时段:每日 9:00-12:00、14:00-18:00;其余为空闲时段
V4-Pro高峰时段输出价格涨到了27元/百万tokens。对比8月12日刚上线时的定价(输入3元、输出6元),涨幅相当夸张——最高一档涨了11倍。
算一下账,你就知道贵了多少
澎湃新闻算过一笔细账,挺直观的:
假设你每天用V4-Pro做代码审查,日消耗20万输出Token。调价前每天大概花1.2元。调价后,高峰时段要花5.4元,空闲时段也要2.7元。
如果你是个做产品的公司,日均消耗1亿输出Token——高峰时段从原来的600元/天直接跳到2700元/天。错峰到空闲时段也得1350元/天,比原来还是贵了1.25倍。
对于靠API吃饭的开发者来说,这个涨幅真的不是闹着玩的。
为什么要这么干?
官方说得很直白:高峰时段算力太挤了,用价格把人赶走。
翻译一下就是:白天大家挤在一起抢算力,服务不稳定,体验不好。现在用价格杠杆,把不着急的任务赶到晚上、凌晨去跑。
用市场的话说,从“低价抢市场”切换到“精细化运营”了。过去靠便宜吸引开发者,现在规模上来了,得想办法让资源利用率最大化。8月12日刚上线V4-Pro时那个超低价——缓存命中输入低到0.025元/百万tokens——可能真的是最后的狂欢。
开发者怎么办?
V4-Pro正式版支持384K上下文,原生适配代码补全、工具调用、智能体部署这些商用场景。模型本身是能打的,就是使用成本变了。
接下来可能要考虑几件事:
-
不着急的任务,丢到晚上跑——比如数据清洗、批量推理这些后台作业
-
对延时敏感的场景,可能得咬牙付高峰价
-
评估一下是不是非用V4-Pro不可——Flash便宜不少,看业务够不够用
如果你不想自己写代码去判断什么时候是高峰、什么时候切换模型,可以考虑用EasyAPI这类聚合平台。它们内置了模型路由和成本控制策略,把非紧急任务排到空闲时段执行,相当于把“人工错峰”变成“自动调度”,少操一份心。
一句话总结
DeepSeek这次调价,本质上是从“烧钱换规模”变成了“规模起来了得开始赚钱”。对开发者来说,意味着API成本不再是固定的,需要像管电费一样管模型调用成本了。

861

被折叠的 条评论
为什么被折叠?



