DeepSeek-V4-Pro不涨回去了:2.5折API价直接转正
导语:DeepSeek-V4-Pro现行2.5折API价将转为正式定价。
DeepSeek 这次对 API 价格表的改动,真正值得注意的地方不是“优惠到期”,而是优惠到期后并不涨回去。根据官方 API 文档的最新说明,DeepSeek-V4-Pro 当前执行的 2.5 折 API 优惠将在北京时间 2026 年 5 月 31 日 23:59 结束,但结束之后,价格不会恢复到此前原价,而是直接把现行优惠价固化为新的正式定价。
对正在评估大模型调用成本的开发者、企业团队和 AI 应用服务商来说,这个信号相当明确:DeepSeek-V4-Pro 的 API 成本基线被重新压低了。换句话说,原本看起来像阶段性促销的价格,现在变成了长期价格锚点。
2.5 折优惠转正式定价,核心变化在这里
官方文档显示,DeepSeek-V4-Pro 调整后的价格,相当于原定价的四分之一。具体到每百万 tokens,输入侧会区分缓存命中与缓存未命中两种情况:缓存命中输入价格为 0.025 元,缓存未命中输入价格为 3 元;输出价格为每百万 tokens 6 元。
作为对比,DeepSeek-V4-Pro 此前对应的原定价分别是:缓存命中输入 0.1 元、缓存未命中输入 12 元、输出 24 元。也就是说,不只是输出 tokens 降到了原来的四分之一,输入侧无论是否命中缓存,也都按同样比例下调。
这对 API 使用者意味着什么
大模型 API 的实际成本,往往不只取决于“模型够不够强”,更取决于长文本、检索增强、Agent 工作流、多轮对话等场景里的 tokens 消耗。尤其是 RAG、代码助手、知识库问答、自动摘要这类应用,输入 tokens 的占比经常并不低。如果缓存命中输入价格固定在每百万 tokens 0.025 元,对于高频重复上下文、系统提示词较长、文档片段复用率高的业务,成本弹性会更明显。
缓存未命中输入每百万 tokens 3 元、输出每百万 tokens 6 元的组合,也会让不少中小团队重新计算“自建模型服务”和“直接走 API”的边界。此前一些项目在原型阶段可以接受 API 调用,但一到规模化上线就会被 tokens 成本卡住;这次 DeepSeek-V4-Pro 把优惠价转为正式价,至少让预算模型更容易做长期规划,而不是围绕短期促销反复调整。
价格表已经更新,开发者应以官方文档为准
需要注意的是,本次信息来自 DeepSeek 官方 API 文档中的价格说明更新。API 定价直接影响账单预估、服务毛利以及产品套餐设计,建议已经接入或计划接入 DeepSeek-V4-Pro 的团队,及时同步内部成本表,并重新核算不同调用量级下的单次请求成本。
- 优惠结束时间:北京时间 2026 年 5 月 31 日 23:59
- 结束后定价:不恢复原价,现行 2.5 折价格转为正式价格
- 调整后输入价格:缓存命中 0.025 元 / 百万 tokens,缓存未命中 3 元 / 百万 tokens
- 调整后输出价格:6 元 / 百万 tokens
- 对应原定价:缓存命中输入 0.1 元、缓存未命中输入 12 元、输出 24 元
从行业角度看,API 价格从“限时优惠”变成“正式定价”,通常比单纯打折更有分量。前者更像市场活动,后者则会影响开发者的长期选型。对于依赖 DeepSeek-V4-Pro 做推理、生成、搜索增强或智能体编排的产品来说,这次价格确认,最直接的价值就是让成本预期更稳定。