图片来源:视觉中国
界面新闻记者 | 宋佳楠
8月6日,DeepSeek发布官方公告称,近期将对API服务价格进行整体上调,预计涨幅明显,建议用户提前规划用量,最终方案以正式通知为准。
图片来源:DeepSeek
据界面新闻在DeepSeek开放平台查询结果显示,目前对外执行的V4‑Flash与V4‑Pro两款主力模型,仍维持此前多轮降价后的基准价位。
根据官方报价,deepseek‑v4‑flash模型中,缓存命中输入单价为0.02元/百万tokens,未命中输入为1元/百万tokens,输出则为2元/百万tokens;定位更高端的deepseek‑v4‑pro模型,缓存命中输入价为0.025元/百万tokens,未命中输入3元/百万tokens,输出价高达6元/百万tokens。
DeepSeek API现行定价机制
该平台还引入了峰谷分时计费模式,旨在缓解算力资源压力:工作日高峰时段费用翻倍,夜间、周末及节假日则保持平峰低价。两款模型均支持百万级超长上下文,并兼容OpenAI与Anthropic两种调用格式。
时间进入2026年,DeepSeek已多次调整API价格策略。
4月25日,平台曾下调缓存命中输入价格,针对deepseek‑v4‑pro模型开启限时2.5折优惠,活动截止至2026年5月5日。优惠期间,百万tokens输入(缓存命中)价格为0.25元,未命中输入3元,输出6元。
彼时市场观点认为,deepseek‑v4作为二季度备受瞩目的国产模型事件,其国产化适配意味着国内“模型-芯片-云”闭环正逐步打通,有助于构建自身AI商业生态。模型性能越强、迭代速度越快,越能向AI芯片、设备及云基础设施环节传导,国产算力核心标的也将直接受益。
5月23日,DeepSeek宣布,模型API将在2026年5月31日结束2.5折优惠后,正式恢复原价的四分之一。调整后,输入缓存命中价0.025元/百万tokens,未命中3元/百万tokens,输出6元/百万tokens,较原价降幅达75%。紧随DeepSeek发布公告,小米MiMo-V2.5系列API也宣布永久降价,最高幅度达99%。这一连串动作被外界视为国内大模型价格战加剧的信号。
转折出现在6月底。DeepSeek发给用户的升级邮件透露,V4正式版计划于7月中旬上线,预计此次更新将带来功能优化与性能提升。
DeepSeek方面解释,为合理配置资源并提升服务稳定性,正式版发布后将同步调整API定价,引入峰谷机制,高峰时段调用费翻倍。
具体而言,deepseek‑v4‑pro模型百万tokens输入(缓存命中)平时0.025元,高峰0.05元;未命中输入平时3元,高峰6元;输出平时6元,高峰12元。DeepSeek将每日北京时间9:00-12:00及14:00-18:00划定为高峰时段。
deepseek‑v4‑flash价格相对亲民,百万tokens输入(缓存命中)平时0.02元,高峰0.04元;未命中输入平时1元,高峰2元;输出平时2元,高峰4元。
有分析指出,DeepSeek V4正式版的峰谷定价并非单纯涨价,而是在算力稀缺背景下的一种标准化调度手段。
今年以来,DeepSeek API调价时间线
而即将到来的大幅涨价,实则是应对高昂算力成本的策略。大模型推理对高端GPU消耗巨大,长期低价跑量会持续侵蚀企业现金流。
多模型聚合平台OpenRouter发布的全球AI大模型调用量周榜单(7月27日至8月2日)显示,DeepSeek V4 Flash以7.22万亿Token的调用量位居榜首。另据开源项目团队OpenCode数据,其平台上DeepSeek V4 Flash调用量激增,仅8月1日一天,单日处理量即达8万亿Token。8月4日,deepseek‑v4‑flash还因前所未有的访问量出现容量不足状况。
不仅DeepSeek,近半年来多家大模型服务商均有不同形式的价格调整。在今年的智谱2025年业绩说明会上,智谱CEO张鹏表示,2026年一季度智谱API调用定价提升83%。即便如此,市场仍供不应求,调用量增长400%。
过去两年,为抢占市场份额,各家疯狂压低API单价,甚至推出大规模免费额度以吸引开发者迁移。进入2026年下半年,随着算力供需紧张、芯片采购及运营成本持续走高,单纯靠低价换规模的模式难以为继。行业逻辑正从“拼低价抢用户”转向“成本可承受前提下的商业化”。
对于DeepSeek即将涨价,有观点认为,API定价回调反映出厂商开始重视可持续经营,但调价也将给中小开发者的AI创新项目带来直接压力。








