DeepSeek开始给API调用划分峰时和非峰时。按照官方在2025年2月公布的方案,北京时间每天00:30至08:30,DeepSeek-V3享受五折,DeepSeek-R1降至常规价格的四分之一;其余时段维持原价。

这项调整最重要的地方,不是DeepSeek又降了一次价,而是国内大模型API开始明确用价格引导调用时间。它说明DeepSeek正在把有限的推理资源当作云计算容量来经营。不过,仅凭分时定价就断言“算力吃紧”,证据并不充分。促销获客、提高夜间利用率和管理区域负载,都能解释这次变化。

DeepSeek用夜间折扣调度V3和R1调用

按DeepSeek当时公布的计费标准,价格单位为人民币元/百万tokens。非峰时折扣覆盖输入与输出,并区分缓存命中和未命中的输入。

模型计费项目常规时段非峰时00:30—08:30折扣幅度
DeepSeek-V3输入,缓存命中0.5元0.25元50%
DeepSeek-V3输入,缓存未命中2元1元50%
DeepSeek-V3输出8元4元50%
DeepSeek-R1输入,缓存命中1元0.25元75%
DeepSeek-R1输入,缓存未命中4元1元75%
DeepSeek-R1输出16元4元75%

折后,R1与V3在非峰时段的三档价格被拉到同一水平。需要大量推理输出的任务,节省最明显。比如离线评测、合成训练数据、日志分析、批量摘要和知识库预处理,都可以安排到凌晨执行。

但这不是面向所有用户的普遍降价。网页端和App端用户不会因为使用时间不同而直接看到一张更低的账单;无法延后请求的在线客服、搜索问答和实时Agent,也很难吃到折扣。

时区同样容易被忽略。公告使用北京时间,即UTC+8。对应UTC时间为前一日16:30至当日00:30。海外团队若按本地时间部署定时任务,需要重新换算,不能把“凌晨优惠”简单理解为当地凌晨。

分时价格说明负载有波峰,不足以证明算力短缺

大模型推理的固定成本很高。GPU买下或租下之后,闲置时段也在产生折旧、机房和运维费用。低峰降价能把一部分可延迟任务搬到夜间,让同一批硬件处理更多请求。古语所谓“因时制宜”,放到这里就是用价格替代排队。

这种做法在云计算行业并不陌生。AWS Spot实例用大幅折扣出售闲置算力,但实例可能被回收;OpenAI的Batch API则用约五折价格处理异步任务,代价是用户要接受最长24小时的处理窗口。DeepSeek的方案更直接:API形态不变,用户只需调整调用时间。

定价方式用户换取低价的条件主要限制
DeepSeek非峰时API把调用迁移到固定时段实时业务难迁移,优惠受北京时间约束
OpenAI Batch API提交异步批任务不能要求即时返回
云厂商Spot实例接受闲置算力调度容量可能中断或被回收

这组对照也说明,分时定价本身不是“缺算力”的铁证。若DeepSeek只是夜间资源利用率偏低,降价属于正常的容量经营;只有峰时频繁限流、排队时间持续拉长,或服务等级明显下降,才能进一步支持供给紧张的判断。

因此,标题若直接写成“降价背后是算力吃紧”,判断过了头。更准确的说法是:DeepSeek承认调用需求存在明显波峰,并愿意用利润换取更平滑的负载曲线。

开发团队能省钱,但迁移前要算延迟和运维账

如果团队每天要跑数百万乃至更多tokens的离线任务,最现实的动作是给任务队列增加定时调度,把评测、数据清洗和批量生成移到非峰时段。R1输出价格从每百万tokens 16元降至4元,调用规模越大,账单差异越明显。

省下的token费用也可能被其他成本抵消。任务集中到八小时窗口后,团队可能遇到并发限制、失败重试或队列堆积;如果结果必须在上班前交付,延迟一次就可能影响后续流程。企业还要确认实际结算以请求发起时间、处理时间还是平台账单规则为准,不能只改一个定时器便视为完成迁移。

实时产品则不宜为折扣牺牲体验。客服机器人为了等到凌晨再回答用户,账单是省了,产品也失去了意义。此类团队更该观察峰时稳定性、限流规则和缓存命中率,而不是只盯最低单价。

价格也可能继续调整。开发者在接预算或承诺长期成本前,应以DeepSeek官方定价页和控制台账单为准,并保留切换模型或供应商的能力。真正检验这项策略的变量,不是凌晨有多便宜,而是峰时能否稳定、折扣能否长期存在。