IT时报记者 潘少颖 图 AI生成
对于不少依赖API调用DeepSeek模型的开发者和企业来说,最近的账单可能要重新计算了。
8月17日零时起,DeepSeek API正式启用全新的峰谷分时计价体系,核心变化是把一天划分为高峰和空闲两个时段,不同时段的价格差异相当明显。这是DeepSeek上线API服务以来首次对定价机制做出结构性调整,意味着官方开始用市场化手段精细化调控算力资源。
根据官方方案,每日9:00~12:00和14:00~18:00为高峰时段,其余17个小时均为空闲时段,空闲时段的价格统一为高峰时段的一半。简单说,只要把任务挪到晚上、凌晨或周末运行,API调用成本就能直接打五折。官方明确,法定节假日全天均按空闲时段价格执行,这对有批量任务需求的团队来说是个可以利用的时间窗口。
以旗舰模型V4 Pro为例,调整前后对比直观。输出价格从原先的6元/百万Tokens涨至高峰时段27元,涨幅达350%,空闲时段为13.5元。输入价格缓存未命中从3元涨至高峰9元,涨幅200%,空闲时段4.5元。输入价格缓存命中从0.025元涨至高峰0.3元,涨幅高达1100%,空闲时段0.15元。缓存命中价格的涨幅最为突出,虽然绝对值不高,但涨了11倍,说明官方对高频缓存命中的日间调用收紧了定价。
轻量级的V4 Flash模型同样适用此规则,其高峰时段输出价格为9元/百万Tokens,空闲时段为4.5元。对于预算敏感的小型团队或个人开发者,Flash模型配合空闲时段调用,仍可保持较低的使用成本。
此次调价仅针对API调用,网页端、App普通免费用户不受影响。主要承压的是通过API调用、运行Agent或开发AI应用的开发者和企业。如果业务大量依赖日间实时API交互,尤其是高频缓存命中的场景,成本变化需要重新测算。
官方推行此机制,意在借助价格杠杆,引导用户将非紧急的批处理任务如数据分析、离线生成、批量内容审核等移至夜间或凌晨执行,以缓解日间算力拥堵,提升服务稳定性。从全局来看,这有助于降低高峰期的服务延迟,对实时性要求高的用户反而是利好。
对于开发者而言,若想控制成本,最直接的策略便是将非实时任务尽量安排在空闲时段运行。此外,可以拆解业务流程,将实时交互部分保留在日间,批量处理部分统一调度到夜间队列。如果条件允许,也可以评估Flash模型在空闲时段能否替代Pro模型完成部分轻量任务。成本敏感型团队建议重新进行月度预算测算,按新价格评估日间调用量是否在可接受范围内。