A5站长网9月9日消息,涨价不到一个月,DeepSeek又出手了,这次是往下调。今日,DeepSeek开放平台发布公告,从北京时间9月10日12:00起调整flash系列模型定价,降幅最大的缓存命中输入直接砍掉六成。
具体账目以空闲时段为准:输入(缓存命中)从每百万Token 0.05元降到0.02元,降幅60%;输入(缓存未命中)从1.5元降到1元,降了三分之一;输出从4.5元降到4元,降幅约11%。调价覆盖deepseek-v4-flash和deepseek-v4-flash-vision-exp两款模型,执行同一套标准。
峰谷分时计价继续保留,而且价差拉得更开。高峰时段价格仍是空闲时段的两倍——缓存命中0.04元、缓存未命中2元、输出8元。高峰时段的划定没变:北京时间周一至周五9:00-12:00和14:00-18:00,其余时间包括整个周末都算空闲。把不急的任务挪到晚上或周末跑,成本差距肉眼可见。
这轮降价最有味道的地方在时机。就在上个月,DeepSeek刚因为需求激增对V4系列调过一轮价,高峰时段部分价格涨幅不小,当时不少开发者抱怨性价比优势没了。如今flash系列回调,叠加9月8日刚启动的V4.1 Flash中间版本内测——官方口径是能力更强、速度更快、成本更低——这一降一升之间,既有对8月涨价的部分修正,也在给新模型铺路。
对开发者来说,这笔账值得精打细算。缓存命中的概念很直白:客服机器人答常见问题、文档总结复用固定提示词、长对话里反复调用的系统指令,这些场景命中率高,成本能省出一大截。官方测算口径下,如果工作流缓存命中率高、输入输出结构合理,综合调用成本有望下降四成左右。错峰调用加善用缓存,正在成为用flash系列最划算的组合姿势。
A5创业网 版权所有