资讯
DeepSeek官宣flash系列模型降价 最高直降60%
📋总体概括
DeepSeek开放平台公告,自2026年9月10日12:00起调整flash系列模型定价,并引入峰谷分时计费:空闲时段输入缓存命中0.02元、未命中1元、输出4元/百万Token,高峰时段为空闲2倍,高峰限定工作日9:00-12:00及14:00-18:00。对比旧价,缓存命中降幅达60%,未命中降33.33%,输出降11.11%。此轮降价叠加错峰计费,显示推理成本优化已可向价格端传导,或加剧API市场价格战。
⚡关键信息
- ▸DeepSeek官宣2026年9月10日12:00起下调flash系列模型价格,最高降幅60%
- ▸空闲时段输入缓存命中价从0.05元降至0.02元/百万Token,降幅60%
- ▸输入缓存未命中从1.5元降至1元(降33.33%),输出从4.5元降至4元(降11.11%)
- ▸首次采用峰谷分时计费:高峰为空闲2倍,高峰限定工作日9:00-12:00、14:00-18:00
- ▸高峰时段同步下调:缓存命中0.04元、未命中2元、输出8元/百万Token
🔥犀利点评
别只盯着60%的降幅,真正有意思的是分时计费——这是电力行业的玩法被搬进大模型API。缓存命中价打到0.02元,说明DeepSeek的KV缓存复用率已经高到敢当卖点卖,这才是推理护城河。引导用户错峰调用,本质是削峰填谷摊薄GPU闲置成本,把算力利用率再榨一层。国内API价格战打到这个精细度,说明推理生意已经开始拼运营而非拼融资了。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文 →