资讯
DeepSeek官宣flash系列模型降价 最高直降60%
📋总体概括
DeepSeek开放平台公告,自2026年9月10日12:00起对flash系列模型调价,并引入峰谷分时计费。空闲时段输入缓存命中价从0.05元降至0.02元/百万Token,降幅60%;缓存未命中从1.5元降至1元,降幅33.33%;输出从4.5元降至4元,降幅11.11%。高峰时段(工作日9:00-12:00、14:00-18:00)价格为空闲时段的2倍,同样全面下调。此举意在错峰引导流量、提升GPU利用率,同时以更低价格抢占API市场。
⚡关键信息
- ▸DeepSeek宣布9月10日12:00起调整flash系列模型定价,首次引入峰谷分时计费模式
- ▸空闲时段输入缓存命中价降60%,从0.05元降至0.02元/百万Token
- ▸缓存未命中降33.33%至1元/百万Token,输出降11.11%至4元/百万Token
- ▸高峰时段划定为工作日9:00-12:00、14:00-18:00,价格为空闲时段2倍且同步下调
- ▸高峰各档价格:缓存命中0.04元、未命中2元、输出8元/百万Token
🔥犀利点评
峰谷计费本质是把电力行业的错峰定价搬到大模型上——说明DeepSeek闲时算力严重过剩,宁可贱卖也要把GPU填满。缓存命中降60%最狠,等于公开鼓励开发者优化调用结构,锁定长粘性客户。但输出价只降11%,暴露了推理成本的真实底线。这轮降价与其说是让利,不如说是用价格杠杆重排开发者的调用时钟,顺带给行业打了个样:API价格战进入精细化运营阶段。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文 →