资讯

DeepSeek官宣flash系列模型降价 最高直降60%

驱动之家·2026/9/9 01:32:00🔗 原文

📋总体概括

DeepSeek开放平台公告,自2026年9月10日12:00起对flash系列模型调价,并引入峰谷分时计费。空闲时段输入缓存命中价从0.05元降至0.02元/百万Token,降幅60%;缓存未命中从1.5元降至1元,降幅33.33%;输出从4.5元降至4元,降幅11.11%。高峰时段(工作日9:00-12:00、14:00-18:00)价格为空闲时段的2倍,同样全面下调。此举意在错峰引导流量、提升GPU利用率,同时以更低价格抢占API市场。

关键信息

  • DeepSeek宣布9月10日12:00起调整flash系列模型定价,首次引入峰谷分时计费模式
  • 空闲时段输入缓存命中价降60%,从0.05元降至0.02元/百万Token
  • 缓存未命中降33.33%至1元/百万Token,输出降11.11%至4元/百万Token
  • 高峰时段划定为工作日9:00-12:00、14:00-18:00,价格为空闲时段2倍且同步下调
  • 高峰各档价格:缓存命中0.04元、未命中2元、输出8元/百万Token

🔥犀利点评

峰谷计费本质是把电力行业的错峰定价搬到大模型上——说明DeepSeek闲时算力严重过剩,宁可贱卖也要把GPU填满。缓存命中降60%最狠,等于公开鼓励开发者优化调用结构,锁定长粘性客户。但输出价只降11%,暴露了推理成本的真实底线。这轮降价与其说是让利,不如说是用价格杠杆重排开发者的调用时钟,顺带给行业打了个样:API价格战进入精细化运营阶段。

本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文