资讯
内存还凭啥大涨价 DS V4.1 Flash优化之神:HBM、SSD用量暴跌75%以上
📋总体概括
DeepSeek发布V4.1 Flash模型,采用Causal-Encoder-Decoder全新结构,5520亿主干参数外挂1960亿参数Engram条件记忆,输入激活80亿、输出激活160亿。通过KV Cache改用FP4并跨层复用,每Token全局KV缓存降至890字节,仅为此前V4 Flash的1/4,长期缓存降至约1/8,HBM与SSD用量因此暴跌75%以上。模型推理速度达500-600Token/s,为V4 Flash的3-4倍,API缓存命中价格下跌60%,用户综合成本约减半。
⚡关键信息
- ▸V4.1 Flash采用全新Causal-Encoder-Decoder结构,5520亿主干参数加1960亿参数Engram条件记忆,整体规模比V4 Flash提升一倍多
- ▸KV Cache主缓存改为FP4并跨层复用,每Token全局KV仅890字节,约为V4 Flash的1/4,SSD/内存长期缓存降至约1/8
- ▸HBM内存及SSD用量降至之前1/4到1/8,直接冲击AI驱动下涨了5-10倍的存储市场逻辑
- ▸推理速度达500-600Token/s,是V4 Flash的3-4倍,API缓存命中价格下跌60%,综合使用成本约减半
🔥犀利点评
这则消息最狠的不是参数翻倍,而是直接用工程优化捅破了存储涨价的底层逻辑——存储厂商靠AI叙事吃下的5-10倍涨幅,可能被一个模型架构砍掉七成需求。若属实,HBM和SSD的紧缺预期将被釜底抽薪,相关产业链估值面临重估。当然,快科技消息需等官方发布及实测验证,但方向上无疑宣告:靠需求堆砌的涨价泡沫,最怕的就是效率革命。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文 →