资讯

DeepSeek V4.1 Flash正式发布:性能全面超越V4 Pro 成本更低

驱动之家·2026/9/10 06:43:00🔗 原文

📋总体概括

深度求索9月10日正式发布全新架构系列中尺寸最小的DeepSeek V4.1 Flash模型,原生支持多模态视觉理解。该模型采用552B参数MoE架构和全新Causal-Encoder-Decoder结构,输入侧仅激活8B参数、输出侧激活16B参数,实现更快推理速度与更高吞吐,推理成本显著低于同尺寸模型。官方基准测试显示其多项成绩超越DeepSeek V4 Pro等旗舰模型,新架构也为后续扩展更大参数规模奠定基础。

关键信息

  • DeepSeek V4.1 Flash为全新架构系列最小模型,原生支持多模态视觉理解
  • 采用552B参数MoE架构,引入全新Causal-Encoder-Decoder不对称结构
  • 输入侧仅激活8B参数,输出侧激活16B参数,推理成本显著低于同尺寸模型
  • 官方基准测试显示多项成绩超越DeepSeek V4 Pro等旗舰模型
  • 新架构为后续扩展至更大参数规模模型打下基础

🔥犀利点评

小杯模型反超大杯性能,这不是常规升级,而是架构层面的降维打击——不对称激活设计把MoE的稀疏性玩出了新花样,推理成本低就是行业最硬的通行证。不过官方基准自证式的『全面超越』还需第三方实测和真实场景验证,参数激活数字漂亮不等于体验领先,等API开放后看实际价格和延迟再下重注。

本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文