资讯
DeepSeek V4.1 Flash正式发布:性能全面超越V4 Pro 成本更低
📋总体概括
深度求索9月10日正式发布全新架构系列中尺寸最小的DeepSeek V4.1 Flash模型,原生支持多模态视觉理解。该模型采用552B参数MoE架构和全新Causal-Encoder-Decoder结构,输入侧仅激活8B参数、输出侧激活16B参数,实现更快推理速度与更高吞吐,推理成本显著低于同尺寸模型。官方基准测试显示其多项成绩超越DeepSeek V4 Pro等旗舰模型,新架构也为后续扩展更大参数规模奠定基础。
⚡关键信息
- ▸DeepSeek V4.1 Flash为全新架构系列最小模型,原生支持多模态视觉理解
- ▸采用552B参数MoE架构,引入全新Causal-Encoder-Decoder不对称结构
- ▸输入侧仅激活8B参数,输出侧激活16B参数,推理成本显著低于同尺寸模型
- ▸官方基准测试显示多项成绩超越DeepSeek V4 Pro等旗舰模型
- ▸新架构为后续扩展至更大参数规模模型打下基础
🔥犀利点评
小杯模型反超大杯性能,这不是常规升级,而是架构层面的降维打击——不对称激活设计把MoE的稀疏性玩出了新花样,推理成本低就是行业最硬的通行证。不过官方基准自证式的『全面超越』还需第三方实测和真实场景验证,参数激活数字漂亮不等于体验领先,等API开放后看实际价格和延迟再下重注。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文 →