资讯

Anthropic、Meta、谷歌、阿里齐发模型更新 编程能力较量白热化

财新·2026/9/3 05:38:38🔗 原文

📋总体概括

北京时间9月2日至3日,Anthropic、Meta、谷歌、阿里在各自旗舰模型基础上密集发布更新版本,能力提升聚焦编程、网络安全和办公领域。Anthropic推出Claude Fable 5.1与Claude Mythos 5.1,Meta发布Muse Spark 1.3,谷歌推出Gemini 3.8 Flash,阿里发布Qwen3.8-Max 0902版本。从第三方榜单看,Claude Fable 5.1智能水平排名第一,Muse Spark 1.3居第三,Gemini 3.8 Flash排名十名开外,阿里的新版暂无测试结果。头部厂商迭代节奏明显加快,排行榜频繁刷新,编程能力成为新一轮竞争焦

关键信息

  • Anthropic于9月2日发布新一代旗舰大模型Claude Fable 5.1与Claude Mythos 5.1,其中Fable 5.1在第三方智能水平榜单排名第一
  • Meta发布Muse Spark 1.3,智能排名第三,与Anthropic形成第一梯队对峙
  • 谷歌新模型Gemini 3.8 Flash排名十名开外,与头部产品存在明显差距
  • 阿里Qwen3.8-Max的0902版本暂未出现在第三方测试结果中
  • 本轮四家更新集中在编程、网络安全和办公能力,编程成竞争白热化领域

🔥犀利点评

一日之内四家齐发,所谓「模型迭代」越来越像军备竞赛式的月度KPI交差。真正的格局残酷:Anthropic独占鳌头,Meta紧咬第一梯队,而谷歌的Flash系列已沦为追赶者,阿里的新品连测试数据都拿不出来。编程能力被反复强调,本质是它是唯一能直接收费、验证商业价值的场景——榜单好看不赚钱,写代码赚钱。

本文由本站自动聚合,以下为原始来源:前往 财新 阅读全文