资讯
Anthropic、Meta、谷歌、阿里齐发模型更新 编程能力较量白热化
📋总体概括
北京时间9月2日至3日,Anthropic、Meta、谷歌、阿里在各自旗舰模型基础上密集发布更新版本,能力提升聚焦编程、网络安全和办公领域。Anthropic推出Claude Fable 5.1与Claude Mythos 5.1,Meta发布Muse Spark 1.3,谷歌推出Gemini 3.8 Flash,阿里发布Qwen3.8-Max 0902版本。从第三方榜单看,Claude Fable 5.1智能水平排名第一,Muse Spark 1.3居第三,Gemini 3.8 Flash排名十名开外,阿里的新版暂无测试结果。头部厂商迭代节奏明显加快,排行榜频繁刷新,编程能力成为新一轮竞争焦
⚡关键信息
- ▸Anthropic于9月2日发布新一代旗舰大模型Claude Fable 5.1与Claude Mythos 5.1,其中Fable 5.1在第三方智能水平榜单排名第一
- ▸Meta发布Muse Spark 1.3,智能排名第三,与Anthropic形成第一梯队对峙
- ▸谷歌新模型Gemini 3.8 Flash排名十名开外,与头部产品存在明显差距
- ▸阿里Qwen3.8-Max的0902版本暂未出现在第三方测试结果中
- ▸本轮四家更新集中在编程、网络安全和办公能力,编程成竞争白热化领域
🔥犀利点评
一日之内四家齐发,所谓「模型迭代」越来越像军备竞赛式的月度KPI交差。真正的格局残酷:Anthropic独占鳌头,Meta紧咬第一梯队,而谷歌的Flash系列已沦为追赶者,阿里的新品连测试数据都拿不出来。编程能力被反复强调,本质是它是唯一能直接收费、验证商业价值的场景——榜单好看不赚钱,写代码赚钱。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 财新 阅读全文 →