资讯

谷歌、Meta被揭露AI跑分作弊 华裔高管回应:OpenAI也一样

驱动之家·2026/9/8 12:55:00🔗 原文

📋总体概括

SemiAnalysis发文指谷歌Gemini 3.8 Flash与Meta Muse Spark 1.3在AA榜单超越OpenAI、Anthropic旗舰模型的表现源于过拟合刷分,即针对评测集做针对性优化。此前国产大模型常被指责刷分,如今矛头指向硅谷巨头。Meta AI负责人Alexandr Wang(Scale AI创始人)否认作弊,并称OpenAI也存在同样行为。

关键信息

  • 分析机构SemiAnalysis指谷歌Gemini 3.8 Flash、Meta Muse Spark 1.3存在过拟合,涉嫌针对榜单刷分
  • 两款模型在AA榜单上一度超越OpenAI、Anthropic旗舰模型,引发对性能真实性的质疑
  • Meta AI业务主管Alexandr Wang否认刷分指控,并回应称OpenAI也一样
  • Alexandr Wang系Scale AI数据标注业务创始人,公司被Meta重金收购后执掌其AI业务
  • AI榜单刷分并非新闻,以往多指责国产大模型,此次矛头首次指向谷歌和Meta

🔥犀利点评

榜单刷分从国产模型的「专利」变成硅谷巨头的日常,恰恰说明排名之争已经异化——分数不再衡量能力,而是融资和话语权的筹码。Wang的回应最微妙:不否认自己刷了,只说OpenAI也刷了,等于承认整个行业集体沉溺于应试。当评测集被所有玩家当题库背熟,榜单就已失去公信力,用户该看的只有真实场景表现。

本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文