资讯
谷歌、Meta被揭露AI跑分作弊 华裔高管回应:OpenAI也一样
📋总体概括
SemiAnalysis发文指谷歌Gemini 3.8 Flash与Meta Muse Spark 1.3在AA榜单超越OpenAI、Anthropic旗舰模型的表现源于过拟合刷分,即针对评测集做针对性优化。此前国产大模型常被指责刷分,如今矛头指向硅谷巨头。Meta AI负责人Alexandr Wang(Scale AI创始人)否认作弊,并称OpenAI也存在同样行为。
⚡关键信息
- ▸分析机构SemiAnalysis指谷歌Gemini 3.8 Flash、Meta Muse Spark 1.3存在过拟合,涉嫌针对榜单刷分
- ▸两款模型在AA榜单上一度超越OpenAI、Anthropic旗舰模型,引发对性能真实性的质疑
- ▸Meta AI业务主管Alexandr Wang否认刷分指控,并回应称OpenAI也一样
- ▸Alexandr Wang系Scale AI数据标注业务创始人,公司被Meta重金收购后执掌其AI业务
- ▸AI榜单刷分并非新闻,以往多指责国产大模型,此次矛头首次指向谷歌和Meta
🔥犀利点评
榜单刷分从国产模型的「专利」变成硅谷巨头的日常,恰恰说明排名之争已经异化——分数不再衡量能力,而是融资和话语权的筹码。Wang的回应最微妙:不否认自己刷了,只说OpenAI也刷了,等于承认整个行业集体沉溺于应试。当评测集被所有玩家当题库背熟,榜单就已失去公信力,用户该看的只有真实场景表现。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文 →