资讯
谷歌、Meta被揭露AI跑分作弊 华裔高管回应:OpenAI也一样
📋总体概括
分析机构SemiAnalysis发文指控谷歌Gemini 3.8 Flash与Meta Muse Spark 1.3在AA榜单上的亮眼成绩存在过拟合刷分嫌疑。此前两家在AI竞赛中一度落后于OpenAI与Anthropic,新模型却反超对手旗舰,引发质疑。Meta AI负责人Alexandr Wang回应反驳,并称OpenAI同样如此。榜单刷分在业内并不新鲜,此前矛头多指向国产大模型,这次轮到硅谷巨头。
⚡关键信息
- ▸SemiAnalysis指控谷歌Gemini 3.8 Flash与Meta Muse Spark 1.3存在过拟合,即针对榜单评测刷分
- ▸两款新模型曾在AA榜单上超越OpenAI与Anthropic的旗舰大模型
- ▸谷歌与Meta此前在AI竞赛中落后,新模型成绩反超被认为是异常表现
- ▸Meta AI主管Alexandr Wang回应否认刷分,并称OpenAI也一样
🔥犀利点评
这次反转颇有讽刺意味:刷分的锅常年甩给国产大模型,结果SemiAnalysis一纸报告直接打脸硅谷巨头。更妙的是Wang的回应——不说自己干净,反而拉OpenAI下水,等于默认行业集体刷分。当跑分成为融资与宣传的生命线,榜单早已异化为营销工具而非技术标尺。真正该被追问的是评测机制本身,否则下次上榜的依然是谁刷得狠谁说话。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文 →