资讯
谷歌、Meta被揭露AI跑分作弊 华裔高管回应:OpenAI也一样
📋总体概括
SemiAnalysis发文指控谷歌Gemini 3.8 Flash与Meta Muse Spark 1.3在AA榜单上的领先成绩源于过拟合刷分,即针对评测集做了针对性优化。此前这两家在AI竞赛中落后于OpenAI和Anthropic,新模型却意外反超旗舰,引发质疑。榜单刷分在行业内早有先例,过去矛头多指向国产模型,如今指向硅谷巨头。Meta AI负责人Alexandr Wang否认作弊,并称OpenAI同样如此,谷歌方面暂无回应。
⚡关键信息
- ▸分析机构SemiAnalysis指控谷歌Gemini 3.8 Flash和Meta Muse Spark 1.3存在过拟合刷分
- ▸两款新模型在AA榜单上一度超越OpenAI和Anthropic的旗舰大模型
- ▸Meta AI主管Alexandr Wang否认作弊指控,并反指OpenAI也一样
- ▸Alexandr Wang系Scale AI创始人,Meta收购后执掌其AI业务,Spark模型在其领导下推出
- ▸榜单刷分并非新闻,此前指责多指向国产大模型,如今指向硅谷巨头
🔥犀利点评
这事最讽刺的不是刷分,而是回应的姿态——王坐不住却只会说「OpenAI也一样」,用别人也脏来洗白自己,等于默认了行业集体造假的默契。AI榜单早已从评测工具异化成融资和股价的营销素材,评测集泄露、针对性训练人人有份,跑分参考价值趋近于零。用户该看的不是榜单排名,而是自己场景里的真实表现。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文 →