资讯

Anthropic、Meta、谷歌、阿里齐发模型更新 编程能力较量白热化

财新·2026/9/3 05:38:38🔗 原文

📋总体概括

9月2日至3日,Anthropic、Meta、谷歌、阿里在48小时内密集发布旗舰模型的更新版本:Anthropic推出Claude Fable 5.1与Claude Mythos 5.1,Meta发布Muse Spark 1.3,谷歌上线Gemini 3.8 Flash,阿里推出Qwen3.8-Max 0902版本,能力提升集中在编程、网络安全和办公场景。从第三方榜单看,Claude Fable 5.1智能水平排名第一,Muse Spark 1.3第三,Gemini 3.8 Flash跌出前十,Qwen3.8-Max暂无测评结果。头部厂商以高频小版本迭代抢排名,编程能力已成竞争最激烈的主战场。

关键信息

  • Anthropic于9月2日发布Claude Fable 5.1与Claude Mythos 5.1双旗舰更新,智能水平在第三方榜单排名第一
  • Meta发布Muse Spark 1.3,榜单排名第三,成为Claude之后最接近头部的追赶者
  • 谷歌Gemini 3.8 Flash排名跌出前十,与其旗舰地位形成明显落差
  • 阿里Qwen3.8-Max 0902版本发布但暂无第三方测评结果,实际能力待验证
  • 四家厂商在48小时内集中更新,升级重点集中于编程、网络安全和办公能力

🔥犀利点评

48小时内四家齐发更新,与其说是技术突破,不如说是榜单焦虑下的军备竞赛。Claude在编程上的领先已成共识,其他人都在追Anthropic的尾灯;谷歌旗舰掉出前十尤其难看,说明迭代节奏落后一步就可能被甩出牌桌。但榜单排名是营销素材不是生产力,真正决定胜负的还是编程和Agent能力能否转化为企业付费。阿里无测评就敢发版,抢的是声量不是验证,成色存疑。

本文由本站自动聚合,以下为原始来源:前往 财新 阅读全文