资讯

Anthropic、Meta、谷歌、阿里齐发模型更新 编程能力较量白热化

财新·2026/9/3 05:38:38🔗 原文

📋总体概括

9月2日至3日,Anthropic、Meta、谷歌、阿里在48小时内密集发布旗舰模型的更新版本:Anthropic推出Claude Fable 5.1与Claude Mythos 5.1,Meta发布Muse Spark 1.3,谷歌上线Gemini 3.8 Flash,阿里推出Qwen3.8-Max 0902版本,能力提升集中在编程、网络安全和办公场景。从第三方榜单看,Claude Fable 5.1智能水平排名第一,Muse Spark 1.3第三,Gemini 3.8 Flash跌出前十,Qwen3.8-Max暂无测评结果。头部厂商以高频小版本迭代抢排名,编程能力已成竞争最激烈的主战场。

关键信息

  • Anthropic于9月2日发布Claude Fable 5.1与Claude Mythos 5.1双旗舰更新,智能水平在第三方榜单排名第一
  • Meta发布Muse Spark 1.3,榜单排名第三,成为Claude之后最接近头部的追赶者
  • 谷歌Gemini 3.8 Flash排名跌出前十,与其旗舰地位形成明显落差
  • 阿里Qwen3.8-Max 0902版本发布但暂无第三方测评结果,实际能力待验证
  • 四家厂商在48小时内集中更新,升级重点集中于编程、网络安全和办公能力

🔥犀利点评

48小时内四家齐发更新,与其说是技术突破,不如说是榜单焦虑下的军备竞赛。Claude在编程上的领先已成共识,其他人都在追Anthropic的尾灯;谷歌旗舰掉出前十尤其难看,说明迭代节奏落后一步就可能被甩出牌桌。但榜单排名是营销素材不是生产力,真正决定胜负的还是编程和Agent能力能否转化为企业付费。阿里无测评就敢发版,抢的是声量不是验证,成色存疑。

各家模型升级越来越频繁,排行榜也不断被刷新


2026年9月2日,人工智能公司Anthropic正式发布新一代旗舰大模型Claude Fable 5.1与Claude Mythos 5.1。图:视觉中国

  【财新网】在各自的旗舰模型基础上,各大模型厂发布更新版模型。北京时间9月2日和3日,Anthropic、Meta、谷歌和阿里等公司发布了基于旗舰模型的更新版本,在编程、网络安全和办公等领域的能力提升。

  目前从第三方AI模型榜单看,最新发布的模型当中,Claude Fable 5.1在智能水平上排名最靠前,Meta新发布的Muse Spark 1.3排名第三,谷歌的新模型Gemini 3.8 Flash排名在十名开外,而阿里Qwen3.8-Max的0902版本暂时还未有测试结果。

本文由本站自动聚合,以下为原始来源:原文 财新 快讯 →