资讯
Anthropic、Meta、谷歌、阿里齐发模型更新 编程能力较量白热化
📋总体概括
9月2日至3日,Anthropic、Meta、谷歌、阿里密集发布旗舰模型更新版:Anthropic推出Claude Fable 5.1与Claude Mythos 5.1,Meta发布Muse Spark 1.3,谷歌上线Gemini 3.8 Flash,阿里Qwen 3.8-Max 0902版本亦已发布。各家升级重点集中在编程、网络安全与办公能力。从第三方榜单看,Claude Fable 5.1智能水平排名第一,Muse Spark 1.3居第三,Gemini 3.8 Flash跌出前十,Qwen新版本暂无测试结果。头部厂商以高频小步迭代抢占榜单与开发者心智,编程能力成为核心竞技场。
⚡关键信息
- ▸Anthropic于9月2日发布Claude Fable 5.1与Claude Mythos 5.1,登顶第三方智能水平榜单
- ▸Meta新发布的Muse Spark 1.3在榜单排名第三,紧咬头部阵营
- ▸谷歌Gemini 3.8 Flash排名跌出前十,旗舰阵营竞争位次明显分化
- ▸阿里Qwen 3.8-Max 0902版本已发布但尚无第三方测试结果
- ▸本轮更新能力提升集中在编程、网络安全和办公三大场景
🔥犀利点评
高频小版本迭代成了行业新常态,榜单成了厂商的营销弹药库。但排名前十还是十名开外的差距,正在被开发者用脚投票放大——编程能力是付费意愿最强的场景,谁掉队谁就丢真金白银。谷歌Flash跌出前十是危险信号,而Qwen没测试结果就先发声明,多少有点抢跑造势的意味。榜单会刷新,护城河还得看实际任务表现。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 财新 阅读全文 →