Anthropic Fable 5.1登顶基准测试,拉开与中国模型差距
nashnova research
Anthropic 9月3日发布 Fable 5.1,在两项主流AI基准测试中均拿下全球第一,领先中国头部模型6分。这意味着→ 美国闭源前沿与中国开源阵营的性能差距正在重新拉大,但价格与商业渗透率的赛道上,胜负远未分出。
Fable 5.1到底强在哪?
Fable 5.1 在 Artificial Analysis 智能指数上拿下 66分、全球第一,领先中国最强的月之暗面 Kimi K3 和智谱 GLM-5.3 各 6分。
它同时登顶 Vals Index(一个衡量金融、编程、法律等真实复杂任务的排行榜),Anthropic 自家的 Opus 5 和 Fable 5 分列二、三。
用大白话说= 同一家公司包揽了前三,说明 Anthropic 目前在"最难的活"上没有对手。
"中国已经追平"的说法还成立吗?
Databricks 技术人员金宇晨称 Fable 5.1 的能力跃升"惊人"。
部分观察人士认为,这次结果直接打破了"中国开源开发者已追平前沿"的叙事。
这意味着→ 在基准测试衡量的那一层——最复杂的编程与知识工作——中美之间的差距正在重新拉开,而非继续收窄。
但中国模型的真正优势在别处?
中国模型走的是预算友好型开源路线,在全球商业市场持续扩大份额。
这反映出中美两条截然不同的路线选择:美国押注闭源前沿性能,中国押注低价大规模渗透。
用大白话说= 美国在"谁最聪明"上领先,中国在"谁用的人最多"上进攻——前沿性能和商业渗透率能否同步,是判断这场竞争走向的核心问题。
市场有风险,内容仅供研究参考,不构成投资建议。