Anthropic Fable 5.1登頂基準測試,拉開與中國模型差距

nashnova research
今天发布阅读约 2 分钟

Anthropic 9月3日發佈 Fable 5.1,在兩項主流 AI 基準測試中均奪得全球第一,領先中國頭部模型6分。這意味著→ 美國閉源前沿與中國開源陣營的性能差距正重新拉大,但價格與商業滲透率的賽道上,勝負遠未分出。

01

Fable 5.1到底強在哪?

Fable 5.1 在 Artificial Analysis 智能指數上取得 66分、全球第一,領先中國最強的月之暗面 Kimi K3 和智譜 GLM-5.3 各 6分
它同時登頂 Vals Index(一個衡量金融、編程、法律等真實複雜任務的排行榜),Anthropic 自家的 Opus 5 和 Fable 5 分列第二、第三。
簡單來說= 同一家公司包攬前三,說明 Anthropic 目前在「最難的活」上沒有對手。
02

「中國已經追平」的說法還成立嗎?

Databricks 技術人員金宇晨稱 Fable 5.1 的能力躍升「驚人」
部分觀察人士認為,這次結果直接打破了「中國開源開發者已追平前沿」的敘事。
這意味著→ 在基準測試衡量的那一層——最複雜的編程與知識工作——中美之間的差距正在重新拉開,而非繼續收窄。
03

但中國模型的真正優勢在別處?

中國模型走的是預算友好型開源路線,在全球商業市場持續擴大份額。
這反映出中美兩條截然不同的路線選擇:美國押注閉源前沿性能,中國押注低價大規模滲透。
簡單來說= 美國在「誰最聰明」上領先,中國在「誰用的人最多」上進攻——前沿性能和商業滲透率能否同步,是判斷這場競爭走向的核心問題。

市场有风险,内容仅供研究参考,不构成投资建议。

Anthropic Fable 5.1登頂基準測試,拉開與中國模型差距 · nashnova