智譜GLM-5.3程式設計能力超越Claude Opus 4.8,仍落後Fable 5

Nashnova编辑部
Published todayAbout 2 min read

智譜即將發布GLM-5.3模型,編程基準得分31.4%超過Claude Opus 4.8的29.5%,但與Anthropic旗艦Fable 5的39.5%仍有明顯差距——國產開源模型正在追趕,但頭部天花板尚未觸及。

01

31.4%對29.5%——GLM-5.3贏在哪裡?

GLM-5.3在高努力模式下取得31.4%的編程基準得分,用了約5萬個輸出token
同一基準上,Anthropic的Claude Opus 4.8得分29.5%,卻用了12萬個token——超過GLM-5.3的兩倍。
這意味著→ GLM-5.3不僅分數更高,而且token效率(用更少的輸出完成更多任務)有明顯優勢,「話更少、活更好」。
02

離Fable 5還有多遠?

Anthropic旗艦模型Claude Fable 5在最大努力模式下得分39.5%,比GLM-5.3高出8.1個百分點
簡單來說= GLM-5.3剛剛越過了Opus 4.8這道線,但離真正的天花板還差一個量級的跨越。
這反映出頭部AI編程能力的競爭格局:第一梯隊內部差距正在收窄,而旗艦與追趕者之間仍有結構性落差。
03

同一底座、快速迭代——智譜的策略是甚麼?

GLM-5.3構建在與前代(今年6月發布)相同的7000億參數基礎模型之上,並非重新訓練底座。
這意味著→ 智譜走的是「底座不動、上層快速調優」的路線,用更低成本換更快的能力提升。
這是中國開源權重模型陣營追趕Anthropic和OpenAI的縮影——GLM-5.3能否繼續縮小與Fable 5的差距,將是觀察國產大模型編程賽道競爭格局的關鍵節點。

Content is for reference only, not financial advice.

智譜GLM-5.3程式設計能力超越Claude Opus 4.8,仍落後Fable 5 · nashnova