智谱GLM-5.3编程能力超越Claude Opus 4.8,仍落后Fable 5

Nashnova编辑部
Published todayAbout 2 min read

智谱即将发布GLM-5.3模型,编程基准得分31.4%超过Claude Opus 4.8的29.5%,但与Anthropic旗舰Fable 5的39.5%仍有明显差距——国产开源模型正在追赶,但头部天花板尚未触及。

01

31.4% vs 29.5%——GLM-5.3赢在哪里?

GLM-5.3在高努力模式下拿到31.4%的编程基准得分,用了约5万个输出token
同一基准上,Anthropic的Claude Opus 4.8得分29.5%,却用了12万个token——超过GLM-5.3的两倍。
这意味着→ GLM-5.3不仅分数更高,而且"话更少、活更好",token效率(用更少的输出完成更多任务)有明显优势。
02

离Fable 5还有多远?

Anthropic旗舰模型Claude Fable 5在最大努力模式下得分39.5%,比GLM-5.3高出8.1个百分点
用大白话说= GLM-5.3刚刚越过了Opus 4.8这道线,但离真正的天花板还差一个量级的跨越。
这反映出头部AI编程能力的竞争格局:第一梯队内部差距正在缩小,但旗舰与追赶者之间仍有结构性落差。
03

同一底座、快速迭代——智谱的策略是什么?

GLM-5.3构建在与前代(今年6月发布)相同的7000亿参数基础模型之上,并非重新训练底座。
这意味着→ 智谱走的是"底座不动、上层快速调优"的路线,用更低成本换更快的能力提升。
这是中国开源权重模型阵营追赶Anthropic和OpenAI的缩影——GLM-5.3能否继续缩小与Fable 5的差距,将是观察国产大模型编程赛道竞争格局的关键节点。

Content is for reference only, not financial advice.

智谱GLM-5.3编程能力超越Claude Opus 4.8,仍落后Fable 5 · nashnova