智谱GLM-5.3-Flash称全量国产芯片承载,港股单日涨逾8%

Nashnova编辑部
今天发布阅读约 4 分钟

智谱宣布GLM-5.3-Flash全部在线请求由超10万张国产芯片承载,港股单日涨逾8%报1115港元——国产算力替代叙事首次从实验室推到了生产级规模。

01

这个模型到底跑出了什么成绩?

GLM-5.3-Flash此前以匿名代号"Ox Alpha"上线OpenRouter平台,5天内累计产生超50万亿token流量,当前使用量已超DeepSeek两倍以上。
在AA综合智能指数中排名第10,高于DeepSeek V4 Pro Max,与Anthropic的Claude Opus 4.8持平(均为57分)。
这意味着→ 智谱用一个激活参数仅18B的"轻量版"模型,跑出了与行业旗舰持平的评测分数,同时把价格压到了旗舰的十分之一。
02

"全量国产芯片"——这个说法有多硬?

智谱声明:GLM-5.3-Flash全部在线推理请求均由超过10万张国产芯片承载,将国产算力替代从概念验证推向了生产级部署。
但CNBC指出,无法独立核实该芯片声明,智谱亦拒绝披露具体供应商。据《晚点LatePost》此前了解,供应商或来自华为、摩尔线程与海光,智谱官方未予置评。
用大白话说= 这是目前最大规模的"国产芯片跑大模型"公开声明,但第三方还没能验证,芯片到底是谁家的也没有官方确认。
03

怎么用国产芯片撑住百万token上下文?

单张国产芯片的主要瓶颈在于内存容量与带宽。智谱在SGLang(一种开源推理框架)基础上构建了专用引擎,采用W8A8量化(把模型权重和激活值都压缩到8位精度,省显存、提速度)、混合缓存量化及节点内张量并行等技术。
同时引入生产级EPD分离式架构(把"理解输入""填充上下文""逐字生成"三个阶段拆开,分别调度芯片资源),端到端服务性能比同一硬件上的初始基线提升了3倍
这意味着→ 国产芯片单卡性能仍有差距,但智谱用工程手段——量化、拆分、并行——把差距压到了可以上线商用的程度。
04

定价打到什么程度?

GLM-5.3-Flash每百万token输入0.8元、输出2.8元,为旗舰GLM-5.3的十分之一
上线前两周实行半价,限时折扣内定价约为Claude Opus 4.8的1/40
这反映出智谱的策略:先用极低价抢流量和开发者生态,再用规模摊薄国产芯片的单位成本。
05

同板块MiniMax表现如何?竞争格局怎么看?

同日MiniMax(00100.HK)港股涨约3%,披露上半年营收同比增长283%,但调整后净亏损超过翻倍,达2.93亿美元
两家公司均于今年1月在港上市,智谱自IPO以来累计涨超800%,MiniMax累计涨超80%——差距已拉到一个量级。
用大白话说= MiniMax增收但亏损更大,智谱的股价走势说明市场目前把"国产芯片+顶级评测分数"的组合看得比单纯营收增长更值钱。
06

接下来看什么?

智谱定于下周一发布上半年业绩,届时商业化收入能否支撑当前估值,是这波国产芯片叙事能否持续的关键验证节点。
这意味着→ 市场已经为"国产算力替代"给出了溢价,但如果收入数据跟不上,股价回调压力会很大。

市场有风险,内容仅供研究参考,不构成投资建议。

智谱GLM-5.3-Flash称全量国产芯片承载,港股单日涨逾8% · nashnova