小红书AI模型首次在国际数学奥林匹克竞赛获满分

Miles Bennett
Published todayAbout 2 min read

小红书旗下AI模型dots-note-3.0在今年IMO以42分满分完赛,成为首个在该赛事取得满分的AI模型——这意味着AI数学推理能力在一年内从金牌水平跨越至满分。

01

满分意味着什么?

dots-note-3.0解出本届IMO全部六道题目,拿到42分满分,是历史上首个做到这一点的AI模型。
这意味着→ AI不仅能算出正确答案,还能写出让评委认可的完整数学证明——IMO评的是证明过程的逻辑严密性,不是最终数字。
本届IMO周一在上海落幕,该赛事自1959年起每年举办,被公认为全球最权威的数学竞赛。
02

比去年的金牌选手强在哪?

去年IMO上,谷歌DeepMind和OpenAI的模型各拿到35分(满分42分),已达金牌级别。
dots-note-3.0今年直接拉到42分满分——用大白话说=一年之内,AI数学推理从"顶尖选手"变成了"完美选手"。
这反映出AI推理能力的进步速度远超预期,去年的金牌成绩如今已不再是天花板。
03

dots-note-3.0是什么来头?

它是小红书dots3系列中参数量最小的版本,目前仍处于测试阶段。
这意味着→ 满分成绩来自系列里最"轻量"的模型,更大的jazz和aria版本针对不同场景和算力成本做了优化,潜力尚未展示。
小红书称将"在不久的将来"开源dots-note-3.0,但未披露具体时间表
04

对AI行业意味着什么?

从35分到42分的跨越发生在仅仅一年之内,这意味着→ 现有的AI推理能力评估基准(benchmark)正在被快速击穿。
用大白话说= 用来衡量AI"聪不聪明"的考试,AI已经考满分了——行业需要更难的新标尺。
这也意味着一家以社交内容起家的公司,在AI基础能力赛道上跑出了超越谷歌和OpenAI的单项成绩。

Content is for reference only, not financial advice.

小红书AI模型首次在国际数学奥林匹克竞赛获满分 · nashnova