小紅書AI模型首次在國際數學奧林匹克競賽獲滿分

Miles Bennett
Published todayAbout 2 min read

小紅書旗下AI模型dots-note-3.0在今年IMO以42分滿分完賽,成為首個在該賽事取得滿分的AI模型——這意味著AI數學推理能力在一年內從金牌水平躍升至滿分。

01

滿分代表甚麼?

dots-note-3.0解出本屆IMO全部六道題目,取得42分滿分,是史上首個做到這一點的AI模型。
這意味著→ AI不僅能算出正確答案,還能寫出讓評委認可的完整數學證明——IMO評分看的是證明過程的邏輯嚴密性,而非最終數字。
本屆IMO週一在上海落幕,該賽事自1959年起每年舉辦,被公認為全球最權威的數學競賽。
02

比去年的金牌選手強在哪?

去年IMO上,Google DeepMind和OpenAI的模型各取得35分(滿分42分),已達金牌級別。
dots-note-3.0今年直接拉到42分滿分——簡單來說=一年之內,AI數學推理從「頂尖選手」變成了「完美選手」。
這反映出AI推理能力的進步速度遠超預期,去年的金牌成績如今已不再是天花板。
03

dots-note-3.0是甚麼來頭?

它是小紅書dots3系列中參數量最小的版本,目前仍處於測試階段。
這意味著→ 滿分成績來自系列裡最「輕量」的模型,更大的jazz和aria版本針對不同場景和算力成本做了優化,潛力尚未展示。
小紅書稱將「在不久的將來」開源dots-note-3.0,但未披露具體時間表
04

對AI行業意味著甚麼?

從35分到42分的跨越發生在僅僅一年之內,這意味著→ 現有的AI推理能力評估基準(benchmark)正在被快速擊穿。
簡單來說= 用來衡量AI「聰不聰明」的考試,AI已經考滿分了——行業需要更難的新標尺。
這也意味著一家以社交內容起家的公司,在AI基礎能力賽道上跑出了超越Google和OpenAI的單項成績。

Content is for reference only, not financial advice.

小紅書AI模型首次在國際數學奧林匹克競賽獲滿分 · nashnova