輝達50億押注SSI,首個模型疑本週發布
Nashnova编辑部
英偉達向蘇茨克維爾創立的SSI投資50億美元並開放下一代晶片獨家訪問權,SSI首個模型疑似本週發布——這是對當前主流AI訓練範式的一次正面挑戰。
SSI是誰,為甚麼值得英偉達下這麼大的注?
SSI全稱「安全超級智能」(Safe Superintelligence),由伊利亞·蘇茨克維爾創立——他是OpenAI的聯合創始人,被公認為深度學習領域最核心的技術人物之一。
SSI的定位極其激進:不發布中間產品,直奔超級智能。這意味著→ 它不會像其他實驗室那樣先出聊天機械人再迭代,而是把全部資源壓在一條尚未被驗證的技術路線上。
英偉達今年7月宣布與SSI達成長期戰略合作,承諾12個月內將SSI算力提升10倍,並開放下一代Vera Rubin系統的獨家訪問權限。英偉達在新聞稿中表示,這個決定是在「獲得了對其嚴密保護的研究成果的罕見訪問權」之後才做出的。
簡單來說= 英偉達看了SSI的底牌,然後決定押50億美元——這本身就是一個信號。
首個模型甚麼時候出?有多少實錘?
投資人加文·貝克在播客中透露,SSI曾表示將於8月發布其模型。
a16z合夥人馬丁·卡薩多近日暗示接觸到了「今年最重磅的新模型」——a16z正是SSI的核心投資方之一。
目前沒有SSI官方的發布日期確認,但多位矽谷投資人的公開暗示指向本週。這反映出SSI內部可能已經進入了成果展示階段。
「測試時訓練」到底是甚麼?和現在的AI有甚麼不同?
據報道,SSI首個模型基於測試時訓練(Test-Time Training,簡稱TTT)架構。簡單來說= 現在的AI模型像一本印好的教科書——訓練完成後內容就固定了,遇到新問題只能在已有知識裡翻找答案。
TTT架構完全不同:模型在回答問題的過程中會實時修改自身的參數權重,相當於一邊考試一邊學習。這意味著→ 模型面對新信息時不只是「查找」,而是真的在「理解和適應」。
現有的主流做法(包括OpenAI的o1系列)靠擴大上下文窗口來處理更多信息,但模型本身不變。TTT則讓模型在推理時產生梯度更新(一種讓神經網絡調整自身的數學機制),從根本上改變了「模型何時學習」這個問題的答案。
蘇茨克維爾為甚麼認定這條路線?
蘇茨克維爾在2024年NeurIPS大會上公開預言:預訓練時代即將結束。他在2025年11月的播客中進一步指出,AI正從「規模擴展時代」邁向「研究時代」。
這反映出他的核心判斷:靠堆數據、堆算力把模型做大的老路正在碰到天花板,下一步突破必須來自架構層面的根本創新。
SSI投資人杰德·麥卡勒布曾聯署論文,明確指出「長上下文語言建模根本不是架構問題,而是連續學習問題」——這和TTT路線高度吻合,說明SSI團隊內部對這個方向有共識。
如果SSI的模型真的管用,誰會受到衝擊?
目前各大AI廠商的競爭壁壘建立在兩個基礎上:預訓練算力規模和上下文窗口長度。誰的訓練集群大、窗口長,誰就領先。
如果TTT架構被證明有效,這兩道護城河都會被削弱。這意味著→ 花了幾十億美元建訓練集群的公司,可能發現競爭對手用一種完全不同的方式繞過了自己的優勢。
英偉達提前鎖定SSI獨家算力供應的戰略意圖也會更加清晰:無論哪條路線勝出,英偉達都要站在供應鏈的上游。說白了= 英偉達不賭誰贏,它賭的是不管誰贏都得用它的晶片。
Content is for reference only, not financial advice.