字節跳動創始人明確拒絕AI蒸餾策略,稱願犧牲短期利益
Alina Collins
字節跳動創始人張一鳴在內部全員會議上表態:公司不會用蒸餾技術提升大模型能力,即便短期落後於國內競爭對手。這一決策的核心驅動力並非技術判斷,而是TikTok面臨的美國合規壓力。
張一鳴說了甚麼?
張一鳴上月在內部全員會議上明確表態:字節跳動不會採用蒸餾技術來提升大模型能力。
蒸餾(用現有先進模型的輸出去訓練新模型,等同於「抄優等生答案來加速學習」)是目前中國AI公司追趕前沿的常見路徑。
張一鳴稱公司「應當願意為長期目標犧牲一些短期利益」,但未具體解釋長期目標是甚麼。
這是張一鳴罕見就公司AI戰略公開表態,信號意義大於技術細節本身。
點解唔蒸餾?真係技術信仰?
據三名知情人士透露,核心驅動力是TikTok的合規壓力,而非純粹的技術路線選擇。
這意味著→ 字節跳動擔心的不是「蒸餾好唔好」,而是「蒸餾美國前沿模型會否給華盛頓新的藉口」。
TikTok此前多次面臨美國封禁威脅,去年才通過將美國數據安全業務出售給美方主導的投資方暫時化解危機。
簡單來說= 這不是一個技術決策,是一個政治避險決策——寧可模型落後,也不能讓TikTok再上一次美國的靶心。
代價有幾大?
字節跳動大語言模型目前落後於阿里巴巴、DeepSeek、智譜AI、月之暗面等國內同行。
最新模型Seed 2.1 Pro未出現在行業最廣泛參考的Artificial Analysis排行榜上,在Arena AI網頁開發編程榜上僅列第19位。
字節的大語言模型幾乎全部閉源,與同行普遍押注開源的策略形成鮮明對比,外界難以獨立評估其真實能力。
這反映出 字節在大語言模型賽道上正變得越來越「孤立」——既不蒸餾,也不開源,排名還在下滑。
內部就冇反對聲音?
據員工透露,字節內部圍繞是否蒸餾的爭論由來已久,每當國內對手發布強力開源模型,爭論便會升溫。
張一鳴此次發聲的時間節點值得留意:就在月之暗面Kimi K3模型引發美方警覺之後不久。
這意味著→ 一名白宮高級官員剛公開指控Kimi K3蒸餾美國前沿模型,張一鳴隨即在內部劃清界限——時間線高度吻合。
字節的AI全係短板?
並非如此。字節在AI視頻生成領域表現突出:Seedance 2.0憑藉超寫實視頻生成能力被業界認為處於全球領先水平。
簡單來說= 字節不是「AI全面落後」,而是在大語言模型這一條賽道上主動選擇了慢跑。
蒸餾策略的取捨最終會在大語言模型競爭格局中留下多大缺口,仍是外界觀察字節AI戰略的核心懸念。
Content is for reference only, not financial advice.