張一鳴親自掛帥,字節跳動最快下月發布空間視頻世界模型
nashnova research
據彭博社報道,張一鳴正親自統籌一款實時空間視頻AI模型,最快下月發布;該模型試圖將字節的AI算力、內容平台和Pico頭顯串成閉環,直接對標Meta和蘋果的XR生態。
「世界模型」到底是甚麼?
世界模型(World Model)是一種能模擬真實物理環境的AI系統,用戶可以在生成的虛擬世界裡實時互動,而不只是看一段預錄視頻。
這意味著→ 它的目標不是「生成一段靚片」,而是造出一個可以走進去的空間。
這條路線與Google的Genie、李飛飛和Yann LeCun推動的視覺AI方向相通,被視為機械人、遊戲和自動駕駛的底層能力。
張一鳴為何親自下場?
彭博社引述知情人士稱,張一鳴正親自統籌該項目,模型基於字節已有的視頻生成模型Seedance構建。
簡單來說= 創辦人掛帥通常代表公司將此事放到最高優先級,願意調配頂級資源。
目標應用場景涵蓋直播、短劇和遊戲,但知情人士亦指出發布時間尚未確定,計劃可能調整。
「飛輪」怎樣轉?
張一鳴構想的閉環是:AI模型 + 雲端算力 + 內容平台(抖音/CapCut/豆包) + Pico頭顯,四個環節互相餵養。
具體而言,模型能響應Pico用戶的語音或動作指令,按需生成視頻,延遲約0.05秒,幀率20幀/秒。
這意味著→ 重活在雲端處理,頭顯只負責顯示——硬件可以做得更平、更輕,降低用戶門檻。
對標Meta和蘋果,字節有甚麼牌?
Meta靠Quest打大眾市場,蘋果用Vision Pro錨定高端空間計算,但兩者至今都未能大規模普及。
字節的差異化押注在於:將計算留在雲端,用AI生成內容填充硬件,而非等開發者慢慢做應用。
說白了= Meta和蘋果賣的是「好硬件等好內容」,字節想反轉——用AI直接造內容,令硬件變平。
錢從何來?
彭博社上周報道,字節跳動已取得一筆300億美元貸款,用於擴充AI能力和數據中心。
此前亦有報道指字節正考慮最高700億美元的資本開支投入AI佈局。
這反映出字節在AI基礎設施上的投入力度,已進入與全球頂級科技公司同一量級的軍備競賽。
這個飛輪轉得起來嗎?
關鍵驗證點很明確:世界模型能否在Pico生態中形成真實的用戶規模。
若用戶不買帳,雲端算力就是空轉的成本;若用戶湧入,內容與硬件便能互相拉動。
簡單來說= 模型再強,最終要看有沒有人願意戴上頭顯、走進這個世界。
市场有风险,内容仅供研究参考,不构成投资建议。