張一鳴親自掛帥,字節跳動最快下月發布空間視頻世界模型

nashnova research
今天发布阅读约 3 分钟

據彭博社報道,張一鳴正親自統籌一款實時空間視頻AI模型,最快下月發布;該模型試圖將字節的AI算力、內容平台和Pico頭顯串成閉環,直接對標Meta和蘋果的XR生態。

01

「世界模型」到底是甚麼?

世界模型(World Model)是一種能模擬真實物理環境的AI系統,用戶可以在生成的虛擬世界裡實時互動,而不只是看一段預錄視頻。
這意味著→ 它的目標不是「生成一段靚片」,而是造出一個可以走進去的空間
這條路線與Google的Genie、李飛飛和Yann LeCun推動的視覺AI方向相通,被視為機械人、遊戲和自動駕駛的底層能力。
02

張一鳴為何親自下場?

彭博社引述知情人士稱,張一鳴正親自統籌該項目,模型基於字節已有的視頻生成模型Seedance構建。
簡單來說= 創辦人掛帥通常代表公司將此事放到最高優先級,願意調配頂級資源。
目標應用場景涵蓋直播、短劇和遊戲,但知情人士亦指出發布時間尚未確定,計劃可能調整
03

「飛輪」怎樣轉?

張一鳴構想的閉環是:AI模型 + 雲端算力 + 內容平台(抖音/CapCut/豆包) + Pico頭顯,四個環節互相餵養。
具體而言,模型能響應Pico用戶的語音或動作指令,按需生成視頻,延遲約0.05秒,幀率20幀/秒
這意味著→ 重活在雲端處理,頭顯只負責顯示——硬件可以做得更平、更輕,降低用戶門檻。
04

對標Meta和蘋果,字節有甚麼牌?

Meta靠Quest打大眾市場,蘋果用Vision Pro錨定高端空間計算,但兩者至今都未能大規模普及
字節的差異化押注在於:將計算留在雲端,用AI生成內容填充硬件,而非等開發者慢慢做應用。
說白了= Meta和蘋果賣的是「好硬件等好內容」,字節想反轉——用AI直接造內容,令硬件變平
05

錢從何來?

彭博社上周報道,字節跳動已取得一筆300億美元貸款,用於擴充AI能力和數據中心。
此前亦有報道指字節正考慮最高700億美元的資本開支投入AI佈局。
這反映出字節在AI基礎設施上的投入力度,已進入與全球頂級科技公司同一量級的軍備競賽。
06

這個飛輪轉得起來嗎?

關鍵驗證點很明確:世界模型能否在Pico生態中形成真實的用戶規模
若用戶不買帳,雲端算力就是空轉的成本;若用戶湧入,內容與硬件便能互相拉動。
簡單來說= 模型再強,最終要看有沒有人願意戴上頭顯、走進這個世界

市场有风险,内容仅供研究参考,不构成投资建议。

張一鳴親自掛帥,字節跳動最快下月發布空間視頻世界模型 · nashnova