張一鳴重金押注「世界模型」,字節跳動轉型搶攻 AI 空間視覺
字節跳動正加速進軍「世界模型」領域,計劃推出一款全新的人工智慧即時空間影片生成模型。據知情人士透露,創辦人張一鳴親自出馬督軍,全面整合內部各事業體的資源與強大算力來推動此專案。這款備受矚目的新模型最快有望於下個月正式亮相,不過確切的發布時程與後續計畫仍有調整空間。
這款新模型建構於字節跳動現有的 Seedance 影片生成系統之上,核心目標是讓使用者能輕鬆打造高互動性的虛擬世界,未來應用場景將廣泛涵蓋直播、短劇與遊戲。其最大突破在於跳脫傳統影片生成,賦予內容空間感與即時互動性──使用者能透過聲音或動作直接影響虛擬環境的呈現,並預計與字節跳動旗下的擴增實境(XR)品牌 Pico 硬體深度連動。
為了解決設備效能瓶頸,該系統主打將高耗能的空間內容運算全面轉移至雲端處理,藉此大幅降低頭戴裝置的硬體門檻與初期成本。在效能表現上,模型預計能達到每秒 20 幀的即時輸出,且延遲僅約 0.05 秒,提供流暢的空間運算環境與介面。對字節跳動而言,這項技術突破不僅是 AI 領域的升級,更是完美串聯旗下內容平台、雲端資源與 XR 硬體生態系的關鍵布局。
ByteDance Founder Joins AI Elite in Race to Perfect World Models
ByteDance prepares AI model for real-time spatial video generation, taking aim at Google, Meta
ByteDance founder joins AI elite in race to perfect world models
(首圖來源:科技新報)