請更新您的瀏覽器

您使用的瀏覽器版本較舊,已不再受支援。建議您更新瀏覽器版本,以獲得最佳使用體驗。

FLUX 3 Video 正式登場!支援文字、圖片生成影片,最長 20 秒並內建音訊

T客邦

更新於 08月19日07:37 • 發布於 08月05日07:00 • ycr

Black Forest Labs 推出 FLUX 3 Video,支援文字與圖片生成影片,並整合音效對話。FLUX 3 Video 具備高畫質影像,大幅提升內容創作效率。

AI 新創 Black Forest Labs 正式推出 FLUX 3 Video,首波開放文字生成影片與圖片生成影片功能,透過 BFL API 與合作夥伴提供服務。新模型可生成最長 20 秒、720p HD 影片,並支援升級至 1080p Full HD,同時原生生成對白、音效與環境音,不需額外配音。FLUX 3 是 Black Forest Labs 最新的多模態 AI 模型,涵蓋影片、音訊、圖片及動作生成能力,此次則是首次正式對外開放影片生成功能。

支援文字、圖片生成影片,還能同步產生音訊

Black Forest Labs 表示,FLUX 3 並非只追求電影感畫面,而是希望更貼近真實世界,因此生成風格可依需求呈現自然、寫實、懷舊、趣味或高度風格化等不同效果,並能理解複雜指令,自由切換鏡位、場景及敘事節奏。

FLUX 3 Video 正式登場!支援文字、圖片生成影片,最長 20 秒並內建音訊
FLUX 3 Video 正式登場!支援文字、圖片生成影片,最長 20 秒並內建音訊

功能方面,FLUX 3 Video 除了支援文字生成影片,也提供圖片轉影片、關鍵影格(Keyframe)控制、影片續寫(Video Continuation)等能力。使用者可輸入最多 4 秒既有影片與音訊,讓 AI 接續生成後續內容,同時維持人物動作、鏡頭運動、對話與音效的一致性。

模型也支援單支影片內切換多個場景與鏡位,並可同步生成角色對話、背景音效與環境聲。官方表示,FLUX 3 Video 支援包括英文、中文、日文、西班牙文、法文、德文、葡萄牙文、俄文、印尼文、土耳其文、印地語、旁遮普語等多種語言,並具備口型同步能力。

新增草稿模式,官方稱效能達頂尖水準

此外,新版本加入 Draft Mode(草稿模式),可先快速生成低成本預覽版本,待確認內容後再輸出完整高畫質影片,讓創作者能更有效率地反覆修改與調整。

FLUX 3 Video 正式登場!支援文字、圖片生成影片,最長 20 秒並內建音訊

Black Forest Labs 表示,根據內部測試與人工評比,FLUX 3 Video 在文字生成影片表現優於目前多數主流模型,在圖片生成影片方面則與 Seedance 2.0 並列領先,整體已達到目前頂尖(State-of-the-Art,SOTA)水準。

FLUX 3 Video 正式登場!支援文字、圖片生成影片,最長 20 秒並內建音訊

在安全性方面,Black Forest Labs 強調已與第三方機構 Cinder 合作,在正式發布前完成風險評估,涵蓋未經同意私密影像及兒少性剝削內容等濫用情境,希望降低生成式 AI 遭到不當使用的風險。

官方也預告,未來 FLUX 3 將持續擴充更多控制功能,並支援結合圖片、影片與音訊等多種素材共同生成影片,同時推出 FLUX 3 Image 圖像模型,以及開放權重版本 FLUX 3 Dev。

查看原始文章

更多科技相關文章

01

輝達發布新AI安全工具 稱可阻止Hugging Face遭駭事件

路透社
02

輝達庫藏股計畫追加1500億美元 規模創紀錄

路透社
03

比爾蓋茲籲美國國會立法 稱AI業者自我監管不夠

路透社
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...