FLUX 3 AI 影片產生器
用 FLUX 3——Black Forest Labs 的多模態基礎模型,生成帶原生音訊的電影級 AI 影片。在 Topview 上,從文字、圖片或影片參考創作最長 20 秒的片段。

什麼是 FLUX 3?

FLUX 3 是 Black Forest Labs 的多模態基礎模型。它在統一的 Self-Flow 架構中聯合學習圖像、影片與音訊,使運動、聲音與視覺結構保持一致。在 Topview 上,你可以線上體驗 FLUX 3 影片生成:文生影片、圖生影片,以及帶原生音訊的參考驅動片段。
為什麼多模態 Self-Flow 很重要
- 一個模型涵蓋圖像、影片與音訊——而非割裂的管線
- 原生音訊與影片同一次生成完成
- 最長 20 秒片段,時間連貫性強
- 文字、圖片與影片參考,可控生成
- 多語言對白與豐富風格多樣性
- 代理人式多鏡頭串聯,支援更長序列
FLUX 3 核心亮點
最長 20 秒影片,聲音內建
一次生成最長 20 秒、風格多樣的片段,音訊同步產出——撞擊、對白與環境音與畫面鎖定,無需單獨配樂步驟。
最長 20 秒 | 原生音訊 | 一次生成
文字、圖片與影片參考
從提示詞起步、讓靜幀動起來,或把參考片段中的角色帶入新場景——無需拼接多個模態工具才能完成工作流程。
文生影片 | 圖生影片 | 影片參考

多鏡頭保持同一角色
影片到影片與代理人式多鏡頭串聯,幫助你在由短片段拼出更長序列時,保持面部身分、服飾與出場感連貫。
V2V 延續 | 多鏡頭 | 身分鎖定
多語言對白與富有表現力的面孔
早期評測顯示面部表情強、多語言對白出色、風格跨度大——從攝影機紀實到動畫與電影質感。
面部表演 | 多語言 | 風格廣度
See what creators make with FLUX 3
Real clips shared on X—watch the posts below, then try FLUX 3 yourself on Topview.
FLUX 3 模型重點
創作者在 Topview 體驗 FLUX 3 影片生成時的關鍵參數與能力一覽。
Self-Flow
在圖像、影片與音訊上統一的多模態流匹配。
圖像 + 影片 + 音訊
聯合學習,使聲音、運動與結構保持對齊。
最長 20 秒
單次生成片段,內建原生音訊(Early Access)。
內建
音訊與影片聯合生成——不是後期單獨步驟。
文字 / 圖片 / 影片
T2V、I2V 動畫或參考,以及 V2V 角色延續。
關鍵影格與連貫性
關鍵影格到影片、影片-音訊續寫、多鏡頭串聯。
多語言
強大的多語言對白,適合全球敘事。
高度多樣
從家用攝影機素材到動畫與電影質感。
動態文字
出色的字體生成與動態設計輸出。
影片 EA 現已開放
透過 Topview 線上體驗 FLUX 3 影片;圖像 EA 即將推出。
10s · 720p
早期偏好測試使用帶音訊的 10 秒 720p T2V 片段。
基礎模型
內容創作與物理 AI(動作)的骨幹模型。
FLUX 3 有何新變化
相較早期 FLUX 圖像模型與常見單模態影片產生器,FLUX 3 在 Self-Flow 下統一圖像、影片與音訊——原生音訊影片,多模態控制更強。
| 能力 | 以往 FLUX / 典型影片模型 | FLUX 3 | 意義何在 |
|---|---|---|---|
| 模型範圍 | 偏圖像,或影片堆疊彼此分離 | 統一多模態基礎模型 | 一套骨幹涵蓋圖像、影片、音訊 |
| 架構 | 依模態的標準流匹配 | Self-Flow 多模態對齊 | 跨模態一致性更好 |
| 影片 + 音訊 | 靜音影片或後期硬掛音訊 | 一次生成原生音訊 | 聲音與物理事件匹配 |
| 片段長度 | 更短,或需多輪流程 | 最長 20 秒單次生成 | 更長且連貫的場景 |
| 圖生影片 | 基礎首幀動畫 | 動畫或視覺參考模式 | I2V 控制更靈活 |
| 角色連貫 | 跨鏡頭身分偏弱 | V2V 角色延續 | 同一角色,新場景 |
| 連貫工具 | 續寫能力有限 | 影片-音訊續寫 + 關鍵影格 | 過渡更可控 |
| 更長敘事 | 手動拼接片段 | 代理人式多鏡頭串聯 | 分鐘級序列 |
| 對白 | 有限或以英語為主 | 多語言對白 | 全球敘事 |
| 字體排版 | 動態文字偏弱 | 強字體與動態設計 | 標題與品牌動效 |
| 圖像品質 | 早期 FLUX 世代 | 複雜提示詞與文字更強 | 中期訓練初步提升 |
| 動作 / 機器人 | 非主要路徑 | 動作預測 + FLUX-mimic | 內容 + 物理 AI |
早期偏好評測
Black Forest Labs 發布了 FLUX 3 Video 的初步偏好結果(10 秒文生影片、720p、帶音訊)。這些是早期評測——模型與評測框架仍在演進,Early Access 期間結果可能繼續提升。
| 對比模型 | 偏好 FLUX 3 |
|---|---|
| Grok Imagine Video | 最高達 69% |
| Kling v3 Pro | 60% |
| Happy Horse v1 | 59% |
| Happy Horse 1.1 | 57% |
| Seedance 2.0 | 52% |
| Gemini Omni Flash | 52% |
| Runway Gen-4.5 | 77% |
| Luma Ray 3.2 | 93% |
僅供初步參考。偏好率來自 BFL 報告的早期人工對比,不應視為最終基準。
BFL 點出的早期優勢
- 人物面部表情
- 聲音與物理事件關聯
- 多語言能力
- 多鏡頭序列中的角色一致性
請把這些早期數據當作方向性訊號,而非絕對排名。在 Topview 線上體驗 FLUX 3 影片生成,用你自己的提示詞與工作流程判斷品質。
在 Topview 體驗 FLUX 3誰適合使用 FLUX 3
面向需要原生音訊多模態 AI 影片的團隊——以及籌備圖像 Early Access、探索動作路徑的創作者與合作夥伴。
電影人與敘事創作者
用對白、音效與多鏡頭串聯打造電影級場景,同時保持角色身分一致。
品牌與效果行銷
一次生成帶音訊的產品揭幕、鉤子與生活風格短片,加速創意測試。
社群與 UGC 創作者
產出直式短影片:多語言對白、潮流風格,以及參考驅動的連貫性。
動態設計師
探索字體、動態設計,以及從家用攝影機到完整電影質感的風格區間。
代理商與製作團隊
用關鍵影格、影片參考與續寫工具,控制鏡頭之間的過渡。
研發與物理 AI 團隊
關注 FLUX 3 Action 與 FLUX-mimic 路徑——影片世界模型與機器人交會處。
如何在 Topview 體驗 FLUX 3

開啟 AI 影片產生器
進入 Topview 的 AI 影片產生器,選擇 FLUX 3,開始文生影片、圖生影片或影片參考工作階段。

加入提示詞與參考
描述場景、對白與音訊。可選上傳圖片或影片參考,用於動畫、風格或角色一致性。

生成並下載
選擇時長與畫幅,生成最長 20 秒、內建原生音訊的影片,預覽後下載你的片段。
線上體驗 FLUX 3 影片生成
在 Topview 創作帶原生音訊的多模態 AI 影片——文字、圖片與影片參考,由 Black Forest Labs 的 FLUX 3 驅動。
FLUX 3 Video Early Access · 圖像 Early Access 將於未來數週開放
