Trình tạo video AI FLUX 3
Tạo video AI điện ảnh với audio gốc bằng FLUX 3—mô hình nền multimodal của Black Forest Labs. Tạo clip tối đa 20 giây từ văn bản, hình ảnh hoặc reference video trên Topview.


FLUX 3 là gì?

FLUX 3 là mô hình nền multimodal của Black Forest Labs. Nó học chung từ hình ảnh, video và audio trong kiến trúc Self-Flow thống nhất—nên chuyển động, âm thanh và cấu trúc hình giữ nhất quán. Trên Topview, bạn dùng thử tạo video FLUX 3 online cho văn bản thành video, hình ảnh thành video và clip dẫn reference với audio gốc.
Vì sao Self-Flow multimodal quan trọng
- Một mô hình cho hình ảnh, video và audio—không pipeline rời
- Audio gốc được tạo cùng video trong một lượt
- Clip tối đa 20 giây với liên tục thời gian mạnh
- Reference văn bản, hình và video để tạo có kiểm soát
- Thoại đa ngôn ngữ và đa dạng phong cách cao
- Ghép multi-shot kiểu agent cho chuỗi dài hơn
Tính năng nổi bật FLUX 3
Video tối đa 20s với âm thanh sẵn
Tạo clip đa dạng tối đa 20 giây trong một lượt, với audio tạo chung—nên va chạm, thoại và ambience khóa với hình mà không cần bước soundtrack riêng.
Tối đa 20s | Audio gốc | Một lượt
Reference văn bản, hình và video
Bắt đầu từ câu lệnh, làm sống still, hoặc mang nhân vật từ clip reference sang cảnh mới—không ghép công cụ modality rời thành một quy trình.
Văn bản thành video | Hình ảnh thành video | Reference video

Giữ cùng nhân vật qua các shot
Video thành video và ghép multi-shot kiểu agent giúp giữ nhận diện khuôn mặt, trang phục và hiện diện gắn kết khi bạn dựng chuỗi dài hơn từ clip ngắn.
V2V carry-over | Multi-shot | Identity lock
Thoại đa ngôn ngữ và khuôn mặt biểu cảm
Đánh giá sớm nhấn biểu cảm khuôn mặt mạnh, thoại đa ngôn ngữ và dải phong cách rộng—từ thực camcorder đến hoạt họa và điện ảnh.
Diễn khuôn mặt | Đa ngôn ngữ | Dải phong cách
Xem creator làm gì với FLUX 3
Clip thật chia sẻ trên X—xem bài bên dưới, rồi tự dùng thử FLUX 3 trên Topview.
Điểm nổi bật mô hình FLUX 3
Tham số và khả năng chính cho creator dùng thử tạo video FLUX 3 trên Topview.
Self-Flow
Flow matching multimodal thống nhất qua hình, video và audio.
Hình + Video + Audio
Học chung để âm thanh, chuyển động và cấu trúc giữ thẳng hàng.
Tối đa 20s
Clip một lần tạo với audio gốc (Early Access).
Sẵn
Audio tạo chung với video—không phải bước hậu kỳ riêng.
Văn bản / Hình / Video
T2V, animation hoặc reference I2V, và carry-over nhân vật V2V.
Keyframe & liên tục
Keyframe thành video, tiếp tục video-audio, ghép multi-shot.
Đa ngôn ngữ
Thoại đa ngôn ngữ mạnh cho kể chuyện toàn cầu.
Đa dạng cao
Từ footage camcorder đến hoạt họa và look điện ảnh.
Chữ chuyển động
Tạo typography mạnh và đầu ra thiết kế hoạt họa.
Video EA Now
Dùng thử video FLUX 3 online qua Topview; Image EA sắp ra.
10s · 720p
Bài preference sớm dùng clip T2V 10s ở 720p với audio.
Mô hình nền
Xương sống cho tạo nội dung và physical AI (action).
Điểm mới trong FLUX 3
So với mô hình hình FLUX trước và trình tạo video đơn modality điển hình, FLUX 3 thống nhất hình, video và audio dưới Self-Flow—với video audio gốc và kiểm soát multimodal mạnh hơn.
| Khả năng | FLUX trước / mô hình video điển hình | FLUX 3 | Vì sao quan trọng |
|---|---|---|---|
| Phạm vi mô hình | Tập trung hình hoặc stack video riêng | Nền multimodal thống nhất | Một xương sống cho hình, video, audio |
| Kiến trúc | Flow matching chuẩn theo modality | Căn chỉnh multimodal Self-Flow | Nhất quán xuyên modal tốt hơn |
| Video + audio | Video câm hoặc audio gắn thêm | Audio gốc trong một lần tạo | Âm khớp sự kiện vật lý |
| Độ dài clip | Quy trình ngắn hơn hoặc nhiều lượt | Tối đa 20s một lượt | Cảnh gắn kết dài hơn |
| Hình ảnh thành video | Animation khung bắt đầu cơ bản | Chế độ animation hoặc reference hình | Kiểm soát I2V linh hoạt |
| Liên tục nhân vật | Nhận diện yếu qua shot | Carry-over nhân vật V2V | Cùng nhân vật, cảnh mới |
| Công cụ liên tục | Tiếp tục hạn chế | Tiếp tục video-audio + keyframe | Chuyển cảnh có kiểm soát |
| Câu chuyện dài hơn | Ghép clip thủ công | Ghép multi-shot kiểu agent | Chuỗi quy mô phút |
| Thoại | Hạn chế hoặc thiên tiếng Anh | Thoại đa ngôn ngữ | Kể chuyện toàn cầu |
| Typography | Chữ chuyển động yếu | Typography mạnh & thiết kế hoạt họa | Title và motion thương hiệu |
| Chất lượng hình | Thế hệ FLUX trước | Câu lệnh phức tạp & chữ cải thiện | Lợi ích midtraining sơ bộ |
| Action / robotics | Không phải đường chính | Dự đoán action + FLUX-mimic | Nội dung + physical AI |
Đánh giá preference sớm
Black Forest Labs công bố kết quả preference sơ bộ cho FLUX 3 Video (clip văn bản thành video 10 giây ở 720p với audio). Đây là đánh giá sớm—mô hình và harness vẫn đang phát triển, và kết quả có thể cải thiện trong Early Access.
| Mô hình so sánh | FLUX 3 được ưa hơn |
|---|---|
| Grok Imagine Video | Tối đa 69% |
| Kling v3 Pro | 60% |
| Happy Horse v1 | 59% |
| Happy Horse 1.1 | 57% |
| Seedance 2.0 | 52% |
| Gemini Omni Flash | 52% |
| Runway Gen-4.5 | 77% |
| Luma Ray 3.2 | 93% |
Chỉ sơ bộ. Tỷ lệ preference phản ánh so sánh người sớm do BFL báo cáo và không nên xem như benchmark cuối.
Điểm mạnh sớm BFL nêu
- Biểu cảm khuôn mặt người
- Gắn âm thanh với sự kiện vật lý
- Khả năng đa ngôn ngữ
- Nhất quán nhân vật qua chuỗi multi-shot
Dùng số liệu sớm này như tín hiệu hướng—không xếp hạng tuyệt đối. Dùng thử tạo video FLUX 3 online trên Topview và đánh giá chất lượng trên câu lệnh và quy trình của bạn.
Dùng thử FLUX 3 trên TopviewAi nên dùng FLUX 3
Dựng cho đội cần video AI multimodal với audio gốc—cộng creator chuẩn bị Image Early Access và đối tác khám phá action.
Nhà làm phim & kể chuyện
Dựng cảnh điện ảnh với thoại, SFX và ghép multi-shot trong khi giữ nhận diện nhân vật nhất quán.
Marketer thương hiệu & hiệu suất
Sản xuất reveal sản phẩm, móc và spot lifestyle với audio trong một lần tạo để test sáng tạo nhanh hơn.
Creator social & UGC
Xuất reel dọc với thoại đa ngôn ngữ, phong cách trend và liên tục dẫn reference.
Nhà thiết kế motion
Khám phá typography, thiết kế hoạt họa và dải phong cách từ camcorder đến look điện ảnh đầy đủ.
Agency & đội sản xuất
Dùng keyframe, reference video và công cụ tiếp tục để kiểm soát chuyển cảnh qua shot.
Đội R&D và physical AI
Theo đường FLUX 3 Action và FLUX-mimic nơi mô hình thế giới video gặp robotics.
Cách dùng thử FLUX 3 trên Topview

Mở trình tạo video AI
Vào trình tạo video AI của Topview và chọn FLUX 3 để bắt đầu phiên văn bản thành video, hình ảnh thành video hoặc reference video.

Thêm câu lệnh và reference
Mô tả cảnh, thoại và audio. Tùy chọn tải hình hoặc video reference cho animation, phong cách hoặc nhất quán nhân vật.

Tạo và tải xuống
Chọn thời lượng và tỷ lệ, tạo video tối đa 20 giây với audio gốc, rồi xem và tải clip.
Dùng thử tạo video FLUX 3 online
Tạo video AI multimodal với audio gốc trên Topview—reference văn bản, hình và video do FLUX 3 của Black Forest Labs cung cấp.
FLUX 3 Video Early Access · Image Early Access sẽ ra trong vài tuần tới