Black Forest Labs: Blog (Web)
95

Mô hình

FLUX 3 Video: Bước tiến mới trong công nghệ tạo video từ Black Forest Labs

(giờ Việt Nam)

Tóm tắt AI

Black Forest Labs chính thức giới thiệu FLUX 3 Video, mở ra khả năng tạo video chất lượng cao với độ chân thực ấn tượng, đánh dấu cột mốc quan trọng trong lộ trình phát triển mô hình của hãng.

Bản dịch AI

FLUX 3 Video, Part 1: Generation

Kể từ hôm nay, phiên bản đầu tiên của FLUX 3 Video dùng để tạo video từ văn bản và hình ảnh đã chính thức khả dụng thông qua BFL API và một số đối tác chọn lọc. Mô hình này tạo ra các đoạn clip dài tới 20 giây ở độ phân giải HD, với đầu ra Full HD thông qua tính năng nâng cấp độ phân giải (upscaling) và âm thanh gốc được tạo đồng thời cùng video.

FLUX 3 là mô hình đa phương thức tiên phong của chúng tôi trong việc tạo và dự đoán video, âm thanh, hình ảnh và hành động. Với bản phát hành này, khả năng tạo video của mô hình lần đầu tiên được cung cấp rộng rãi. Xem thêm chi tiết về FLUX 3 tại đây.

Các mô hình video phải là các mô hình thực tế.

Thực tế vốn dĩ mang tính đa phương thức; nhưng mỗi hình thức thể hiện (ví dụ: hình ảnh, video, âm thanh) chỉ nắm bắt được một phần của nó. Không một mảnh ghép đơn lẻ nào là hoàn chỉnh. Đây là lý do tại sao FLUX 3 - một mô hình được thiết kế để mô phỏng thực tế chính xác nhất có thể - lại mang tính đa phương thức ngay từ cốt lõi, và được thiết kế để mô phỏng thực tế mà không bị bó hẹp vào một tập hợp con hoặc phong cách đồng nhất nào. Kết quả là các đầu ra video không bị giới hạn trong thẩm mỹ điện ảnh, mà có thể trông chân thực, tự nhiên, vui tươi, hoài cổ hoặc kỳ lạ.

Điều này làm cho FLUX 3 trở thành một mô hình linh hoạt và có khả năng kiểm soát cao cho việc sáng tạo nội dung. FLUX 3 có thể xử lý cả những câu lệnh (prompt) đơn giản và phức tạp với sự hiểu biết sâu sắc về thế giới. Nó có thể chuyển đổi giữa các cảnh và góc máy trong cùng một lần tạo, hiển thị kiểu chữ như một phần tự nhiên của cảnh quay, và tạo lời thoại bằng nhiều ngôn ngữ với giọng điệu và khả năng khớp môi tự nhiên. Cùng một mô hình có thể tạo ra những sản phẩm mang tính cá nhân và tự nhiên, hoặc mang phong cách điện ảnh cách điệu cao, hay đơn giản là mang tính giải trí và vui nhộn.

FLUX 3 Video - Khả năng tạo nội dung

Chúng tôi chính thức cung cấp FLUX 3 Video cho người dùng phổ thông từ hôm nay. Ở dạng ban đầu, FLUX 3 Video có thể tạo các đoạn video dài tới 20 giây kèm âm thanh gốc. Chúng tôi phát hành mô hình ở độ phân giải HD (720p) và Full HD (1080p), đồng thời cung cấp các khả năng sau:

Chế độ Nháp (Draft Mode): Cho phép khám phá các hướng sáng tạo một cách dễ dàng. Việc tạo bản nháp sẽ trả về bản xem trước nhanh cho câu lệnh của bạn với chi phí thấp hơn, giúp bạn có thể lặp lại ý tưởng thay vì phải chờ đợi một bản tạo chất lượng cao đầy đủ mỗi lần. Khi bản nháp đã đạt yêu cầu, FLUX 3 sẽ kết xuất video ở chất lượng đầy đủ. Nó bao gồm cùng các chủ thể, cùng bố cục và cùng chuyển động để đầu ra cuối cùng khớp với phiên bản bạn đã duyệt.

FLUX 3 Video mang đến trải nghiệm video SOTA (tiên tiến nhất).

FLUX 3 Video cung cấp các khả năng SOTA trong cả việc tạo văn bản-thành-video và hình ảnh-thành-video. Chúng tôi đã đánh giá kỹ lưỡng mô hình của mình so với các mô hình tiên tiến nhất hiện có. Kể từ thông báo ban đầu, khả năng xử lý video của FLUX 3 đã tiến bộ hơn nữa. Những người đánh giá là con người nhận thấy đây là mô hình được ưu tiên cho cả việc tạo văn bản-thành-video và hình ảnh-thành-video.

Trong đánh giá nội bộ, FLUX 3 vượt trội hơn các mô hình SOTA hiện có trong việc tạo văn bản-thành-video với khoảng cách đáng kể. Nó ngang bằng với Seedance 2.0 và đánh bại tất cả các mô hình SOTA hiện có khác trong việc tạo hình ảnh-thành-video.

Phát triển và triển khai có trách nhiệm

Chúng tôi cam kết phát triển và triển khai các mô hình AI một cách có trách nhiệm, đồng thời áp dụng nhiều lớp giảm thiểu rủi ro trước, trong và sau khi phát hành để chống lại nguy cơ lạm dụng. Hợp tác với đối tác bên thứ ba đáng tin cậy là Cinder, chúng tôi đã đánh giá FLUX 3 Video trước khi phát hành để xác thực các biện pháp giảm thiểu rủi ro trên toàn bộ các phương thức được hỗ trợ, bao gồm hình ảnh thân mật không có sự đồng ý (NCII) và tài liệu lạm dụng tình dục trẻ em (CSAM).

Điều gì tiếp theo

Các bản phát hành tiếp theo của chúng tôi sẽ mở rộng FLUX 3 Video để tăng cường khả năng kiểm soát và bổ sung các khả năng cho các phương thức mới. Chúng tôi sẽ cho phép tạo video từ sự kết hợp của các tham chiếu hình ảnh, video và âm thanh. Lộ trình của chúng tôi còn bao gồm FLUX 3 Image để tạo và chỉnh sửa hình ảnh, và FLUX 3 Dev như một biến thể mã nguồn mở (open-weight).

Hãy sáng tạo cùng FLUX 3.

FLUX 3 Video hiện đã có sẵn thông qua BFL API và các đối tác được chọn. Chúng tôi rất nóng lòng chờ xem những gì bạn sẽ tạo ra.

Tìm hiểu thêm về FLUX 3 → https://bfl.ai/models/flux-3 Tài liệu tại đây → https://docs.bfl.ai/flux_3

FLUXAI VideoBlack Forest LabsGenerative AICông nghệ mới
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ Black Forest Labs: Blog (Web). Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.