IT Home
88

Mô hình

ByteDance ra mắt Seedance 2.5: Bước tiến mới trong tạo video 30 giây với khả năng kể chuyện logic

(giờ Việt Nam)

Tóm tắt AI

ByteDance vừa trình làng mô hình Seedance 2.5, nâng cấp thời lượng tạo video lên 30 giây mỗi lần và cải thiện đáng kể khả năng duy trì tính nhất quán, logic giữa các cảnh quay.

Bản dịch AI

Theo tin từ IT ngày 31 tháng 7, ByteDance hôm nay đã ra thông báo chính thức ra mắt mô hình tạo video Seedance 2.5. Mô hình này có khả năng tạo các đoạn video chất lượng cao dài 30 giây trong một lần duy nhất, sẽ lần lượt được cập nhật trên Jimeng AI ( AI) và Doubao bản chuyên nghiệp, đồng thời dịch vụ API cũng sẽ sớm được tích hợp vào Volcano Ark.

Theo công bố từ hãng, Seedance 2.5 kế thừa kiến trúc tạo đồng thời âm thanh và video đa phương thức thống nhất của Seedance 2.0, tập trung cải thiện khả năng kể chuyện dài, tham chiếu đa phương thức và năng lực chỉnh sửa.

Mô hình này hướng tới các lĩnh vực như điện ảnh truyền hình, quảng cáo, giáo dục, sản xuất công nghiệp, trí tuệ hiện thân (embodied AI) và xe tự lái, với mục tiêu chuyển dịch việc tạo video từ "tạo một đoạn clip" sang "hoàn thiện một tác phẩm sáng tạo".

Về khả năng tạo video, Seedance 2.5 nâng thời lượng tạo video mỗi lần từ 15 giây lên 30 giây và hỗ trợ kéo dài video qua nhiều vòng. Theo hãng, mô hình có thể sắp xếp nhiều cảnh quay có liên kết logic trong vòng 30 giây, giúp câu chuyện được triển khai theo trình tự: đặt vấn đề, phát triển, cao trào và kết thúc.

Trong ví dụ minh họa chính thức, một đoạn clip ca sĩ bước lên sân khấu với cú máy quay liên tục (one-shot) đã thể hiện một câu chuyện hoàn chỉnh: ống kính đẩy từ khe hở của tấm màn đỏ dày, tiến vào phòng trang điểm ấm áp phía sau sân khấu; nữ ca sĩ trẻ chỉnh lại tai nghe, nhân viên nhắc nhở cô lên sân khấu; ca sĩ đi qua lối đi hậu trường, tương tác với bạn nhảy và nhận micro; sau đó bước lên sân khấu, ống kính cuối cùng kéo xa ra toàn cảnh sân vận động, hiển thị khán giả, bảng đèn, gậy phát sáng và tiếng reo hò.

Về khả năng kéo dài video qua nhiều vòng, ví dụ của hãng yêu cầu mô hình tiếp tục tạo thêm 30 giây dựa trên video có sẵn, đồng thời giữ nguyên nhân vật chính, bối cảnh, phong cách hình ảnh, âm thanh và hiệu ứng âm thanh. Cốt truyện ví dụ bao gồm các hành động liên tục như cậu bé ôm quả bóng chạy dọc toa tàu, lao ra khỏi cửa khi tàu điện ngầm dừng hẳn, và nhân vật nam đuổi theo rồi cuối cùng bắt được cậu bé.

Seedance 2.5 hỗ trợ người dùng nhập tối đa 30 hình ảnh, 10 đoạn video và 10 đoạn âm thanh làm tài liệu tham khảo trong một lần. Theo hãng, mô hình có thể hiểu tổng hợp các yếu tố như bố cục hình ảnh, bối cảnh, phong cách, nhân vật, đạo cụ từ các tài liệu khác nhau và áp dụng vào việc tạo video theo yêu cầu.

Trong các cảnh quay có nhiều người cùng khung hình và kể chuyện nhóm, Seedance 2.5 có thể tái hiện đồng thời hình ảnh và giọng nói của nhiều nhân vật, đồng thời giữ cho các đặc điểm của chủ thể ổn định. Đoạn clip hòa nhạc dài 30 giây được hãng trình diễn sử dụng khung hình ngang 16:9, phong cách điện ảnh chân thực, với tài liệu tham khảo bao gồm ảnh bối cảnh, nghệ sĩ piano, đàn cello, violin, ca sĩ chính, dàn nhạc giao hưởng, dàn hợp xướng và khán đài khán giả.

IT đính kèm địa chỉ tham khảo.

Trang chủ dự án Seedance 2.5.

Tuyên bố quảng cáo: Các liên kết ngoài có trong bài viết (bao gồm nhưng không giới hạn ở siêu liên kết, mã QR, mật khẩu, v.v.) được sử dụng để truyền tải thêm thông tin, tiết kiệm thời gian sàng lọc, kết quả chỉ mang tính chất tham khảo. Tất cả các bài viết của IT đều bao gồm tuyên bố này.

ByteDanceSeedanceAI tạo videoGenerative AICông nghệ
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ IT Home. Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.