04/09

Thứ Sáu · 1 tin
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

Giải mã liên kết thời gian: Định tuyến ngữ cảnh cho tạo video-âm thanh theo kịch bản

Nghiên cứu giới thiệu phương pháp mới giúp đồng bộ hóa chính xác thời điểm chuyển cảnh và lời thoại trong video dựa trên kịch bản, khắc phục hạn chế về kiểm soát thời gian của các mô hình tạo nội dung hiện nay.

21/08

Thứ Sáu · 1 tin
Hugging Face Daily Papers
Nghiên cứuĐiểm AI 85/100

VA-Judger: Mô hình phần thưởng dựa trên phản hồi người dùng cho thế hệ video-âm thanh đồng bộ

VA-Judger giải quyết vấn đề thiếu tính nhất quán trong tạo video-âm thanh bằng cách sử dụng tập dữ liệu VAPref-10K, giúp mô hình hiểu rõ hơn về sự đồng bộ ngữ nghĩa và cảm nhận của con người thay vì chỉ tối ưu các chỉ số rời rạc.

Tổng 2 tin, không còn tin nào nữa

40 tin mỗi trang, cuộn để tải tiếp · lọc và sắp xếp ngay trên máy chủ (16 ms) · bộ lọc nằm trong đường dẫn nên chia sẻ link là giữ nguyên kết quả

Toàn bộ tin AI · Thẻ “Video-Audio” | AIHOT.vn