HiDream.ai giới thiệu DreamWorld, mô hình khuếch tán video sử dụng tiền đề hình học 3D để giải quyết tình trạng biến dạng vật thể và thiếu nhất quán khi thay đổi góc quay, giúp tạo ra thế giới ảo ổn định hơn.
Vì sao đáng đọc: Nghiên cứu quan trọng được ECCV chấp nhận, giải quyết bài toán khó về tính nhất quán 3D trong tạo video, có tính ứng dụng cao cho mô hình thế giới (World Models).
18/08
Thứ Ba · 1 tin
HuggingFace Daily Papers (bài nghiên cứu nổi bật của cộng đồng)
AnyTalk giới thiệu phương pháp mới giúp tạo hoạt ảnh 3D từ video mà không cần dữ liệu mẫu, thông qua kỹ thuật tinh chỉnh chuyên biệt (CsF) để tối ưu hóa tham số khuôn mặt. Công nghệ này hỗ trợ đa dạng cấu hình nhân vật và có phiên bản thời gian thực hiệu quả.
SCoPE Sightline-Coordinate Positional Encoding for Video Diffusion Transformers model: https://hug...
DịchSCoPE là phương pháp mã hóa vị trí tọa độ Sightline mới, giúp tối ưu hóa khả năng hiểu không gian và tính nhất quán cho các mô hình tạo video dựa trên kiến trúc Transformer.