ViRDM là phương pháp hậu huấn luyện video không cần mô hình giáo viên hay bộ phân biệt, giúp tối ưu hóa việc tạo video nhân quả chỉ với 20 bước cập nhật, đạt hiệu suất vượt trội trên VBench với chi phí tính toán thấp.
HyperQ giới thiệu các nhánh lượng tử có điều kiện vào mô hình ngôn ngữ khuếch tán, cho phép tinh chỉnh hiệu quả mà không cần huấn luyện lại toàn bộ backbone, giúp tận dụng sức mạnh tính toán lượng tử với chi phí thấp.
RefineEdit là khung chỉnh sửa ảnh mới giúp thay đổi nội dung theo yêu cầu mà vẫn giữ nguyên các chi tiết gốc, bằng cách kết hợp định vị chỉnh sửa với tạo nội dung thông qua mã nhị phân toàn cục mà không cần huấn luyện lại.
VC-Attention là giải pháp không cần huấn luyện giúp tăng tốc và duy trì độ chính xác cho các mô hình Diffusion bằng cách xử lý nhiễu giá trị (value outliers) và tối ưu hóa hàm Softmax, giải quyết nút thắt chi phí tính toán trong các chuỗi video dài.