Nghiên cứu
LLaDA-Image: Bước tiến mới trong tạo ảnh AI với quy trình huấn luyện mở hoàn toàn
(giờ Việt Nam)
Tóm tắt AI
LLaDA-Image là mô hình Diffusion Transformer 6B kết hợp khả năng hiểu ngôn ngữ hình ảnh mạnh mẽ, cho phép tạo ảnh chân thực và chỉnh sửa chi tiết với tốc độ cao nhờ phiên bản Turbo.
Bản dịch AI
Tác giả: Chuyan Chen, Haoxing Chen, Kun Chen, Zhenglin Cheng, Long Cui, Ruishan Fang, Zhangxuan Gu, Zhicheng Huang, Zhenzhong Lan, Yuanting Lei, Haoquan Li, Jianguo Li, Rongchuan Li, Sidu Li, Tao Lin, Deyuan Liu, Jiacheng Liu, Lin Liu, Yuxuan Lou, Zhisheng Lu, Yuxin Ma, Shuheng Shen, Peng Sun, Chaoyang Wang, Hongjun Wang, Xiaomei Wang, Yongxin Wang, Chengzhang Wu, Hongru Wu, Jun Xie
Xem PDF HTML (thử nghiệm)
DOI do arXiv cấp thông qua DataCite (đang chờ đăng ký)
Lịch sử gửi bài
Từ: Jun Xie [xem email] [v1] Thứ Năm, ngày 3 tháng 9 năm 2026 13:02:40 UTC (44.735 KB)
Bài viết được AI dịch và tổng hợp tự động từ Hugging Face Daily Papers. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.