Mô hình
Alibaba ra mắt Qwen-Image-2.1: Mô hình tạo ảnh mã nguồn mở chỉ 7 tỷ tham số
(giờ Việt Nam)
Tóm tắt AI
Đội ngũ Qwen của Alibaba vừa giới thiệu Qwen-Image-2.1, mô hình tạo và chỉnh sửa ảnh mạnh mẽ với chỉ 7B tham số, có khả năng chạy mượt mà trên các GPU phổ thông như RTX 3090.
Bản dịch AI
Đội ngũ Qwen AI của Alibaba vừa ra mắt Qwen-Image-2.1, một mô hình mã nguồn mở (open-weight) phục vụ cho việc tạo và chỉnh sửa hình ảnh. Đội ngũ này tuyên bố rằng thành phần tạo hình ảnh của mô hình chỉ có 7 tỷ tham số nhưng đã vượt qua hầu hết các mô hình đóng trên bộ tiêu chuẩn đánh giá (benchmark) của riêng Qwen, mặc dù các đánh giá độc lập vẫn đang chờ thực hiện. Mô hình này có thể chạy trên các GPU tiêu dùng mạnh mẽ như RTX 3090.

Mô hình có khả năng tạo và chỉnh sửa hình ảnh trong suốt (RGBA) một cách tự nhiên, cho phép người dùng tách biệt các đối tượng hoặc thay đổi văn bản trên các lớp trong suốt. Nó có thể xử lý cùng lúc tối đa mười hình ảnh tham chiếu cho các mục đích như tạo ảnh chân dung nhóm, thử đồ ảo hoặc thiết kế phòng, đồng thời sử dụng các hình tròn, mặt nạ hoặc các nét vẽ để hướng dẫn chỉnh sửa cục bộ. Qwen cho biết những thay đổi về kiến trúc và việc tái sử dụng bộ nhớ đệm KV giúp tăng tốc độ suy luận, đặc biệt là khi sử dụng nhiều hình ảnh tham chiếu.
Qwen-Image-2.1 hiện đã có mặt trên Hugging Face, GitHub và Model Scope, kèm theo một bản demo trên Hugging Face. Giấy phép nghiên cứu của mô hình không cho phép sử dụng cho mục đích thương mại, vì vậy người dùng doanh nghiệp cần liên hệ với Qwen để xin cấp giấy phép riêng.
Tin tức AI không thổi phồng – Được biên soạn bởi con người.
Đăng ký THE DECODER để đọc tin không quảng cáo, nhận bản tin AI hàng tuần, báo cáo chuyên sâu "AI Radar" độc quyền sáu lần mỗi năm, quyền truy cập toàn bộ kho lưu trữ và tham gia phần bình luận của chúng tôi.
Đăng ký ngay.
Bài viết được AI dịch và tổng hợp tự động từ The Decoder: AI News. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.