Thanks @sgl_project for the day-0 support! 🙌 SGLang-Diffusion now serves Qwen-Image-2.1: text-to-im…
DịchSGLang-Diffusion vừa cập nhật hỗ trợ Qwen-Image 2.1, cho phép thực hiện tạo ảnh từ văn bản, chỉnh sửa nhiều ảnh và xuất file RGBA trong suốt chỉ với một checkpoint duy nhất.
Mi-Ripple là quy trình phục hồi ảnh giúp loại bỏ các vết nhiễu dạng lưới và hạt phát sinh trong quá trình chỉnh sửa AI lặp lại, giúp bảo toàn cấu trúc ảnh gốc mà không làm mất chi tiết.
Nhóm nghiên cứu từ Beihang và Tsinghua giới thiệu UniH3, khung làm việc đột phá giúp tối ưu hóa phục hồi ảnh y tế bằng cách cân bằng các đặc trưng đồng nhất và dị biệt. Mô hình đạt hiệu suất SOTA trên các bộ dữ liệu lớn và đã được mã nguồn mở.
OracleZoom giải quyết thách thức thiếu dữ liệu gốc ở các cấp độ phóng đại cực lớn bằng cách sử dụng cơ chế tự chưng cất và ràng buộc tham chiếu, giúp mô hình duy trì độ chính xác khi thực hiện siêu phân giải đệ quy.
KnowChange là khung tổng hợp dữ liệu mới sử dụng mô hình ngôn ngữ-hình ảnh để mô phỏng các thay đổi trong ảnh viễn thám một cách linh hoạt, giúp cải thiện hiệu suất cho các mô hình phát hiện thay đổi mà không cần quy tắc thủ công.
Nghiên cứu từ vivo và các đại học hàng đầu giới thiệu ART, phương pháp mới giúp chuyển đổi chính xác các kiểu trang điểm phức tạp như kim tuyến hay họa tiết nghệ thuật mà vẫn giữ nguyên cấu trúc khuôn mặt và danh tính người dùng.
Vì sao đáng đọc: Bài viết giới thiệu giải pháp kỹ thuật đột phá cho một bài toán khó trong thị giác máy tính, có tính ứng dụng cao trong ngành làm đẹp và chỉnh sửa ảnh, nội dung chuyên sâu và có giá trị tham khảo tốt.
SimLoss tối ưu hóa mô hình ngôn ngữ thị giác bằng cách căn chỉnh biểu diễn ẩn với dữ liệu hình ảnh trực tiếp, giúp mô tả chi tiết vật thể mà không cần tăng độ trễ như các hệ thống đa giai đoạn hiện nay.
Tiến sĩ Lưu Bác Dương đã sử dụng Qwen để phân tích và tái hiện thuật toán xử lý ảnh nhật hoa phức tạp của Druckmüller, giúp tạo ra hình ảnh nhật hoa độ phân giải cao chỉ trong 3 giờ sau nhật thực toàn phần tại Tây Ban Nha.
EditBridge tối ưu hóa việc chỉnh sửa ảnh độ phân giải cao bằng cách chuyển đổi từ bản thấp phân giải, giúp giữ trọn chi tiết gốc. Công nghệ này tăng tốc xử lý lên đến 8,4 lần, cho phép chỉnh sửa ảnh 4K chỉ trong 61 giây.
watermarks-remover for AI content reaches ~11k stars on github. People really hate the watermarks. …
DịchMột công cụ AI giúp loại bỏ watermark trên hình ảnh vừa cán mốc 11.000 sao trên GitHub, cho thấy nhu cầu rất lớn của người dùng trong việc xử lý ảnh sạch không logo.
Nghiên cứu chỉ ra rằng hiện tượng nhiễu và giả ảnh trong Latent SDS xuất phát từ sự lệch pha của VAE. PixSDS khắc phục vấn đề này bằng cách tinh chỉnh gradient nhất quán mà không cần huấn luyện lại mô hình, giúp tạo 3D sắc nét và sạch hơn.
S2R là khung làm việc toàn diện đầu tiên kết hợp mô phỏng vật lý, khử phản chiếu video bằng mô hình khuếch tán và bộ tiêu chuẩn đánh giá mới, giúp khôi phục video sắc nét chỉ với một bước khử nhiễu.