Tạo ảnh AI
Tiền tuyến vẽ tranh AI: Mô hình văn bản sang ảnh, chỉnh sửa ảnh thông minh và hệ sinh thái công cụ sáng tạo.
390 bài thu thập26 tinh chọncập nhật đến 27/09 21:36
- Midjourney: UpdatesT6 · 28/08 · 06:40
Midjourney ra mắt mô hình chỉnh sửa ảnh V8.2 cho tất cả người dùng
Midjourney vừa mở quyền truy cập mô hình V8.2, cho phép người dùng chỉnh sửa ảnh bằng câu lệnh, kết hợp tối đa 4 ảnh tham chiếu, cùng các tính năng nâng cao như vẽ đè (inpainting) và mở rộng khung hình (outpainting) ngay trên web và Discord.
- JiQiZhiXinCN · 23/08 · 21:30
Đại học Princeton công bố i1: Công thức mở hoàn chỉnh cho mô hình tạo ảnh từ văn bản
Nhóm nghiên cứu tại Princeton đã thực hiện hơn 300 thí nghiệm với 700.000 giờ TPU để tạo ra i1, một mô hình tạo ảnh 3B tham số hoàn toàn mở, vượt trội hơn các mô hình mã nguồn mở hiện có tới 29,5% trên các bài kiểm tra tiêu chuẩn.
- Hugging Face Daily PapersT4 · 19/08 · 02:15
IVT: Bước tiến mới giúp AI 'tư duy hình ảnh nội tại' để dự đoán video chủ động
IVT là phương pháp huấn luyện giúp mô hình AI dự đoán các khung hình tương lai mà không cần tạo ảnh trung gian, giúp tăng tốc độ xử lý video mà vẫn giữ được khả năng suy luận logic.
- Ant Group inclusionAI: GitHub kho mã mớiT3 · 18/08 · 12:34
Ant Group ra mắt ConceptEdit: Công cụ mã nguồn mở tạo dữ liệu chỉnh sửa ảnh bằng AI
ConceptEdit là quy trình tự động tạo tập dữ liệu chỉnh sửa ảnh quy mô lớn thông qua ba bước: tạo lệnh bằng VLM, thực thi chỉnh sửa với FLUX và đánh giá bằng VQA, giúp tối ưu hóa việc huấn luyện các mô hình chỉnh sửa hình ảnh.
- Hugging Face Daily PapersT2 · 17/08 · 09:45
Marionette: Mô hình thế giới game đột phá bằng cách tách biệt trạng thái 3D và kết xuất hình ảnh
Marionette cải thiện tính nhất quán trong game bằng cách tách biệt việc dự đoán trạng thái 3D của nhân vật với quá trình kết xuất hình ảnh, giúp kiểm soát chuyển động và hình học chính xác hơn so với các mô hình tạo ảnh pixel truyền thống.
- JiQiZhiXinT4 · 12/08 · 14:45
Đột phá từ ByteDance: Tối ưu hóa mô hình tạo ảnh bằng 'Structured Prompt' thay vì chỉ tăng độ dài văn bản
Nhóm Seed của ByteDance phát hiện rằng thông tin hình ảnh trong Caption quan trọng hơn độ dài văn bản. Họ đề xuất Structured Prompt giúp cải thiện đáng kể khả năng suy luận và hiểu biết thế giới của các mô hình khuếch tán.