Ant Group vừa công bố mã nguồn mở Ling-3.0-tiny-base (7.9B) và Ling-3.0-flash-base (124B) cùng 6 checkpoints đi kèm, tối ưu cho các tác vụ huấn luyện chuyên sâu, tinh chỉnh và học tăng cường.
Vì sao đáng đọc: Đây là thông tin quan trọng từ một tập đoàn công nghệ lớn, cung cấp các mô hình mã nguồn mở có thông số kỹ thuật rõ ràng, hữu ích cho cộng đồng phát triển AI.
🧵 We've open-sourced 6 Base Model checkpoints for Ling-3.0-tiny & Ling-3.0-flash, covering pre-trai…
DịchAnt Group vừa công bố 6 checkpoint cho các mô hình Ling-3.0-tiny và Ling-3.0-flash, bao gồm các giai đoạn tiền huấn luyện và hợp nhất trọng số WSM. Đây là nguồn tài nguyên hữu ích cho cộng đồng để thử nghiệm chiến lược huấn luyện liên tục và tối ưu hóa mô hình.
ConceptEdit là quy trình tự động tạo tập dữ liệu chỉnh sửa ảnh quy mô lớn thông qua ba bước: tạo lệnh bằng VLM, thực thi chỉnh sửa với FLUX và đánh giá bằng VQA, giúp tối ưu hóa việc huấn luyện các mô hình chỉnh sửa hình ảnh.
Vì sao đáng đọc: Đây là công cụ hữu ích cho cộng đồng nghiên cứu AI, giải quyết bài toán thiếu hụt dữ liệu chất lượng cao cho các mô hình chỉnh sửa ảnh, có tính ứng dụng thực tiễn cao.
CEO Ant Group nhận định sự bùng nổ của AI Agent sẽ đến từ sự hoàn thiện của công nghệ suy luận, khả năng thực thi tác vụ phức tạp và mô hình kinh doanh bền vững trong thời gian tới.
7.9B total. 1.3B active. One DGX Spark. No cluster. Ling-3.0-tiny × ASystem AReno closes the Agentic…
DịchVới 7.9B tham số, Ling-3.0-tiny kết hợp cùng ASystem AReno cho phép thực hiện quy trình học tăng cường (RL) khép kín ngay trên một máy chủ DGX Spark, giúp tối ưu hóa việc lặp lại và huấn luyện mô hình mà không cần cụm máy chủ phức tạp.
Ant Group và ASystem đã kết hợp Ling-3.0-tiny cùng thuật toán GSPO để tối ưu hóa quy trình huấn luyện hậu kỳ cho Agentic RL. Kết quả thử nghiệm trên cờ caro cho thấy hiệu suất mô hình cải thiện rõ rệt, ổn định khả năng gọi công cụ và rút ngắn độ dài phản hồi.
Ant Group has released Ling 3.0 Tiny, which scores 25 on the Artificial Analysis Intelligence Index….
DịchAnt Group giới thiệu Ling 3.0 Tiny, mô hình MoE với 7.9B tham số nhưng đạt hiệu suất ngang ngửa các model 120B, thiết lập chuẩn mực mới về tối ưu hóa hiệu năng trên Artificial Analysis.