Mô hình
Ant Group ra mắt Ling-3.0-flash: Mô hình AI 124B tối ưu, hiệu năng vượt trội thế hệ cũ
(giờ Việt Nam)
Tóm tắt AI
Ant Group vừa giới thiệu Ling-3.0-flash, mô hình suy luận hỗn hợp với 124B tham số nhưng chỉ kích hoạt 5.1B, giúp tối ưu chi phí và tốc độ mà vẫn vượt qua hiệu năng của thế hệ tiền nhiệm Ring-2.6-1T.
Bản dịch AI
Cảm ơn bạn đọc của IT đã gửi tin!
Theo tin từ IT ngày 24 tháng 7, Ant Group hôm nay đã chính thức ra mắt Ling-3.0-flash, mô hình suy luận hỗn hợp thuần túy thế hệ mới thuộc dòng mô hình ngôn ngữ lớn Bailing.
Theo công bố chính thức, so với mô hình tư duy hàng đầu thế hệ trước là Ring-2.6-1T, Ling-3.0-flash có tổng số tham số là 124B (chỉ bằng khoảng 12,4% so với Ring-2.6-1T) và số tham số kích hoạt chỉ là 5,1B (khoảng 8,1% so với Ring-2.6-1T), nhưng đã đạt được khả năng tương đương hoặc thậm chí vượt trội trên mọi phương diện.
Theo giới thiệu, những cải tiến cốt lõi của Ling-3.0-flash được thể hiện qua các khía cạnh sau:
Kiến trúc tuyến tính hỗn hợp, tiến hóa thuần túy: Ngay từ giai đoạn tiền huấn luyện, mô hình đã áp dụng kiến trúc chú ý tuyến tính hỗn hợp thuần túy (xếp chồng xen kẽ 5:1 giữa KDA và MLA), đồng thời nâng cấp lên cơ chế cổng chéo hạt mịn KDA mới và MoE thưa 1/64. Với quy mô 124B tổng tham số và 5,1B tham số kích hoạt, mô hình đã đạt được bước nhảy vọt về hiệu suất ngữ cảnh dài, khả năng ghi nhớ trạng thái và tối ưu hóa chi phí tính toán.
Mật độ thông minh tối ưu, thách thức vượt cấp: Theo đuổi giới hạn về mật độ thông minh và tỷ lệ hiệu quả trí tuệ theo tiêu chí "nhanh, tiết kiệm, dễ triển khai", mô hình đạt hiệu suất vượt cấp khi đối đầu trực tiếp với các đối thủ SOTA kích thước lớn hơn và thế hệ hàng đầu trước đó. Chỉ với 5,1B tham số kích hoạt, mô hình cung cấp khả năng suy luận truyền thống, tuân thủ chỉ dẫn và xử lý văn bản dài vượt trội, hỗ trợ toàn diện cho việc triển khai hiệu quả các kịch bản Agent phức tạp.
Agent tiến hóa toàn diện, khép kín quy trình dài: Được tinh chỉnh sâu dựa trên các kịch bản năng suất thực tế, mở rộng hơn 10.000 môi trường huấn luyện tương tác, hiện thực hóa quy trình khép kín cho các tác vụ Coding, General và Deep Research Agent, đảm bảo "năng lực mạnh, phản hồi nhanh, phối hợp ổn định". Đồng thời, mô hình tích hợp sáng tạo kiến trúc bộ nhớ đệm phân cấp SGLang HiCache + Mooncake (hai pool vật lý, L3 chia sẻ theo cụm), giúp các tương tác dài không cần tính toán lại, giảm TTFT từ 60% đến hơn 80% đối với các đầu vào dài.

Phía nhà phát hành đã mở quyền truy cập API miễn phí trong thời gian giới hạn trên OpenRouter và nền tảng chính thức của Bailing. Thời gian miễn phí kéo dài đến 23:00 ngày 3 tháng 8 (giờ Bắc Kinh), trọng số của mô hình Ling-3.0-flash sẽ chính thức được mã nguồn mở sau khi kết thúc giai đoạn miễn phí.
IT đính kèm địa chỉ trải nghiệm OpenRouter:
https://openrouter.ai/inclusionai/ling-3.0-flash:free
Tuyên bố quảng cáo: Các liên kết chuyển hướng bên ngoài trong bài viết (bao gồm nhưng không giới hạn ở siêu liên kết, mã QR, mật khẩu, v.v.) được sử dụng để truyền tải thêm thông tin, giúp tiết kiệm thời gian lựa chọn, kết quả chỉ mang tính chất tham khảo. Tất cả các bài viết trên IT đều bao gồm tuyên bố này.
Bài viết được AI dịch và tổng hợp tự động từ IT Home ITHome. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.