Ant Ling@AntLingAGI
85

Thủ thuật

Ant Ling-3.0-flash: Mô hình 124B đạt tốc độ 38.7 tok/s trên một máy đơn

(giờ Việt Nam)

Tóm tắt AI

Mô hình Ling-3.0-flash 124B của Ant Group đạt tốc độ ấn tượng 38.7 tok/s trên DGX Spark, nhanh gấp 2.4 lần DeepSeek V4 Flash. Với khả năng xử lý 256K context và viết code chạy được ngay, đây là mô hình 124B cục bộ nhanh nhất hiện nay.

Ant GroupLing-3.0LLMTối ưu hóaAI cục bộ
Xem nguyên văn trên X

Bài viết được AI dịch và tổng hợp tự động từ X: Ant Ling (@AntLingAGI). Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.