Thủ thuật
NVIDIA Groq 3 LPX thiết lập kỷ lục tốc độ suy luận cho Gemma 4 31B
(giờ Việt Nam)
Tóm tắt AI
Artificial Analysis ghi nhận NVIDIA Groq 3 LPX đạt tốc độ suy luận ấn tượng 3.431 tokens/giây cho mô hình Gemma 4 31B, duy trì hiệu suất ổn định ngay cả với ngữ cảnh 100k.
Bài viết được AI dịch và tổng hợp tự động từ X: Artificial Analysis (@ArtificialAnlys). Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.