Nghiên cứu
FreeToken: Đột phá giúp laptop 8GB chạy mượt mô hình 35B
(giờ Việt Nam)
Tóm tắt AI
Engine FreeToken mới từ UC Berkeley và UT Austin tối ưu hóa bộ nhớ GPU, cho phép laptop 8GB chạy mô hình 35B với tốc độ 39.3 tokens/giây, vượt xa hiệu suất thông thường.

Bài viết được AI dịch và tổng hợp tự động từ X: Rohan Paul (@rohanpaul_ai). Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.