Yuchen Jin@Yuchenj_UW
92

Sản phẩm

UC Berkeley ra mắt FreeToken: Tăng tốc suy luận AI cục bộ lên gấp 4 lần

(giờ Việt Nam)

Tóm tắt AI

FreeToken từ UC Berkeley cho phép chạy các mô hình lớn như GLM-5.2 hay Qwen3.6 trên GPU phổ thông với tốc độ nhanh gấp 2-4 lần so với Ollama mà không cần nén mô hình quá mức.

AI cục bộTối ưu hóaUC BerkeleyFreeTokenGPU
Xem nguyên văn trên X

Bài viết được AI dịch và tổng hợp tự động từ X: Yuchen Jin (@Yuchenj_UW). Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.