Rohan Paul@rohanpaul_ai
85

Nghiên cứu

DeepMind giới thiệu kỹ thuật 'Recirculation': Tối ưu hóa suy luận LLM mà không cần huấn luyện lại

(giờ Việt Nam)

Tóm tắt AI

DeepMind đề xuất phương pháp 'Recirculation' bằng cách đưa các kích hoạt tầng sâu vào tầng nông trong quá trình suy luận, giúp giảm đáng kể độ bối rối (perplexity) của mô hình Gemma3 trên ngữ cảnh dài mà không cần thay đổi trọng số hay huấn luyện lại.

Xem nguyên văn trên X

Bài viết được AI dịch và tổng hợp tự động từ X: Rohan Paul (@rohanpaul_ai). Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.