OpenBMB@OpenBMB
85

Nghiên cứu

OpenBMB và ĐH Thanh Hoa: Công thức dữ liệu giúp AI suy luận văn bản dài mà không cần tinh chỉnh phần thưởng

(giờ Việt Nam)

Tóm tắt AI

OpenBMB và ĐH Thanh Hoa giới thiệu phương pháp tối ưu hóa suy luận văn bản dài thông qua thiết kế dữ liệu chuyên biệt và GRPO tối giản, giúp cải thiện hiệu suất đáng kể trên các mô hình Qwen mà không cần kỹ thuật phần thưởng phức tạp.

AILLMSuy luậnOpenBMBXử lý ngôn ngữ tự nhiên
Xem nguyên văn trên X

Bài viết được AI dịch và tổng hợp tự động từ X: OpenBMB (@OpenBMB). Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.