Rohan Paul@rohanpaul_ai
85

Nghiên cứu

Nghiên cứu từ Salesforce: AI yếu hơn khi bắt chước mô hình mạnh, phương pháp on-policy hiệu quả hơn

(giờ Việt Nam)

Tóm tắt AI

Salesforce phát hiện việc tinh chỉnh mô hình Qwen theo quỹ đạo của Gemini khiến hiệu suất giảm từ 78% xuống 63,1% do sự xung đột trong cách lập kế hoạch. Thay vì bắt chước, việc điều chỉnh dựa trên hành vi gốc (on-policy) mang lại kết quả tốt hơn.

Xem nguyên văn trên X

Bài viết được AI dịch và tổng hợp tự động từ X: Rohan Paul (@rohanpaul_ai). Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.