Rohan Paul@rohanpaul_aiNghiên cứuĐiểm AI 37/100
Nghiên cứu Qwen2.5: Lấy mẫu lặp lại hiệu quả hơn tự phản tư trong suy luận toán học
If you're spending extra tokens making an LLM critique itself, this paper says a simpler move can be…
DịchNghiên cứu trên các mô hình Qwen2.5 cho thấy việc lấy mẫu lặp lại và chọn đáp án đa số mang lại hiệu quả cao hơn các phương pháp tự phản tư phức tạp khi cùng giới hạn số lượng token.
