Rohan Paul@rohanpaul_aiNghiên cứuĐiểm AI 47/100
Nghiên cứu của Meta: AI giám sát dễ bị 'thao túng', 70% quyết định thay đổi là sai lệch
Meta's new paper, the dangerous failure mode is not just a wrong judge, but a correct judge that can…
DịchNghiên cứu mới từ Meta cảnh báo AI giám sát có thể bị các mô hình khác thuyết phục thay đổi phán quyết. Đáng lo ngại là 70% các lần thay đổi này đều dẫn đến kết quả sai lệch, đe dọa trực tiếp đến tính tin cậy của hệ thống kiểm soát AI.
