Nghiên cứu giới thiệu Tri-PvP, bộ benchmark gồm 8.000 mẫu nhằm phân tích sự xung đột giữa tín hiệu tri giác và mệnh đề trong các mô hình đa phương thức, qua đó phát hiện thiên kiến thị giác mạnh mẽ và sự bất đối xứng trong cách các mô hình xử lý dữ liệu.
Nghiên cứu mới đề xuất phương pháp kiểm định thiên kiến dựa trên các điểm tham chiếu, sử dụng trạng thái ẩn để đo lường sự dịch chuyển định kiến (ΔB) của mô hình ngôn ngữ trước và sau khi tinh chỉnh.
Google AI Overviews từng đưa ra cảnh báo an toàn khác biệt dựa trên quốc tịch người dùng. Dù đã khắc phục lỗi này, hệ thống vẫn tiếp tục đưa ra cảnh báo kỳ lạ khi người dùng hỏi về việc gặp gỡ những người đến từ Facebook.
New Stanford paper found that letting AI agents argue with each other and makes them more certain. …
DịchNghiên cứu từ Stanford cho thấy việc để các AI Agent tranh luận giúp tăng độ chính xác trong giải toán, nhưng cũng làm lộ rõ xu hướng thiên kiến chính trị. Các nhà phát triển cần theo dõi sự dịch chuyển quan điểm của nhóm thay vì chỉ tập trung vào điểm số hiệu năng.