Nghiên cứu
Báo cáo Guidelight: Các ông lớn AI như OpenAI và Anthropic vẫn lỏng lẻo trong quản trị hệ thống nội bộ
(giờ Việt Nam)
Tóm tắt AI
Đánh giá đầu tiên từ Guidelight cho thấy các phòng thí nghiệm AI hàng đầu như OpenAI, Anthropic, Google, xAI và Meta chưa thực hiện đầy đủ các biện pháp kiểm soát an toàn cơ bản, với điểm số thấp nhất thuộc về Meta.
Bản dịch AI

Không có công ty AI nào áp dụng đầy đủ các biện pháp kiểm soát cơ bản cho chính hệ thống AI nội bộ của họ. Đó là kết luận rút ra từ đánh giá đầu tiên của tổ chức phi lợi nhuận Guidelight. Nhóm đã xem xét Anthropic, OpenAI, Google, xAI và Meta, chỉ dựa trên các nguồn công khai như thẻ hệ thống (system cards), báo cáo an toàn và các bài đăng trên blog.
Guidelight đã kiểm tra sáu thực tiễn cơ bản. Các thực tiễn này bao gồm ghi nhật ký hoạt động AI nội bộ, kiểm soát các hành động rủi ro thông qua cơ chế đánh giá, các biện pháp tắt khẩn cấp được gọi là "ngắt mạch" (circuit breaking) và các kế hoạch ngăn chặn các mô hình không tuân thủ (misaligned models). Anthropic và OpenAI dẫn đầu với điểm C+, theo sau là Google với điểm D+ cùng một lộ trình chi tiết, trong khi xAI (D−) và Meta (F) là những đơn vị có điểm số thấp nhất.

Các công ty này làm tốt nhất ở khâu phát hiện hành vi sai lệch. Họ làm kém nhất ở khâu phòng ngừa và ngăn chặn. Guidelight là một tổ chức phi lợi nhuận độc lập được thành lập bởi các cựu lãnh đạo bộ phận an toàn của OpenAI là Page Hedley và Steven Adler.
Tin tức AI không thổi phồng – Được biên tập bởi con người
Đăng ký THE DECODER để đọc không quảng cáo, nhận bản tin AI hàng tuần, báo cáo chuyên sâu "AI Radar" độc quyền sáu lần một năm, quyền truy cập toàn bộ kho lưu trữ và tham gia phần bình luận của chúng tôi.
Đăng ký ngay
Bài viết được AI dịch và tổng hợp tự động từ The Decoder: AI News. Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.