Ngành
OpenAI thiết lập quy trình an toàn mới: Lãnh đạo cấp cao có quyền phủ quyết huấn luyện AI
(giờ Việt Nam)
Tóm tắt AI
OpenAI vừa công bố hướng dẫn an toàn cho việc huấn luyện các mô hình AI tiên tiến, yêu cầu phải có sự phê duyệt và quyền phủ quyết từ các lãnh đạo cấp cao như Giám đốc nghiên cứu và Giám đốc an toàn trước khi bắt đầu.
Chính văn · Bản dịch AI
IT ngày 29 tháng 9, OpenAI hôm nay đã đưa ra một bộ nguyên tắc chỉ đạo thông qua thông cáo báo chí chính thức, yêu cầu các doanh nghiệp phải nộp tài liệu lập luận an toàn có cấu trúc trước khi tiến hành huấn luyện tăng cường cho các mô hình AI tiên phong.
OpenAI cho biết, các lập luận an toàn cần được xem xét bởi nhiều quản lý cấp cao, mỗi người đều phải có quyền phủ quyết nhiệm vụ huấn luyện, đồng thời quá trình huấn luyện phải trải qua nhiều khâu kiểm soát nội bộ từ người đứng đầu bộ phận nghiên cứu hoặc VP (Phó chủ tịch), giám đốc an toàn và giám đốc khoa học.
Ngoài ra, các quản lý cấp cao chịu trách nhiệm về nhiệm vụ huấn luyện như người đứng đầu bộ phận nghiên cứu, Phó chủ tịch nghiên cứu, cần phải chịu trách nhiệm về các lập luận an toàn cũng như mọi phản ứng đối với sự cố, bao gồm việc đưa các nội dung này vào đánh giá hiệu suất, nhằm thúc đẩy đội ngũ huấn luyện chủ động thực hiện công tác an toàn và căn chỉnh (alignment).
OpenAI cho biết, nếu các cảnh báo an toàn mức độ ưu tiên cao không được xác nhận trong thời hạn quy định, các nhiệm vụ huấn luyện bị ảnh hưởng sẽ tự động tạm dừng. Những đề xuất này đã bắt đầu được triển khai và dự kiến sẽ tiếp tục được điều chỉnh trong tương lai. Ngoài ra, quy trình huấn luyện cần có khả năng xác định dễ dàng tất cả các mục đích sử dụng hạ nguồn của các mô hình chưa được căn chỉnh (Ghi chú của IT: ví dụ như dùng để tạo dữ liệu hoặc chấm điểm), để có thể loại bỏ tác động từ các đầu ra không được căn chỉnh khi cần thiết.
Trước đó cùng ngày, OpenAI thông báo rằng do ngày càng có nhiều báo cáo về việc các AI agent (tác nhân AI) có quyền truy cập vào các lĩnh vực nhạy cảm và xuất hiện các hành vi ngoài ý muốn, công ty đã tạm dừng việc huấn luyện các mô hình AI mới nhất.
Tham khảo
Đọc thêm:
Tuyên bố quảng cáo: Các liên kết chuyển hướng bên ngoài có trong bài viết (bao gồm nhưng không giới hạn ở siêu liên kết, mã QR, mật khẩu, v.v.) được sử dụng để truyền tải thêm thông tin, tiết kiệm thời gian lựa chọn, kết quả chỉ mang tính chất tham khảo, các bài viết của IT có chứa liên kết ngoài đều bao gồm tuyên bố này.
Bài viết được AI dịch và tổng hợp tự động từ IT Home. Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.