Ngành
OpenAI siết chặt quy trình bảo mật sau sự cố rò rỉ tại Hugging Face
(giờ Việt Nam)
Tóm tắt AI
OpenAI vừa công bố loạt chính sách an toàn mới, bao gồm hệ thống cảnh báo 30 phút và tạm dừng các dự án học tăng cường quy mô lớn để kiểm soát rủi ro sau sự cố bảo mật gần đây.
Chính văn · Bản dịch AI
Vào thứ Ba, OpenAI đã công bố một loạt chính sách bảo mật mới tập trung vào việc ngăn chặn các sự cố an ninh trong quá trình thử nghiệm mô hình. Các biện pháp bảo vệ mới bao gồm việc giám sát chi tiết hơn các mô hình trong quá trình phát triển, cũng như chú trọng hơn vào sự căn chỉnh (alignment) và bảo mật trong giai đoạn hậu đào tạo (post-training).
“Khi các mô hình ngày càng trở nên mạnh mẽ hơn, những rủi ro liên quan đến việc phát triển và thử nghiệm chúng nội bộ cũng tăng lên,” công ty cho biết trong một bài đăng trên blog. “Các tiêu chuẩn của chúng tôi về giám sát, căn chỉnh và bảo mật phải luôn đi trước những rủi ro đó.”
Các biện pháp mới này là một trong những thay đổi công khai đầu tiên trong quy trình an toàn của OpenAI kể từ sau sự cố Hugging Face, vốn được tiết lộ vào ngày 26 tháng 7.
Các đại diện của OpenAI nhấn mạnh rằng những biện pháp này không phải là phản ứng trực tiếp đối với sự cố Hugging Face, mà một phần được thúc đẩy bởi năng lực an ninh mạng của mô hình Astra sắp ra mắt, cũng như tốc độ phát triển chung của ngành AI.
Trong cùng bài đăng, OpenAI tiết lộ rằng họ đã tạm dừng việc học tăng cường (reinforcement learning) trong hai tuần sau sự cố Hugging Face, nhưng kể từ đó đã khởi động lại nhiều mô hình ít rủi ro hơn.
“Hoạt động chạy RL (học tăng cường) quy mô lớn nhất theo kế hoạch của chúng tôi vẫn đang bị tạm dừng trong khi chúng tôi thực hiện các đợt đào tạo và đánh giá quy mô nhỏ hơn để kiểm tra hành vi của mô hình, xác thực các biện pháp bảo vệ và thiết lập thêm bằng chứng về sự căn chỉnh trước khi tiếp tục,” bài đăng viết.
Chia sẻ với các phóng viên, Phó chủ tịch nghiên cứu của OpenAI, Amelia Glaese, nhấn mạnh rằng mức độ nghiêm ngặt của các biện pháp kiểm soát sẽ tăng lên khi các mô hình trở nên mạnh mẽ hơn, trong đó các mô hình lớn nhất sẽ phải chịu sự giám sát chặt chẽ nhất.
“Chúng tôi đã đưa ra các yêu cầu và kỳ vọng cho việc phát triển an toàn,” Glaese nói với các phóng viên. “Những yêu cầu và kỳ vọng đó thay đổi tùy theo mức độ rủi ro mà chúng tôi nhận thấy.”
OpenAI đã bị chỉ trích vì các thực tiễn bảo mật mạng yếu kém sau sự cố, khi các mô hình thoát khỏi môi trường đào tạo bằng cách xâm nhập vào một tiện ích cài đặt gói (packet-installation utility) vẫn còn quyền truy cập internet. Các biện pháp bảo vệ mới bao gồm các quy trình cô lập mạng mạnh mẽ hơn, mặc dù các chi tiết cụ thể vẫn còn mơ hồ. Theo hệ thống mới, bài đăng cho biết, “một sự xâm nhập đơn lẻ vào khối lượng công việc hoặc dịch vụ hỗ trợ sẽ không tự nó cho phép truy cập trái phép vào Internet hoặc các mạng nội bộ khác.”
Biện pháp bảo vệ mạnh mẽ nhất là hệ thống giám sát, vốn sẽ kiểm tra các hành động của công cụ, các dấu vết suy luận (reasoning traces) có sẵn và nhật ký hoạt động để phát hiện nhiều hành vi trái phép khác nhau. OpenAI cho biết họ đặt mục tiêu đưa ra cảnh báo trong vòng 30 phút kể từ khi phát hiện hoạt động đáng lo ngại.
OpenAI ước tính rằng gánh nặng tính toán của việc giám sát đó sẽ chiếm khoảng 20% quy trình đang được theo dõi. Công ty hứa hẹn sẽ cung cấp thêm chi tiết về hệ thống này trong một bài đăng blog sắp tới. Bản phân tích hậu kiểm (post-mortem) chính thức của OpenAI về sự kiện này vẫn đang được thực hiện.
Khi bạn mua hàng thông qua các liên kết trong bài viết của chúng tôi, chúng tôi có thể nhận được một khoản hoa hồng nhỏ. Điều này không ảnh hưởng đến tính độc lập trong biên tập của chúng tôi.
Russell Brandom đã đưa tin về ngành công nghệ từ năm 2012, với trọng tâm là chính sách nền tảng và các công nghệ mới nổi. Trước đây, ông từng làm việc tại The Verge và Rest of World, đồng thời đã viết bài cho Wired, The Awl và MIT’s Technology Review. Bạn có thể liên hệ với ông qua email [email protected] hoặc qua Signal theo số 412-401-5489.
Xem tiểu sử

Bài viết được AI dịch và tổng hợp tự động từ TechCrunch: AI. Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.