IT Home
92

Tin ngành

OpenAI hoãn ra mắt mô hình Astra vì lo ngại rủi ro an ninh mạng

(giờ Việt Nam)

Tóm tắt AI

OpenAI quyết định hoãn phát hành Astra sau khi đánh giá mô hình này đạt mức rủi ro 'nghiêm trọng' về an ninh mạng. Công ty đang thực hiện các biện pháp kiểm soát nghiêm ngặt và phối hợp với chính phủ để đảm bảo an toàn trước khi công bố rộng rãi.

Bản dịch AI

Theo tin từ IT ngày 8 tháng 8, OpenAI cho biết các đánh giá nội bộ và từ chuyên gia cho thấy mô hình sắp ra mắt Astra đã đạt được những bước đột phá lớn trong lĩnh vực lập trình tác nhân (agentic programming) và an ninh mạng. Theo "Khung chuẩn bị" (Preparedness Framework) của hãng, Astra đã được xếp hạng là mô hình đầu tiên của OpenAI đạt mức rủi ro "nghiêm trọng" (Critical) trong lĩnh vực an ninh mạng.

Lưu ý của IT: Theo khung này, một mô hình AI sẽ chạm ngưỡng "nghiêm trọng" nếu đáp ứng bất kỳ điều kiện nào sau đây:

Khai thác lỗ hổng zero-day không cần can thiệp: Có khả năng nhận diện và phát triển các chương trình khai thác lỗ hổng zero-day hiệu quả ở mọi cấp độ nghiêm trọng trên nhiều hệ thống trọng yếu thực tế đã được tăng cường bảo mật mà không cần sự can thiệp của con người.

Tự chủ thực hiện tấn công từ đầu đến cuối (end-to-end): Chỉ cần cung cấp mục tiêu chiến lược cấp cao, mô hình có thể tự hình thành ý tưởng và thực hiện các cuộc tấn công mạng từ đầu đến cuối hoàn toàn mới nhắm vào các mục tiêu đã được gia cố.

OpenAI đặc biệt nhấn mạnh rằng Astra là một mô hình chưa được phát hành và không liên quan đến sự cố tấn công mạng nhắm vào Hugging Face trước đó.

Để đảm bảo an toàn và tuân thủ trong quá trình phát triển tiếp theo, OpenAI tuyên bố đã áp dụng nhiều biện pháp kiểm soát:

Thực hiện các biện pháp kiểm soát an ninh nghiêm ngặt hơn đối với các mô hình có năng lực cao và các hoạt động nghiên cứu phát triển liên quan, bao gồm: thiết lập môi trường thử nghiệm cách ly, hạn chế quyền truy cập mạng và công cụ, tăng cường bảo vệ và mã hóa trọng số mô hình, triển khai các khả năng giám sát và phát hiện bổ sung, cũng như thực hiện vận hành trong môi trường sandbox; đồng thời tạm dừng tất cả các hoạt động liên quan đến Astra trong nội bộ chưa đáp ứng được các tiêu chuẩn an ninh tăng cường nêu trên.

Triển khai giám sát toàn diện đối với tất cả các ứng dụng tác nhân (agent) của Astra (bao gồm cả giai đoạn huấn luyện và đánh giá), bao gồm các hành vi rủi ro cao và sự sai lệch trong căn chỉnh (alignment failure). Thông qua việc đánh giá chuỗi suy nghĩ (CoT) của mô hình để rà soát và ngăn chặn các thao tác rủi ro cao.

Hợp tác với các cơ quan chính phủ liên quan và các tổ chức an toàn AI được chỉ định để cùng thử nghiệm mô hình; cung cấp các quy chuẩn kiểm soát an ninh được khuyến nghị cho các đối tác thử nghiệm bên thứ ba nhằm đảm bảo các đánh giá và khối lượng công việc có rủi ro cao hơn có thể vận hành trong trạng thái an toàn.

Giám đốc điều hành OpenAI, Sam Altman, sau đó cho biết Astra là một mô hình có hiệu năng mạnh mẽ và hãng đang nỗ lực hết sức để thúc đẩy việc phát hành công khai.

Chúng tôi luôn tin rằng việc giới hạn các mô hình hàng đầu trong tay một số ít người không phải là một chiến lược tốt.

Tuy nhiên, xét đến năng lực mạnh mẽ của nó trong lĩnh vực an ninh mạng, chúng tôi vẫn cần thêm một chút thời gian để đảm bảo mọi thứ diễn ra an toàn tuyệt đối. Hy vọng mọi người sẽ không phải chờ đợi quá lâu!

OpenAIAstraAn ninh mạngRủi ro AITin AI
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ IT Home. Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.