TechCrunch: AI
92

Tin ngành

OpenAI tạm dừng phát triển mô hình Astra vì lo ngại rủi ro an ninh mạng

(giờ Việt Nam)

Tóm tắt AI

OpenAI đã hoãn một phần quá trình phát triển mô hình Astra sau khi phát hiện AI này có khả năng tự thực hiện các cuộc tấn công mạng vào những hệ thống bảo mật cao.

Bản dịch AI

OpenAI cho biết hôm thứ Sáu rằng họ đã tạm dừng công việc đối với một số khía cạnh của mô hình Astra sắp ra mắt sau khi một cuộc đánh giá nội bộ phát hiện mô hình này đã đạt được những tiến bộ đáng kể trong lĩnh vực lập trình đại lý (agentic coding) và an ninh mạng — đủ để gây lo ngại về khả năng của nó.

Trong một bài đăng trên blog vào thứ Sáu, OpenAI cho biết mô hình này, hiện vẫn đang trong quá trình phát triển, đã chạm đến "ngưỡng an ninh mạng quan trọng", nghĩa là nó có thể độc lập xác định và thực hiện các cuộc tấn công mạng nhắm vào các hệ thống thực tế vốn được bảo vệ nghiêm ngặt. Theo "Khung chuẩn bị" (Preparedness Framework) mà công ty đã tạo ra vào năm 2023, điều này đã kích hoạt các biện pháp bảo vệ bổ sung.

"Trong khi chúng tôi tiếp tục đánh giá và kiểm định mô hình này, các đánh giá sơ bộ cho thấy hiệu suất mạnh mẽ đến mức chúng tôi không thể loại trừ khả năng đạt cấp độ Critical (nguy cấp) vào thời điểm này," OpenAI viết. "Astra là một mô hình sắp ra mắt và không liên quan đến vụ khai thác Hugging Face."

Tiết lộ này làm nổi bật một thời điểm bất thường trong lĩnh vực các phòng thí nghiệm AI tiên phong đầy biến động và vẫn còn non trẻ. Các công ty trong mọi ngành nghề đều trì hoãn sản phẩm vì những rủi ro tiềm ẩn, bao gồm cả các mối lo ngại về an toàn và an ninh mạng. Tuy nhiên, họ hiếm khi công khai những quyết định đó khi sản phẩm vẫn còn đang trong quá trình phát triển.

Trong trường hợp này, OpenAI vốn đã bị giám sát chặt chẽ sau khi một mô hình khác chưa được phát hành đã xâm nhập vào hệ thống của Hugging Face trong quá trình thử nghiệm nội bộ — đây là sự cố đầu tiên có thể xác minh về việc một phòng thí nghiệm AI mất kiểm soát đối với mô hình của mình. Kể từ đó, OpenAI và các phòng thí nghiệm AI như Anthropic đã tiết lộ các sự cố khác, trong đó các mô hình AI đã vượt qua môi trường thử nghiệm (sandbox) và gây ra các mối đe dọa trong quá trình kiểm tra an ninh mạng.

Chuỗi sự việc này — dường như ngày nào cũng có một tiết lộ mới — đã gây ra những phản ứng khác nhau từ các chuyên gia an ninh mạng, các nhà lập pháp và chính các phòng thí nghiệm AI. Một số người bày tỏ sự lo ngại và kêu gọi giám sát chặt chẽ hơn. Nhưng cũng có một chút tâm lý "khoe khoang". Trong một số giới, bất kỳ phòng thí nghiệm AI nào sở hữu mô hình có khả năng như vậy đều được xem là một bước tiến ấn tượng.

OpenAI cho biết họ chia sẻ thông tin này vì tin rằng "việc minh bạch với công chúng cũng như cộng đồng an toàn và an ninh về sự thay đổi tiềm năng trong năng lực này là rất quan trọng."

Phòng thí nghiệm AI này cho biết họ cũng đang hành động, bao gồm việc ban hành các biện pháp kiểm soát an ninh nghiêm ngặt hơn và tạm dừng các hoạt động nội bộ liên quan đến Astra không đáp ứng được các rào cản bảo vệ đã được tăng cường này. OpenAI cho biết họ đang làm việc với các cơ quan chính phủ liên quan và "các tổ chức an toàn AI được chọn lọc" để kiểm tra khả năng của mô hình này.

Khi bạn mua hàng thông qua các liên kết trong bài viết của chúng tôi, chúng tôi có thể nhận được một khoản hoa hồng nhỏ. Điều này không ảnh hưởng đến tính độc lập trong biên tập của chúng tôi.

Kirsten Korosec là một phóng viên và biên tập viên đã đưa tin về tương lai của ngành giao thông vận tải, từ xe điện (EV) và xe tự lái đến di chuyển hàng không đô thị và công nghệ trên xe trong hơn một thập kỷ. Cô hiện là biên tập viên mảng giao thông tại TechCrunch và đồng dẫn chương trình podcast Equity của TechCrunch. Cô cũng là đồng sáng lập và đồng dẫn chương trình podcast "The Autonocast". Trước đây, cô từng viết bài cho Fortune, The Verge, Bloomberg, MIT Technology Review và CBS Interactive.

Bạn có thể liên hệ hoặc xác minh thông tin từ Kirsten bằng cách gửi email đến [email protected] hoặc qua tin nhắn mã hóa tại kkorosec.07 trên Signal.

Xem tiểu sử

Event Logo
OpenAIAstraAn ninh mạngRủi ro AITin tức AI
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ TechCrunch: AI. Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.