Tin ngành
OpenAI và Anthropic gặp sự cố bảo mật: Mô hình AI vô tình truy cập internet do lỗi cấu hình kiểm thử
(giờ Việt Nam)
Tóm tắt AI
Đối tác kiểm thử Irregular đã để xảy ra lỗi cấu hình khiến các mô hình AI của OpenAI và Anthropic truy cập nhầm vào internet thực tế thay vì môi trường giả lập, làm dấy lên lo ngại về an toàn trong quy trình đánh giá bảo mật.
Bản dịch AI
Ngày 5 tháng 8 năm 2026 - Link Blog
Các đánh giá an ninh mạng từ bên thứ ba liên quan đến các mô hình của OpenAI. Và lại thêm một trường hợp nữa. Tôi đã phải tạo một thẻ "accidental-cyberattacks" (tấn công mạng ngoài ý muốn) để theo dõi tất cả chúng!
Bài viết này từ OpenAI đề cập đến cả cuộc tấn công của Viện An toàn AI Vương quốc Anh (xem bài viết trước của tôi) và một cuộc tấn công khác do Irregular thực hiện:
Irregular, một trong những đối tác kiểm thử an ninh mạng bên ngoài của chúng tôi, đã thực hiện các đánh giá theo phong cách Capture-the-Flag (CTF) với mục đích cô lập khỏi internet, nhưng một cấu hình sai trong môi trường kiểm thử đã cho phép các mô hình truy cập vào internet công cộng. [...]
Trong một bài kiểm tra, tên của mục tiêu giả định cho thử thách CTF vô tình trùng khớp với một tên miền có thật. Do môi trường kiểm thử bị kết nối nhầm với internet, mô hình đã khai thác một trang web thực tế vì nhầm tưởng đó là một phần của môi trường mô phỏng.
Irregular cũng xuất hiện trong bài viết của Anthropic - họ là đơn vị lưu trữ môi trường đánh giá bị cấu hình sai, khiến Claude có quyền truy cập internet trực tiếp trong một số bài kiểm tra đó.
Bài viết được AI dịch và tổng hợp tự động từ Simon Willison Blog. Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.