# Thảm họa AI: Claude xóa sạch 700GB dữ liệu người dùng do lỗi cơ chế bảo mật

- Nguồn: IT Home
- Thời gian phát hành: 2026-08-29 19:59 (giờ Việt Nam)
- Điểm AI: 46/100
- Link AIHOT.vn: https://aihot.vn/items/f2b2c913cf74e250
- Nguồn dữ liệu AI HOT: https://aihot.news/items/cmtef2ily07fjrobgue849jz7
- Link gốc: https://www.ithome.com/0/996/031.htm

## Tóm tắt AI

Trong quá trình thử nghiệm tính năng bảo mật, AI Claude đã hiểu sai lệnh và xóa nhầm toàn bộ thư mục chính của một lập trình viên, khiến 700GB dữ liệu quan trọng bị mất trắng.

## Thân bài

Theo tin từ IT ngày 29 tháng 8, nhà phát triển Sebastien Guillemot chia sẻ trên X vào thứ Tư tuần này rằng anh đã gặp phải một sự cố nghiêm trọng khi thử nghiệm cơ chế bảo vệ xóa tệp của AI agent. Claude đã xóa sạch khoảng 700GB dữ liệu của anh, bao gồm toàn bộ thư mục người dùng (home directory), tương đương với thành quả làm việc của cả một tuần.

Được biết, trước khi sự cố xảy ra, cơ chế bảo mật của Anthropic đã tự động hạ cấp mô hình thực thi tác vụ xuống Opus 4.8 do đánh giá nhiệm vụ có chứa rủi ro.

![](https://img.ithome.com/newsuploadfiles/2026/8/0be22671-fc55-4f21-b18a-10e8953ceb2b.png?x-bce-process=image/format,f_auto)

Theo chia sẻ, anh thường xuyên sử dụng AI agent nhưng nhận thấy chúng hầu như không bao giờ dọn dẹp các tệp trong thư mục tạm sau khi hoàn thành nhiệm vụ, dẫn đến việc thư mục /tmp tích tụ một lượng lớn rác theo thời gian. Vì vậy, anh đã yêu cầu Claude Fable viết một tập lệnh (script) để mỗi agent tạo một thư mục riêng biệt trong /tmp và tự động xóa các tệp tương ứng sau khi kết thúc tác vụ.

Khó khăn cốt lõi nằm ở việc đảm bảo không ảnh hưởng đến các tệp đang được sử dụng. Để tránh xóa nhầm, ban đầu Fable đề xuất thêm các logic như phát hiện các agent đang chạy và trì hoãn việc dọn dẹp các thư mục tương ứng. Tuy nhiên, anh cho rằng mã nguồn được tạo ra quá phức tạp nên đã yêu cầu AI đơn giản hóa phương án.

Do tập lệnh liên quan đến việc xóa tệp trực tiếp, Fable sau đó đã tự thực hiện một cuộc kiểm tra bảo mật đối kháng bằng cách để một phiên bản khác kiểm tra xem logic xóa có rủi ro hay không. Môi trường thực thi bảo mật của Anthropic sau đó đánh giá nhiệm vụ này có rủi ro cao, tự động hạ cấp mô hình từ Fable 5 xuống Opus 5, và cuối cùng là Opus 4.8.

Opus 4.8 sau đó thực hiện kiểm tra bảo mật. Trong quá trình thử nghiệm, mô hình đã cố gắng đối chiếu mục tiêu của lệnh xóa với /tmp và thư mục người dùng để xác nhận thao tác xóa sẽ không nhắm vào các vị trí nguy hiểm này. IT lưu ý rằng, quá trình kiểm tra thực sự đã xác định được các thư mục này có liên quan đến rủi ro.

Tuy nhiên, vấn đề lại phát sinh ở khâu dọn dẹp sau khi kiểm tra hoàn tất. Vì đây vốn là một bài kiểm tra mã nguồn, tập lệnh cần xóa dữ liệu được tạo ra trong quá trình thử nghiệm, nhưng logic kiểm tra và logic dọn dẹp lại dùng chung một tên biến, dẫn đến việc vô tình xóa sạch thư mục người dùng.

Guillemot đã ngay lập tức chấm dứt tiến trình khi phát hiện sự bất thường, nhưng đã quá muộn. Khoảng 700GB dữ liệu đã bị xóa, bao gồm thành quả làm việc cả tuần của anh. Trớ trêu thay, sau khi xóa thư mục người dùng, Claude lại "hoàn hảo" giữ lại thư mục /tmp.

Sau đó, Guillemot đã khôi phục được phần lớn dữ liệu thông qua các nguồn như kho lưu trữ Git, Nix và nhật ký phiên làm việc. Tuy nhiên, rõ ràng là các hệ thống kiểm soát phiên bản như Git và nhật ký chỉ có thể giúp khôi phục một phần dữ liệu đã được ghi lại hoặc lưu giữ, không thể thay thế cho các bản sao lưu độc lập hoàn chỉnh.

Anh chỉ ra rằng, nếu nhiệm vụ được thực hiện bởi Fable 5 với khả năng lập trình mạnh mẽ hơn, có lẽ nó đã có thể phát hiện ra xung đột logic do việc dùng chung tên biến giữa giai đoạn kiểm tra và dọn dẹp. Tuy nhiên, đây chỉ là suy đoán sau sự việc và không thể khẳng định liệu sự khác biệt về năng lực mô hình có trực tiếp ngăn chặn được sự cố này hay không.

Sự việc này một lần nữa phơi bày các vấn đề bảo mật khi AI agent thực hiện các thao tác tệp có rủi ro cao: ngay cả khi AI có thể xác định chính xác các đường dẫn nguy hiểm, lỗi logic trong chính mã kiểm tra vẫn có thể khiến các bước dọn dẹp sau đó vượt qua các đánh giá bảo mật trước đó.
