VnExpress Số hóa
85

Tin ngành

Anthropic khóa hàng loạt tài khoản nghi vấn dùng AI chế tạo vũ khí sinh học

(giờ Việt Nam)

Tóm tắt AI

Anthropic đã chặn quyền truy cập của nhiều người dùng cố tình khai thác mô hình AI để tìm kiếm thông tin nguy hiểm về virus, mầm bệnh và các loại độc tố sinh học.

Bản dịch AI

Anthropic chặn nhiều tài khoản nghi dùng AI phát triển vũ khí sinh học

Anthropic chặn nhiều tài khoản nghi dùng AI phát triển vũ khí sinh học

Công ty Anthropic cho biết đã ngăn chặn một số nhà khoa học sử dụng mô hình AI của họ để truy vấn các thông tin có thể gây hại liên quan đến virus, bệnh truyền nhiễm, nọc độc và các loại độc tố mới.

Theo Interesting Engineering, ngày 10/9, Anthropic cho biết đã chặn ít nhất 5 trường hợp thực tế mà trong đó các nhà nghiên cứu sử dụng Claude theo cách có thể hỗ trợ phát triển vũ khí sinh học. Các trường hợp này diễn ra từ tháng 12/2025 đến tháng 8/2026, bao gồm nghiên cứu tăng cường chức năng của mầm bệnh, các bệnh truyền nhiễm như cúm gia cầm, nọc độc và độc tố mới. Người dùng đã vượt qua nhiều biện pháp kiểm soát như chặn truy cập từ một số khu vực cụ thể và cố gắng che giấu mục đích nghiên cứu để qua mặt các cơ chế bảo vệ.

Sau khi xem xét dữ liệu hoạt động trong 30 ngày, Anthropic đã phát hiện khoảng 35 "nỗ lực nghiên cứu riêng biệt" có hoạt động tiềm ẩn nguy cơ đáng lo ngại. Các cá nhân trong những trường hợp nêu trên là những nhà khoa học đang hành nghề, nhưng công ty không nêu rõ viện nghiên cứu hoặc quốc gia nơi họ hoạt động. Anthropic không thể xác định liệu các nhà nghiên cứu này có ý định gây hại hay không, nhưng họ vẫn chặn các hoạt động này vì hậu quả tiềm tàng là quá nghiêm trọng.

CNN cho biết, báo cáo của Anthropic nêu chi tiết một trường hợp yêu cầu hỗ trợ viết đơn xin tài trợ cho nghiên cứu tăng cường chức năng về khả năng lây truyền và cơ chế lẩn tránh hệ miễn dịch của virus chikungunya. Đây là loại virus lây truyền qua muỗi, gây ra các triệu chứng suy nhược như đau dữ dội và sốt. Người dùng đã đề xuất tài trợ cho nghiên cứu nhằm tăng cường đột biến để làm cho virus trở nên nguy hiểm hơn. Theo Anthropic, mặc dù nghiên cứu như vậy có thể phục vụ việc phát triển vaccine và phương pháp điều trị tốt hơn, nhưng nó cũng có thể bị lợi dụng để làm cho mầm bệnh trở nên nguy hiểm hơn.

Trong một trường hợp khác, một nhà nghiên cứu ở ngoài nước Mỹ đã sử dụng Claude cho nghiên cứu về cúm gia cầm, tập trung vào quá trình thích nghi của virus với động vật có vú và cách nó gây ra bệnh nặng. Ngoài ra, báo cáo còn đề cập tới trường hợp nghiên cứu về orthopoxvirus gây bệnh đậu mùa và đậu mùa khỉ.

Phát triển thuốc là một trong những ứng dụng hứa hẹn nhất của AI với tiềm năng điều trị ung thư và nhiều bệnh khác. Tuy nhiên, khả năng mạnh mẽ của AI trong việc khám phá vật liệu và thuốc mới cũng có thể biến nó thành công cụ phát triển vũ khí sinh học. New York Times nhận định, so với mối đe dọa từ tấn công mạng quy mô lớn hoặc các tác nhân AI hoạt động trái với ý định của con người, việc lạm dụng AI cho nghiên cứu sinh học ít được chú ý hơn, một phần vì các ví dụ trước đây thường chỉ giới hạn trong bối cảnh nghiên cứu thay vì diễn ra trong thực tế.

Logo mô hình Claude Fable 5. Ảnh: Anthropic

Logo mô hình Claude Fable 5. Ảnh: Anthropic

Thách thức lớn nhất của Anthropic là xác định ranh giới giữa nghiên cứu hợp pháp và mục đích gây hại. Theo Anthropic, những đánh giá từ năm ngoái về các mô hình cũ của công ty cho thấy chúng chưa thể hỗ trợ nhiều trong việc tiến hành nghiên cứu sinh học nguy hiểm. Các mô hình hiện nay có khả năng hoàn thành nghiên cứu khoa học phức tạp hơn, thúc đẩy việc thắt chặt các biện pháp bảo vệ nhằm hạn chế truy cập vào nhiều truy vấn nghiên cứu sinh học có tác động kép.

Một số mô hình gần đây như Claude Fable 5 đi kèm với các biện pháp bảo vệ mạnh mẽ hơn, như hạn chế truy cập vào một loạt nghiên cứu sinh học vừa mang lại lợi ích vừa gây nguy hiểm. Theo công ty, có bằng chứng cho thấy các biện pháp bảo vệ của họ đã phát huy tác dụng, nhưng khi mô hình AI trở nên phức tạp hơn, hệ thống an toàn cũng cần phải mạnh mẽ hơn. Ngoài nghiên cứu sinh học, Anthropic cũng ngăn chặn các nỗ lực sử dụng mô hình AI trong hoạt động theo dõi, lừa đảo và phát triển vũ khí như drone và tên lửa.

Theo CNBC, Anthropic cũng phát hiện các nhóm tạo hàng trăm tài khoản mạng xã hội trông như thuộc về người bình thường, sau đó đăng tải nội dung lan truyền cùng một quan điểm chính trị trong suốt một tuần. Công ty đã tìm thấy 9 trường hợp như vậy, có nguồn gốc từ Nga, Iran, Thổ Nhĩ Kỳ, vùng Vịnh Ba Tư, Nam Á, châu Phi và châu Âu.

Anthropic công bố báo cáo sau khi một trong những nhà nghiên cứu của công ty là Jacob Coxon từ chức vì lo ngại rằng Anthropic và đối thủ chính OpenAI đang chạy đua nhằm tạo ra siêu trí tuệ tự cải tiến. Coxon cảnh báo AI có thể tấn công cơ sở hạ tầng quan trọng hoặc xây dựng "vũ khí sinh học cấp độ tuyệt chủng". Jakub Pachocki, giám đốc khoa học của OpenAI, cũng nhấn mạnh rằng AI đang tiến triển nhanh hơn so với khả năng giám sát và kiểm soát chúng của các nhà nghiên cứu.

Tuy nhiên, Anthropic cho biết họ ngăn chặn các hoạt động độc hại ngay sau khi phát hiện, sử dụng kinh nghiệm này để củng cố các biện pháp bảo vệ, đồng thời chia sẻ thông tin với các cơ quan chính phủ và đối tác trong ngành.

An Khang tổng hợp

Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ VnExpress Số hóa. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.