Tin ngành
Báo cáo tình báo mối đe dọa: Phát hiện và ngăn chặn hành vi lạm dụng AI (Tháng 9/2026)
(giờ Việt Nam)
Tóm tắt AI
Anthropic công bố báo cáo chuyên sâu về các phương thức phát hiện và chiến lược đối phó với những hành vi lạm dụng công nghệ AI trong tháng 9 năm 2026.
Bản dịch AI

Phát hiện và ngăn chặn hành vi lạm dụng AI: Tháng 9 năm 2026
Các chiến dịch tấn công mạng
Đọc thêm
Các chiến dịch giám sát
Đọc thêm
Các chiến dịch gây ảnh hưởng
Đọc thêm
Vũ khí thông thường
Đọc thêm
Lạm dụng sinh học
Đọc thêm
Chưng cất bất hợp pháp
Đọc thêm
Trong tám tháng qua, đội ngũ Tình báo Mối đe dọa của chúng tôi đã xác định và ngăn chặn các chiến dịch mà trong đó các tác nhân đe dọa cố gắng sử dụng Claude cho các hoạt động độc hại. Trong báo cáo này, chúng tôi chia sẻ các nghiên cứu điển hình từ những chiến dịch đó và mô tả cách thức lạm dụng Claude đã tiến hóa kể từ các báo cáo mối đe dọa trước đây của chúng tôi vào tháng 3, tháng 8 và tháng 11 năm 2025. Trong mỗi trường hợp, chúng tôi đã ngăn chặn hoạt động, sử dụng những gì đã học được để củng cố các biện pháp bảo vệ và chia sẻ thông tin tình báo với các cơ quan chức năng cũng như các đối tác trong ngành khi phù hợp.
Báo cáo này bao gồm các hoạt động mà chúng tôi đã ngăn chặn từ tháng 12 năm 2025 đến tháng 8 năm 2026 trên bảy lĩnh vực gây hại: chiến dịch tấn công mạng, chiến dịch gây ảnh hưởng, giám sát, lừa đảo và gian lận, lạm dụng sinh học, phát triển vũ khí thông thường và chưng cất bất hợp pháp. Các mô hình Claude Haiku, Sonnet và Opus đã được sử dụng. Không có trường hợp lạm dụng nào liên quan đến việc sử dụng các mô hình lớp Fable hoặc Mythos của Claude, ngoại trừ một trường hợp chưng cất bất hợp pháp.
Các trường hợp chúng tôi chia sẻ ở đây không phải là những hành vi lạm dụng điển hình, mà là những ví dụ về các hoạt động đe dọa đáng chú ý và mới lạ nhất mà chúng tôi đã xác định được cho đến nay. Chúng tôi công bố công trình này vì tin rằng mình có trách nhiệm tiết lộ hành vi lạm dụng độc hại đối với các dịch vụ của mình. Khi các mô hình ngày càng trở nên mạnh mẽ hơn, rủi ro của chúng sẽ tăng lên, trừ khi các nhà phát triển AI và những người bảo vệ xã hội hành động để làm cho chúng an toàn hơn.
Các tác nhân đe dọa được đề cập trong báo cáo này bao gồm các nhóm bị nghi ngờ được nhà nước bảo trợ, tội phạm vì mục đích tài chính, các nhà cung cấp phần mềm gián điệp thương mại, các tổ chức tuyên truyền của nhà nước và các cá nhân có động cơ chính trị. Các trường hợp này trải dài từ mạng lưới các ứng dụng hẹn hò giả mạo được thiết kế để lừa đảo người dùng cho đến các hệ thống giám sát được xây dựng để nhận diện và theo dõi những người bất đồng chính kiến.
Các tác nhân đe dọa tinh vi và dai dẳng liên tục thử nghiệm các biện pháp bảo vệ của chúng tôi và cố gắng vượt qua các biện pháp kỹ thuật mà chúng tôi sử dụng để phát hiện và ngăn chặn hành vi lạm dụng. Chúng tôi sẽ tiếp tục phát triển các biện pháp bảo vệ của mình và phối hợp với các đối tác để cải thiện khả năng phát hiện, ngăn chặn và phòng ngừa các hành vi lạm dụng trong tương lai.
Chúng tôi hy vọng rằng những phát hiện trong báo cáo này sẽ giúp các nhà phát triển khác nhận ra các mô hình tương tự trên nền tảng của riêng họ, mang lại cho chính phủ và xã hội dân sự cái nhìn rõ ràng hơn về cách thức hình thành các mối đe dọa mới nổi, đồng thời củng cố khả năng phòng thủ tập thể.
Các chiến dịch tấn công mạng có sự hỗ trợ của AI
Các chiến dịch tấn công mạng: Từ trợ lý đến người điều phối
Trong sáu tháng qua, đội ngũ Tình báo Mối đe dọa của chúng tôi đã xác định và ngăn chặn một loạt các chiến dịch tấn công mạng mà trong đó các tác nhân đe dọa đã sử dụng Claude. Các tác nhân này bao gồm các nhóm bị nghi ngờ được nhà nước bảo trợ, tội phạm vì mục đích tài chính và các cá nhân có động cơ chính trị. Phần này trình bày một số trường hợp trong số đó.
Xuyên suốt các nghiên cứu điển hình này, báo cáo sẽ tham chiếu đến các Nhóm Mối đe dọa Tạo sinh (Generative Threat Groups - GTGs). Đây là các định danh nội bộ của Anthropic dành cho các tác nhân bị quan sát thấy đang lạm dụng AI. Báo cáo cũng cố gắng đo lường "mức độ nâng cao" (uplift), một thuật ngữ chúng tôi sử dụng để mô tả sự gia tăng năng lực nhờ AI, hoặc mức độ gây hại lớn hơn khi có AI so với khi không có AI. Chúng tôi xem xét mức độ nâng cao này qua lăng kính về tốc độ, quy mô và chiều sâu, đồng thời cố gắng xác định cách thức việc áp dụng AI của một tác nhân tác động đáng kể đến từng đặc điểm này.
Nhiều nhà bình luận tập trung vào rủi ro AI phát triển các lỗ hổng ở quy mô lớn. Mặc dù đây là một mối nguy hiểm, nhưng rủi ro từ việc áp dụng AI lại thể hiện rõ rệt hơn trên toàn bộ chuỗi tấn công mạng (cyber kill chain), nơi các đối thủ có thể hoạt động nhanh hơn, trên một bề mặt tấn công rộng và sâu hơn với ít nguồn lực hơn.
Các trường hợp này trải dài từ tháng 12 năm 2025 đến tháng 8 năm 2026. Trong tất cả các trường hợp, các mô hình Claude Haiku, Sonnet và Opus đã được sử dụng; không tìm thấy hoạt động độc hại nào trên Claude Fable hoặc Mythos (vốn có một loạt các biện pháp bảo vệ giúp giảm đáng kể khả năng thực hiện các tác vụ mạng gây hại). Trong mỗi trường hợp, chúng tôi đã ngăn chặn hoạt động liên quan, củng cố các biện pháp bảo vệ AI dựa trên những gì đã học được và chia sẻ thông tin tình báo với các cơ quan chức năng cũng như các đối tác trong ngành khi phù hợp.
Trong báo cáo tiếp theo, chúng tôi bắt đầu bằng việc thảo luận về các xu hướng chính mà chúng tôi đã quan sát được trong các chiến dịch tấn công mạng này, sau đó chuyển sang báo cáo các nghiên cứu điển hình và cách chúng làm nổi bật những xu hướng đó.
Xu hướng
Các cuộc tấn công tinh vi không còn đòi hỏi những kẻ tấn công tinh vi
Kỹ năng an ninh mạng của các mô hình AI đồng nghĩa với việc AI đã xóa bỏ khoảng cách về nhân lực và công cụ vốn từng tách biệt các chiến dịch được nhà nước bảo trợ với nguồn lực dồi dào khỏi các cá nhân vận hành đơn lẻ. Trong các nghiên cứu điển hình mà chúng tôi báo cáo dưới đây, một nhà hoạt động tin tặc (hacktivist) sử dụng các khóa API bị đánh cắp, các cá nhân có động cơ tài chính riêng biệt và một nhà điều hành gián điệp nhà nước đều thực hiện các chiến dịch nhắm vào nhiều nạn nhân mà ngay cả một năm trước đây, sẽ đòi hỏi nhiều nhân sự lành nghề và kiến thức chuyên môn.
Đối với các điều tra viên tình báo mối đe dọa, sự tinh vi không còn là dấu hiệu đáng tin cậy để xác định ai đứng sau một chiến dịch. Mọi lớp của các hoạt động tấn công đều đã được AI nâng cao, từ trinh sát và phát triển công cụ đến xử lý dữ liệu và khai thác lỗ hổng. Một ví dụ về sự nâng cao năng lực này được ghi lại trong nghiên cứu điển hình GTG-50014 (được mô tả bên dưới). Kết quả thực tế của sự nâng cao năng lực này là khả năng tiếp cận kiến thức với bề rộng và chiều sâu lớn hơn, từ đó thúc đẩy tốc độ phát triển và triển khai năng lực nhanh hơn.
Vào tháng 11 năm 2025, chúng tôi đã ghi lại một mô hình vận hành được một chiến dịch nghi ngờ do nhà nước bảo trợ sử dụng để thực hiện các cuộc tấn công tự động. Mô hình vận hành đó hiện đã lan rộng ra mọi nhóm tác nhân mà chúng tôi đã điều tra. Các khung tác nhân tấn công có sẵn công khai, như PentAGI, tái tạo phần lớn các cấu trúc tương tự cho bất kỳ ai tải xuống. Các cấu trúc này tự động hóa hiệu quả từng bước của chuỗi tấn công mạng. Các nhà điều hành đằng sau các trường hợp được quan sát trải dài từ các cơ quan nhà nước đến các cá nhân đơn lẻ, trên một tập hợp các quốc gia ngày càng mở rộng. Một ví dụ về việc áp dụng các chuỗi tấn công hỗ trợ bởi AI này được ghi lại trong nghiên cứu điển hình GTG-20006. Khi các mô hình tiếp tục phát triển và cải thiện, chúng tôi đánh giá rằng nhiều tác nhân hơn, từ những "con sói đơn độc" đến các thực thể có tổ chức, sẽ tiếp tục áp dụng các khung AI để thực hiện các cuộc tấn công mạng tinh vi hơn với tốc độ và quy mô lớn hơn.
Vai trò của AI trong các chiến dịch tấn công mạng ngày càng trở nên tự chủ
Phần lớn các chiến dịch được mô tả trong báo cáo này được AI hỗ trợ thông qua việc thực thi trực tiếp hoặc điều phối. Việc sử dụng AI đã vượt xa các câu hỏi và phản hồi đơn giản từ chatbot mà thay vào đó liên quan đến việc sử dụng các khung đa tác nhân (multi-agent frameworks) để thực hiện trinh sát, khai thác và đánh cắp dữ liệu. Con người vẫn giữ vai trò kiểm soát bằng cách thiết lập mục tiêu tấn công và xem xét dữ liệu bị đánh cắp. Một ví dụ về xu hướng này là GTG-20006. Tác nhân này đã phát triển một quy trình làm việc có sự hỗ trợ của AI, tự động xây dựng lại và triển khai lại bộ công cụ của họ nếu chúng bị các sản phẩm bảo mật phát hiện.
GTG-20006: Gián điệp Nga
Trong lịch sử, các tác nhân gián điệp mạng thường tuân theo mô hình phát triển và triển khai các bộ công cụ tùy chỉnh được thiết kế để né tránh sự phát hiện. Các tác nhân sẽ sử dụng các công cụ này cho đến khi những người phòng thủ xác định và xây dựng các chữ ký để phát hiện và chặn chúng, sau đó một chu kỳ né tránh và phát hiện mới sẽ bắt đầu. Do đó, các biện pháp phòng thủ và phát hiện mạnh mẽ đã tạo ra chi phí ngày càng tăng cho các đối thủ. Tuy nhiên, hiện nay, việc áp dụng AI đe dọa sẽ nhanh chóng và dễ dàng làm suy yếu khả năng của những người phòng thủ trong việc gây áp lực chi phí lên đối thủ chỉ thông qua các phương pháp phát hiện tĩnh.
GTG-20006 là một tác nhân đã tăng tốc độ bằng cách tự động hóa các hoạt động của mình bằng AI. Việc quy kết của chúng tôi nhất quán với các báo cáo công khai liên kết tác nhân này với Midnight Blizzard. Một trong những nhà điều hành là người nói tiếng Nga sử dụng biệt danh “JackPoterz”, người có kỹ năng nghiệp vụ và mục tiêu nhắm đến nhất quán với hoạt động gián điệp liên quan đến nhà nước Nga. Họ đã thực hiện các chiến dịch tấn công vào các mục tiêu tình báo quân sự trong chính phủ Ukraine và châu Âu, cũng như các tổ chức ngoại giao, quốc phòng và các cá nhân liên quan đến chính sách đối ngoại của Hoa Kỳ. Chúng tôi quan sát thấy GTG-20006 vận hành thông qua các quy trình làm việc tùy chỉnh dựa trên AI, tự động hóa phần lớn các hoạt động của họ từ phát triển, mua lại cơ sở hạ tầng, lừa đảo (phishing), duy trì sự hiện diện thông qua chỉ huy và kiểm soát (C2), cho đến đánh cắp dữ liệu.
GTG-20006 đã sử dụng một bộ công cụ tùy chỉnh bao gồm hai dòng mã độc (implants) dựa trên Windows, một bộ công cụ khai thác di động, một công cụ đánh cắp thông tin đăng nhập nhắm vào kho lưu trữ mật khẩu trình duyệt, một nền tảng lừa đảo được thiết kế để bắt chước các mục tiêu ưu tiên như các tổ chức chính phủ và một bảng điều khiển quản trị được sử dụng để quản lý các tài khoản bị xâm nhập. Mỗi công cụ này đều được quản lý và tinh chỉnh khi cần thiết trong các chiến dịch tấn công mạng thông qua các quy trình làm việc có sự hỗ trợ của AI.
Tác nhân này cũng sử dụng AI để giám sát mức độ hiệu quả của các công cụ trong việc né tránh sự phát hiện từ các biện pháp phòng thủ bảo mật đã biết. Nếu các tác nhân AI giám sát của họ xác định rằng bất kỳ phần mềm độc hại nào đã triển khai bị một sản phẩm bảo mật phát hiện, các tác nhân này sẽ bắt đầu quá trình tự động sửa đổi và xây dựng lại phần mềm độc hại đó để né tránh các phương pháp phát hiện hiện có. Các tác nhân được thiết kế để tiếp tục lặp lại việc cải tiến bộ công cụ của GTG-20006 cho đến khi nó không bị phát hiện. Tại thời điểm đó, các công cụ được đưa vào các chiến dịch thực tế từ các máy chủ lưu trữ dùng một lần, nơi lưu lượng truy cập của nạn nhân được điều hướng đến để tải phần mềm độc hại trong nhiều chiến dịch tấn công mạng của họ, bao gồm các hình thức lừa đảo, ClickFix và chiếm quyền điều khiển DNS.
Tác nhân này cũng sử dụng AI để thúc đẩy các chiến dịch lừa đảo của họ. Họ đã phát triển các quy trình làm việc dựa trên AI để nghiên cứu, sau đó đăng ký tên miền và cấu hình cơ sở hạ tầng lưu trữ được sử dụng để gửi email lừa đảo. Các quy trình làm việc bổ sung đã được phát triển để gửi email và giám sát các kênh C2 nhằm tìm kiếm các vụ xâm nhập thành công. Tác nhân con người tham gia chủ yếu để sửa đổi các kỹ năng Claude Code điều khiển các quy trình làm việc khi chúng cần được tinh chỉnh.
Bài viết được AI dịch và tổng hợp tự động từ Anthropic News. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.