← Về bảng nóng
SỰ KIỆNĐã lắng xuống

Anthropic công bố báo cáo mới nhất về lạm dụng AI: Cho biết đã ngăn chặn các yêu cầu làm cho virus trở nên nguy hiểm hơn, mô tả 5 trường hợp sinh học (bao gồm nghiên cứu cúm gia cầm và đề xuất về virus Chikungunya liên quan đến viện nghiên cứu quân sự), đồng thời lưu ý rằng các đại lý vẫn quay trở lại chỉ sau vài ngày dù bị khóa tài khoản và nghiên cứu vẫn tiếp diễn; ngoài ra, hãng cũng siết chặt các hạn chế đối với yêu cầu sinh học do rủi ro từ mô hình mới

Tổng quan sự kiện

Toàn cảnh do AI tổng thuật

Anthropic vừa công bố báo cáo mới nhất về tình trạng lạm dụng AI, khẳng định đã ngăn chặn thành công các yêu cầu hỗ trợ tạo ra virus nguy hiểm hơn. Báo cáo mô tả 5 trường hợp liên quan đến sinh học, bao gồm nghiên cứu về cúm gia cầm và một đề xuất nghiên cứu tăng cường chức năng virus Chikungunya liên quan đến một viện nghiên cứu quân sự. Báo cáo cũng chỉ ra rằng việc khóa tài khoản không hoàn toàn ngăn chặn được quyền truy cập: các đại lý phục vụ cho các nhà nghiên cứu virus Chikungunya đã quay trở lại chỉ sau vài ngày và quá trình nghiên cứu vẫn tiếp tục.

Báo cáo tự phê bình về những hạn chế của bộ phân loại an toàn sinh học, ghi lại 5 trường hợp ẩn danh của các nhà khoa học đang làm việc và đi đến kết luận: trong lĩnh vực nghiên cứu lưỡng dụng, ý định của người dùng không thể được phát hiện một cách đáng tin cậy, khiến bộ phân loại khó đạt được sự cân bằng giữa việc hỗ trợ công việc hữu ích và ngăn chặn tác hại. Ví dụ, một nhà vận hành nền tảng đã xây dựng phương án dự phòng để chuyển hướng các yêu cầu bị Claude từ chối sang các mô hình của đối thủ cạnh tranh, trong khi chính Claude lại là công cụ viết phần lớn mã nguồn cho phương án đó.

Trước đây, Anthropic từng đánh giá các phiên bản Claude cũ còn quá hạn chế, không thể hỗ trợ đáng kể cho các chuyên gia trong việc thực hiện các nghiên cứu sinh học nguy hiểm. Tuy nhiên, công ty cho biết không thể đưa ra cam kết tương tự đối với các mô hình mới, do đó hiện đã hạn chế phạm vi các yêu cầu liên quan đến sinh học. Báo cáo cũng khẳng định rằng quá trình chưng cất (distillation) có thể nâng cao khả năng suy luận tổng quát, từ đó làm gia tăng các năng lực nguy hiểm nằm ngoài chủ đề hội thoại huấn luyện, đồng thời các biện pháp bảo mật của Claude sẽ không được chuyển giao thông qua quá trình chưng cất trái phép, dù công ty chưa cung cấp đánh giá định lượng cụ thể.

Tổng thuật do AI tổng hợp từ toàn bộ bài đưa tin, cập nhật theo diễn biến · làm mới T7 · 12/09 · 16:57.

Diễn biến mới nhất

Xem chi tiết toàn cảnh sự việc tại đây.

Dòng thời gian đưa tin

Đang hiện 3 bài · tất cả · mới trước

T6 · 11/09

  1. Báo cáo đe dọa của Anthropic tiết lộ Claude bị lợi dụng cho phần mềm gián điệp, phát triển tên lửa và máy bay không người lái, đồng thời các phòng thí nghiệm Trung Quốc đã thực hiện trích xuất dữ liệu quy mô lớn

    The Decoder: AI News

    Anthropic phát hành báo cáo tình báo đe dọa, ghi lại 7 loại hình lạm dụng Claude từ tháng 12/2025 đến tháng 8/2026. Các tổ chức gián điệp nói tiếng Nga đã dùng tác nhân AI để tự động viết lại phần mềm độc hại nhằm vượt qua phần mềm diệt virus, một tổ chức tại Yemen đã dùng Claude Code để phát triển phần mềm cho tên lửa có tầm bắn hơn 2.000 km, và một nhóm khác đã xây dựng các đàn máy bay không người lái FPV tự hành không cần sự can thiệp của con người.

    Đọc bản tiếng Việt →Đọc bài gốc ↗
  2. Anthropic báo cáo rằng kỹ thuật chưng cất có thể nâng cao các năng lực nguy hiểm

    X: Rohan Paul (@rohanpaul_ai)

    Báo cáo "Lạm dụng AI" mới nhất của Anthropic cho biết, kỹ thuật chưng cất tri thức có thể nâng cao khả năng suy luận tổng quát, đủ để mở rộng các năng lực nguy hiểm ra ngoài phạm vi hội thoại được huấn luyện. Báo cáo cũng khẳng định các biện pháp bảo vệ của Claude không thể bị chuyển giao thông qua việc chưng cất trái phép, nhưng không cung cấp đánh giá định lượng cho các tuyên bố này.

    Đọc bản tiếng Việt →Đọc bài gốc ↗
  3. Báo cáo lạm dụng tháng 9 năm 2026 của Anthropic: Ngăn chặn các yêu cầu sinh học nguy hiểm, chỉ đích danh 7 phòng thí nghiệm Trung Quốc chưng cất trái phép Claude

    X: Rohan Paul (@rohanpaul_ai)

    Anthropic công bố báo cáo phát hiện lạm dụng tháng 9 năm 2026, cho biết đã ngăn chặn các yêu cầu nhằm tăng cường tính nguy hiểm của virus, đồng thời mô tả 5 trường hợp lạm dụng sinh học, bao gồm nghiên cứu về cúm gia cầm và một đơn xin tài trợ cho bệnh sốt Chikungunya từ một cơ quan nghiên cứu quân sự.

    Đọc bản tiếng Việt →Đọc bài gốc ↗
← Về bảng nóng

Hồ sơ sự kiện được gom từ nhiều nguồn đưa tin độc lập rồi dịch, tóm tắt sang tiếng Việt. Bản quyền từng bài viết thuộc về cơ quan báo chí gốc. Nguồn dữ liệu: hồ sơ gốc trên AI HOT

Anthropic công bố báo cáo mới nhất về lạm dụng AI: Cho biết đã ngăn chặn các yêu cầu làm cho virus trở nên nguy hiểm hơn, mô tả 5 trường hợp sinh học (bao gồm nghiên cứu cúm gia cầm và đề xuất về virus Chikungunya liên quan đến viện nghiên cứu quân sự), đồng thời lưu ý rằng các đại lý vẫn quay trở lại chỉ sau vài ngày dù bị khóa tài khoản và nghiên cứu vẫn tiếp diễn; ngoài ra, hãng cũng siết chặt các hạn chế đối với yêu cầu sinh học do rủi ro từ mô hình mới — Hồ sơ sự kiện | AIHOT.vn