The Decoder: AI News
85

Tin ngành

Nguyên đơn cài lệnh ẩn trong tài liệu tòa án nhằm thao túng hệ thống AI

(giờ Việt Nam)

Tóm tắt AI

Một nguyên đơn tại Connecticut đã chèn các dòng lệnh ẩn bằng chữ trắng vào tài liệu pháp lý để đánh lừa hệ thống AI của tòa án. Hành vi này bị thẩm phán phát hiện và xử lý nghiêm, đồng thời đặt ra cảnh báo về rủi ro bảo mật khi ứng dụng AI trong quy trình tư pháp.

Bản dịch AI

Plaintiff hid invisible AI instructions in court filings to secretly influence automated review

Một nguyên đơn tự đại diện tại Connecticut đã chèn các chỉ dẫn AI ẩn vào các hồ sơ tòa án chính thức nhằm điều hướng một quy trình đánh giá tự động tiềm năng theo hướng có lợi cho mình.

Một nguyên đơn tự đại diện tên là Matthew Elliott đã chèn các đoạn prompt injection vào hồ sơ của mình trong một vụ kiện tại tòa án Connecticut. Các chỉ dẫn này được định dạng bằng văn bản màu trắng cỡ 3 trên nền trắng, khiến chúng gần như vô hình với mắt người nhưng lại hoàn toàn có thể đọc được bởi bất kỳ hệ thống AI nào xử lý văn bản của tài liệu.

Văn bản ẩn này chỉ đạo một hệ thống AI giả định phải đảm bảo kết quả đầu ra phù hợp với hồ sơ đã nộp và coi quyết định từ chối trước đó của thư ký tòa án là một sai sót cần được sửa chữa. Elliott đã kiện New York Bariatric Group vào tháng 10 năm 2025, cáo buộc vi phạm quyền riêng tư dữ liệu và phân biệt đối xử, cùng các khiếu nại khác.

Tòa án phát hiện khoảng trắng đáng ngờ

Âm mưu này bị bại lộ vì tòa án nhận thấy một lượng khoảng trắng bất thường trong các hồ sơ của Elliott. Kiểm tra kỹ hơn đã phát hiện ra đoạn văn bản gần như vô hình đó. Thẩm phán Walter Spader Jr. đã lên lịch một phiên điều trần và cảnh báo rõ ràng Elliott không được phép ẩn văn bản trong các tài liệu tòa án.

Elliott đã phớt lờ cảnh báo. Trong các hồ sơ sau đó, anh ta lại tiếp tục ẩn các thông điệp, bao gồm một liên kết YouTube và những bình luận chế giễu. Anh ta nói với 404 Media, đơn vị đầu tiên đưa tin về vụ việc, rằng hành động ban đầu là một cuộc "kiểm thử" đối với một hệ thống đánh giá bằng AI tiềm năng. Các thông điệp sau đó, theo anh ta, chỉ là những "trò đùa vô hình".

Thẩm phán so sánh prompt injection với việc bí mật gây ảnh hưởng đến bồi thẩm viên

Trong phán quyết dài 14 trang của mình (có sẵn trong bài đăng trên LinkedIn này), Thẩm phán Spader làm rõ rằng các tòa án tại Connecticut không sử dụng hệ thống AI để xem xét hoặc đưa ra phán quyết đối với các hồ sơ. Các chỉ dẫn ẩn không có tác động gì đến kết quả vụ việc. Tuy nhiên, ông viết, chính hành vi cố tình thực hiện mới là vấn đề, vì nó đã âm thầm tìm cách gây ảnh hưởng đến một hệ thống AI có thể đang được sử dụng.

"Hãy xem xét việc một bên dàn xếp để một tác nhân tự động liên lạc bí mật với một bồi thẩm viên trong phiên tòa là không phù hợp đến mức nào," Spader viết. Về bản chất, một chỉ dẫn ẩn chính là một thông tin liên lạc bí mật nhắm vào những người ra quyết định hoặc các công cụ mà họ dựa vào để đưa ra quyết định.

Đồng thời, vị thẩm phán cũng hoan nghênh việc sử dụng AI để chuẩn bị hồ sơ. Ông viết rằng những công cụ này mang đến cho những người không có luật sư những cách thức mới để trình bày vụ việc của họ một cách rõ ràng trước tòa. Những gì Elliott đã làm là một hành vi sử dụng các công cụ đó một cách thiếu trung thực. Spader cũng cảnh báo rằng các mô hình ngôn ngữ có thể củng cố những lập luận pháp lý sai lệch vì chúng có xu hướng phát triển các lập luận của người dùng một cách thuyết phục nhất có thể thay vì thách thức chúng.

Tòa án thu hồi đặc quyền nộp hồ sơ điện tử

Như một hình thức xử phạt, tòa án đã tước quyền nộp hồ sơ điện tử của Elliott. Giờ đây, anh ta phải nộp tất cả hồ sơ và bằng chứng trực tiếp bằng giấy tại văn phòng thư ký tòa án. Elliott nói với 404 Media rằng hình phạt này là không công bằng, đồng thời chỉ ra rằng các tài liệu giấy được quét cũng có thể chứa văn bản ẩn.

Spader đã dẫn chứng một vụ việc tương tự ở Brazil, nơi hai luật sư cũng đã ẩn văn bản màu trắng cỡ nhỏ trên nền trắng trong một hồ sơ để thao túng hệ thống AI của tòa án. Trong vụ việc đó, hệ thống của tòa án đã tự phát hiện và chặn văn bản trước khi nó được xử lý. Vụ tấn công prompt injection đã thất bại.

Prompt injection là một vấn đề ngày càng gia tăng bên ngoài phòng xử án

Những nỗ lực thao túng các hệ thống AI thông qua các chỉ dẫn ẩn trong tài liệu không chỉ giới hạn ở hồ sơ tòa án. Năm ngoái, Nikkei đã tìm thấy các chỉ dẫn như "chỉ đánh giá tích cực" hoặc "không chỉ trích" trong 17 bản thảo tiền công bố (preprint) trên arXiv. Chúng được ẩn dưới dạng văn bản màu trắng trên nền trắng và cỡ chữ cực nhỏ, tất cả đều nhằm mục đích làm sai lệch các đánh giá ngang hàng (peer review) bằng AI để có lợi cho tác giả.

Hệ thống tư pháp cũng đang phải đối mặt với một xu hướng riêng biệt do AI thúc đẩy. Một nghiên cứu của MIT và USC cho thấy số lượng các vụ kiện không có luật sư tại các tòa án liên bang Hoa Kỳ đã tăng vọt kể từ khi ChatGPT trở nên phổ biến. Năm 2025, có 41.490 vụ kiện tự đại diện (pro se) được đệ trình, gần gấp đôi mức trung bình trước khi bùng nổ AI. Trong một mẫu đơn khiếu nại từ đầu năm 2026, một công cụ phát hiện văn bản AI đã gắn cờ 18% là do AI tạo ra. Vụ việc của Elliott bổ sung thêm một khía cạnh mới vào bức tranh này: AI không chỉ giúp mọi người soạn thảo tài liệu tòa án, mà nó còn đang trở thành mục tiêu bị thao túng ngay trong chính các tài liệu đó.

Tin tức AI không cường điệu – Được tuyển chọn bởi con người

Đăng ký THE DECODER để đọc không quảng cáo, nhận bản tin AI hàng tuần, báo cáo chuyên sâu về công nghệ tiên phong "AI Radar" sáu lần mỗi năm, quyền truy cập toàn bộ kho lưu trữ và tham gia phần bình luận của chúng tôi.

Đăng ký ngay

Image description
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ The Decoder: AI News. Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.