The Decoder: AI News
85

Sản phẩm

Anthropic ra mắt API phát hiện watermark, giúp nhận diện văn bản do Claude tạo ra

(giờ Việt Nam)

Tóm tắt AI

Anthropic giới thiệu API cho phép bên thứ ba phát hiện văn bản từ Claude thông qua công nghệ SynthID Text, giúp xác thực nội dung AI mà không làm ảnh hưởng đến chất lượng hay tính sáng tạo của văn bản.

Bản dịch AI

Anthropic announces watermark detection API that will let third parties detect Claude's AI texts

Anthropic sẽ sớm cung cấp một API phát hiện watermark (hình mờ) cho phép các nhà phát triển bên thứ ba tích hợp tính năng phát hiện văn bản AI vào ứng dụng của riêng họ.

Công ty sử dụng một biến thể của phương pháp SynthID Text mà Google Deepmind đã công bố trên tạp chí Nature vào năm 2024 cho mô hình AI Claude của mình. Watermark này tinh chỉnh nguồn ngẫu nhiên trong quá trình chọn từ, tạo ra một mô hình có thể truy vết được. Theo Anthropic, điều này không gây ảnh hưởng "đến nội dung, mức độ sáng tạo hay khả năng đọc của văn bản do Claude tạo ra." Google Deepmind đã trực quan hóa quy trình này vào năm 2024 bằng hình ảnh động dưới đây.

Watermark hoạt động kém tin cậy hơn trên các văn bản ngắn hoặc các đoạn văn chứa nhiều dữ kiện, nơi không có nhiều cách diễn đạt thay thế. Điều tương tự cũng áp dụng cho mã nguồn (code). Các nội dung được con người chỉnh sửa hoàn toàn cũng sẽ không mang watermark. Bản dịch là một trường hợp khác, vì Claude chọn tất cả các từ trong đó. Anthropic cho biết trong một tài liệu FAQ được công bố rằng việc viết lại nội dung một cách đáng kể có thể loại bỏ watermark.

Watermark chỉ có thể gắn cờ cho biết khả năng cao là Claude đã tham gia vào việc tạo ra văn bản đó. Nó không thể cho biết liệu Claude đã viết toàn bộ hay chỉ chỉnh sửa đáng kể, và nó cũng không thể xác định liệu văn bản đó đến từ con người hay một mô hình AI khác.

Quy định của EU thúc đẩy việc triển khai trên toàn cầu

Anthropic đang bổ sung tính năng watermark để tuân thủ Đạo luật AI của EU (EU AI Act). Cùng với khoảng 190 bên ký kết khác, công ty đã ký Bộ quy tắc thực hành của EU về tính minh bạch đối với nội dung do AI tạo ra vào tháng 7 năm 2026. Vì hiện tại không có cách kỹ thuật nào để giới hạn tính năng này theo khu vực, nên watermark sẽ được triển khai trên toàn thế giới. Theo Anthropic, công ty đang liên tục khám phá thêm các tùy chọn khác và sẽ sớm có các bản cập nhật tiếp theo.

Tất cả các mô hình được phát hành sau ngày 2 tháng 8 năm 2025 đều hỗ trợ watermark ngay từ đầu. Các mô hình Claude cũ hơn sẽ nhận được tính năng này trong những tháng tới. Đối với các tệp tin, Anthropic sử dụng tiêu chuẩn mở C2PA, giúp đính kèm siêu dữ liệu mà không làm thay đổi chính tệp tin đó.

Tính năng watermark của Anthropic hoạt động khác với các công cụ phát hiện AI bên ngoài như Pangram. Các dịch vụ đó không có quyền truy cập vào các khóa (key) của Anthropic. Thay vào đó, họ quét các mô hình điển hình trong văn bản AI, chẳng hạn như cách diễn đạt đặc trưng hoặc các từ ngữ bị lạm dụng. Việc kiểm tra watermark là một phương pháp tiếp cận hoàn toàn khác biệt và hứa hẹn sẽ đáng tin cậy hơn trong thực tế.

Tin tức AI không thổi phồng – Được biên soạn bởi con người

Đăng ký THE DECODER để đọc không quảng cáo, nhận bản tin AI hàng tuần, báo cáo chuyên sâu "AI Radar" độc quyền sáu lần một năm, quyền truy cập toàn bộ kho lưu trữ và tham gia phần bình luận của chúng tôi.

Đăng ký ngay

Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ The Decoder: AI News. Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.