The Decoder: AI News
85

Tin ngành

Anthropic áp dụng watermark toàn cầu cho Claude: Dấu vết AI tồn tại ngay cả khi đã chỉnh sửa

(giờ Việt Nam)

Tóm tắt AI

Anthropic cam kết tuân thủ Đạo luật AI của EU, từ tháng 8/2026 sẽ tích hợp watermark ẩn vào văn bản và metadata C2PA vào hình ảnh do Claude tạo ra, đảm bảo khả năng truy xuất nguồn gốc ngay cả khi nội dung bị chỉnh sửa.

Bản dịch AI

Anthropic đã ký kết Quy tắc thực hành của Đạo luật AI EU về tính minh bạch đối với nội dung do AI tạo ra. Bắt đầu từ tháng 8 năm 2026, các mô hình Claude mới sẽ nhúng hình mờ (watermark) vào văn bản và đính kèm siêu dữ liệu nguồn gốc đã được ký xác thực vào các tệp tin.

Các mô hình Claude ra mắt tại EU vào hoặc sau ngày 2 tháng 8 năm 2026 sẽ được tích hợp sẵn nhãn dán này. Yêu cầu này cũng sẽ không dừng lại ở biên giới EU mà sẽ được áp dụng trên toàn cầu cho tất cả các sản phẩm Claude, bao gồm API, Claude, Claude Code, Claude Cowork và Claude Tag.

Văn bản được tạo ra sẽ mang hình mờ nhúng, trong khi các tệp tin được tạo ra sẽ có siêu dữ liệu nguồn gốc được ký kỹ thuật số. Các mô hình hiện tại có thời gian chuyển tiếp theo luật định, nhưng Anthropic cho biết họ đang tiến hành cập nhật cho các mô hình này.

Công ty cũng có kế hoạch phát hành các công cụ xác minh để người dùng và bên thứ ba có thể kiểm tra nhãn, mặc dù chưa công bố thời điểm cụ thể. Theo Anthropic, các nhà phát triển tích hợp Claude vào sản phẩm của họ phải tự xác định những yêu cầu nào của Điều 50 áp dụng cho dịch vụ của mình.

Hai phương pháp giúp nhận diện nội dung AI

Anthropic dự định sử dụng hai loại nhãn. Theo công ty, văn bản do Claude tạo ra sẽ mang một hình mờ vô hình không làm ảnh hưởng đến ý nghĩa, chất lượng hoặc khả năng đọc. Hình mờ này vẫn tồn tại sau khi sao chép và dán, đồng thời "có thể vẫn giữ nguyên qua một số lần chỉnh sửa". Nó được áp dụng ở cấp độ mô hình, vì vậy không quan trọng bạn đang sử dụng sản phẩm Claude nào.

Các tệp tin được hỗ trợ, bao gồm hình ảnh định dạng.svg,.png và.jpg, sẽ mang siêu dữ liệu nguồn gốc đã được ký dựa trên tiêu chuẩn mở C2PA, do Liên minh Nguồn gốc và Xác thực Nội dung (Coalition for Content Provenance and Authenticity) phát triển. Chữ ký này cho biết Claude đã xử lý tệp tin và có thể tiết lộ các hành vi giả mạo sau đó. Hình mờ văn bản cũng sẽ hoạt động thông qua các đối tác đám mây như AWS, Google Cloud và Microsoft Foundry, mặc dù các nền tảng đó có thể không hỗ trợ siêu dữ liệu đã ký.

Việc phát hiện vẫn có những hạn chế

Anthropic thẳng thắn thừa nhận các hạn chế này. Một hình mờ được phát hiện không có nghĩa là Claude thực sự viết nội dung đó. Mọi người thường xuyên sử dụng Claude để hiệu đính, dịch thuật hoặc tóm tắt, vì vậy kết quả đầu ra có thể mang hình mờ ngay cả khi ý tưởng đến từ con người.

Việc không có hình mờ cũng không khẳng định được điều gì. Mô hình có thể đã được phát hành trước khi tính năng đóng dấu hình mờ ra mắt, văn bản có thể đã được chỉnh sửa hoặc dịch thuật kỹ lưỡng, đoạn văn có thể quá ngắn để phát hiện đáng tin cậy, hoặc siêu dữ liệu đã bị loại bỏ thông qua chuyển đổi định dạng hoặc ảnh chụp màn hình.

Phép thử thực sự nằm ở khả năng tồn tại của các hình mờ này sau khi chỉnh sửa, định dạng lại và dịch thuật. Nếu chúng vẫn giữ nguyên, việc kiểm tra một hình mờ đã biết sẽ đáng tin cậy hơn các công cụ như Pangram, vốn sử dụng các phương pháp phát hiện độc quyền không tiết lộ nguyên nhân dẫn đến kết quả. Các trình phát hiện của bên thứ ba có thể bổ sung hỗ trợ cho hình mờ của Anthropic, mang lại tín hiệu đáng tin cậy hơn cho họ.

Phát hiện văn bản AI vẫn là một vấn đề nhạy cảm trong xã hội

Anthropic không đơn độc trong vấn đề này. Google Deepmind đã mở mã nguồn hệ thống đóng dấu hình mờ SynthID và tích hợp nó vào các mô hình Gemini. SynthID tinh chỉnh nhẹ các giá trị xác suất trong quá trình dự đoán token để tạo hình mờ mà không làm giảm chất lượng văn bản. Nó hoạt động trên nhiều ngôn ngữ nhưng gặp khó khăn với văn bản đã qua chỉnh sửa sau khi tạo.

OpenAI đã nắm giữ một công cụ phát hiện văn bản với độ chính xác 99,9% trong khoảng hai năm nhưng vẫn chưa phát hành. Các lý do bao gồm việc người dùng có thể dễ dàng vượt qua nó thông qua dịch thuật hoặc viết lại, nguy cơ kỳ thị một số nhóm người, và có khả năng là những lo ngại rằng một công cụ phát hiện công khai có thể gây hại cho chính hoạt động kinh doanh của OpenAI.

Rủi ro đó đặc biệt nghiêm trọng trong giáo dục, nơi các công cụ phát hiện không đáng tin cậy có thể dẫn đến những cáo buộc gian lận sai lệch. Đồng thời, có những lý do chính đáng để muốn biết khi nào và mức độ sử dụng AI. Các nghiên cứu cho thấy việc quá phụ thuộc vào các công cụ AI có thể làm suy yếu tư duy phản biện và kỹ năng viết, đặc biệt là ở những sinh viên coi chúng là lối tắt thay vì công cụ hỗ trợ học tập. Vấn đề còn vượt ra ngoài phạm vi học thuật, khi những kẻ lừa đảo hiện đang đăng ký sinh viên giả tại các trường đại học Mỹ và sử dụng AI để vượt qua các môn học và trục lợi hỗ trợ tài chính.

Quyết định của Anthropic cũng có thể ảnh hưởng đến hoạt động kinh doanh của họ. Claude rất phổ biến trong công việc tri thức, đặc biệt là đối với học sinh và sinh viên, vì ngay cả các mô hình cũ cũng tạo ra văn bản khá tự nhiên. Với việc các trường học và đại học đang tranh cãi về việc sử dụng AI trong học tập, khả năng phát hiện đáng tin cậy hơn có thể khiến Claude trở nên kém hấp dẫn hơn đối với những người dùng này.

Tin tức AI không cường điệu – Được tuyển chọn bởi con người

Đăng ký THE DECODER để đọc không quảng cáo, nhận bản tin AI hàng tuần, báo cáo chuyên sâu "AI Radar" độc quyền sáu lần một năm, quyền truy cập toàn bộ kho lưu trữ và tham gia phần bình luận của chúng tôi.

Đăng ký ngay

Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ The Decoder: AI News. Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.