Thủ thuật
Cách Claude gắn nhãn nội dung do AI tạo ra
(giờ Việt Nam)
Tóm tắt AI
Anthropic vừa cập nhật tài liệu hướng dẫn về cơ chế gắn nhãn nội dung, giúp người dùng dễ dàng nhận diện các văn bản hoặc hình ảnh được tạo ra và chỉnh sửa bởi Claude nhằm tăng tính minh bạch.
Bản dịch AI

Cập nhật hôm nay
Anthropic đã ký kết Quy tắc thực hành về tính minh bạch của nội dung do AI tạo ra theo Điều 50(2) của Đạo luật AI EU, với tư cách là nhà cung cấp cả mô hình AI tạo sinh và hệ thống AI tạo sinh. Bài viết này mô tả cách chúng tôi dự định đưa những cam kết đó vào thực tiễn, cách thức hoạt động của việc đánh dấu và những hạn chế của nó. Chúng tôi sẽ cập nhật bài viết này và công bố hướng dẫn kỹ thuật chi tiết hơn khi có thông tin.
Các dấu hiệu có thể đọc được bằng máy trong nội dung do Claude tạo ra
Khi nội dung do AI tạo ra trở nên phổ biến, sự minh bạch cao hơn và các tín hiệu về nguồn gốc nội dung có thể cung cấp cho người dùng ngữ cảnh hữu ích về thông tin mà họ tiêu thụ. Để hỗ trợ tính minh bạch và tuân thủ các nghĩa vụ pháp lý, Anthropic đang nỗ lực đưa các dấu hiệu có thể đọc được bằng máy vào nội dung do Claude tạo ra.
Phạm vi áp dụng
Cách Claude đánh dấu nội dung
Claude sử dụng hai kỹ thuật bổ trợ để đánh dấu nội dung được tạo và xử lý bởi Claude: (1) hình mờ (watermark) được nhúng trong văn bản và (2) siêu dữ liệu nguồn gốc đã ký được đính kèm vào tệp.
1. Hình mờ nhúng trong văn bản
Khi một mô hình Claude được hỗ trợ tạo văn bản, nó sẽ lồng một hình mờ không thể nhận thấy trực tiếp vào chính văn bản đó. Bạn sẽ không nhìn thấy nó và nó không làm thay đổi ý nghĩa, chất lượng hay khả năng đọc phản hồi của Claude.
Vì hình mờ là một phần của văn bản, nó sẽ đi kèm với văn bản khi được sao chép và dán ở nơi khác, đồng thời có thể tồn tại qua một số chỉnh sửa. Việc đóng dấu hình mờ sẽ được áp dụng ở cấp độ mô hình, nghĩa là nó sẽ xuất hiện bất kể văn bản đó đến từ sản phẩm hay giao diện Claude nào.
2. Siêu dữ liệu nguồn gốc đã ký
Khi Claude tạo một loại tệp được hỗ trợ, chẳng hạn như.svg,.png hoặc.jpg, nó sẽ đính kèm siêu dữ liệu nguồn gốc đã ký. Siêu dữ liệu này tuân theo tiêu chuẩn mở của Coalition for Content Provenance and Authenticity (C2PA), vốn được sử dụng trên toàn ngành để ghi lại thông tin về nguồn gốc nội dung. Nếu có nhãn siêu dữ liệu đã ký, nó báo hiệu rằng tệp đã được Claude xử lý và cho phép bạn phát hiện xem tệp đó có bị giả mạo hay không.
Phát hiện các dấu hiệu của Claude
Chúng tôi cũng đang nỗ lực để cho phép người dùng và các bên thứ ba khác phát hiện các hình mờ nhúng và siêu dữ liệu nguồn gốc của Claude. Việc phát hiện sẽ kiểm tra xem một đoạn văn bản hoặc tệp có chứa dấu hiệu Claude được hỗ trợ hay không. Nếu tìm thấy dấu hiệu được hỗ trợ, điều đó cho biết nội dung có thể đã được Claude xử lý.
Chúng tôi sẽ chia sẻ chi tiết về các cơ chế phát hiện trong tài liệu kỹ thuật sắp tới.
Hạn chế
Các dấu hiệu có thể đọc được bằng máy cung cấp những tín hiệu quan trọng về nội dung, nhưng cần hiểu rõ những hạn chế của chúng trên tất cả các loại nội dung.
Nếu bạn xây dựng ứng dụng với Claude
Nếu bạn triển khai Claude trong sản phẩm của riêng mình, bạn nên tự đánh giá xem Điều 50 yêu cầu gì đối với sản phẩm và dịch vụ của bạn. Nhất quán với các cam kết của chúng tôi theo Quy tắc của EU, mục tiêu của chúng tôi là hỗ trợ bạn đáp ứng các nghĩa vụ minh bạch của chính mình, và chúng tôi sẽ chia sẻ hướng dẫn kỹ thuật về phương pháp đánh dấu và phát hiện của chúng tôi khi có thông tin.
Các bài viết liên quan
Bài viết được AI dịch và tổng hợp tự động từ Hacker News Nổi bật (buzzing.cc bản dịch tiếng Trung). Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.