Sản phẩm
Anthropic giải mã cơ chế 'thủy vân' mới trên Claude: Cách vận hành và khả năng chống chỉnh sửa
(giờ Việt Nam)
Tóm tắt AI
Anthropic áp dụng công nghệ SynthID-Text của Google DeepMind để gắn thủy vân vào văn bản từ Claude, giúp tăng tính minh bạch theo quy định của EU mà không làm ảnh hưởng đến chất lượng hay mã nguồn.
Bản dịch AI

Vào thứ Sáu, Anthropic đã đăng tải một bài viết trên blog nhằm giải đáp một số câu hỏi cơ bản về cách họ sẽ gắn watermark (dấu chìm) vào văn bản do chatbot Claude tạo ra. Chẳng hạn như: Watermark sẽ hoạt động như thế nào? Liệu có thể xóa bỏ nó bằng cách chỉnh sửa hay không? Và điều này ảnh hưởng thế nào đến mã nguồn (code)?
Người dùng Claude đã tranh luận về động thái này kể từ khi công ty tiết lộ vào đầu tuần rằng họ sẽ thực hiện việc gắn watermark để tuân thủ Đạo luật AI của EU (EU AI Act) về Quy tắc Minh bạch, vốn yêu cầu các công ty AI phải sử dụng những hệ thống giúp nhận diện nội dung do AI tạo ra.
Ví dụ, trên Reddit, một người dùng đã mô tả đây là một âm mưu chống lại những người dùng Claude vô tội, trong khi một người khác khẳng định: “Lý do duy nhất khiến bạn không muốn điều này là để lừa dối mọi người.” Business Insider cũng đưa tin rằng “hàng chục” người dùng trên X tuyên bố đã hủy gói đăng ký Claude vì lý do này.
Bài viết mới của Anthropic bắt đầu bằng cái nhìn tổng quan về khái niệm watermark, giải thích rằng khi đưa ra các “lựa chọn ít rủi ro” — như chọn giữa từ “overcast” (u ám) và “grey” (xám) để mô tả thời tiết — Claude có thể tạo ra một mô hình trong các phản hồi mà “người đọc không thể phát hiện được, nhưng bất kỳ ai có khóa giải mã đều có thể nhận diện.”
“Watermark không ảnh hưởng đến chất lượng đầu ra của Claude,” công ty cho biết. “Đối với người đọc, một phản hồi có gắn watermark không thể phân biệt được với một phản hồi không có watermark.”
Cụ thể hơn, Anthropic cho biết họ sẽ sử dụng phương pháp SynthID-Text mà đội ngũ Google DeepMind đã phác thảo vào năm 2024, và họ dự định phát hành một API phát hiện watermark. Công ty cũng lưu ý rằng watermark khác biệt với các phương pháp phát hiện AI do các công ty như Pangram cung cấp, vốn tìm kiếm các “dấu hiệu” trong văn bản (như cấu trúc “cái này không phải là [X], mà là [Y]”) để tiết lộ việc sử dụng AI: “Việc nhận diện các mô hình này về cơ bản khác với việc kiểm tra watermark.”
Liệu ai đó có thể viết lại văn bản để ẩn watermark không? Anthropic cho biết điều đó là có thể, nhưng “chỉnh sửa nhẹ có lẽ sẽ không loại bỏ hoàn toàn watermark,” trong khi “viết lại hoàn toàn và thay thế mọi từ ngữ thì sẽ làm được.”
“Tất nhiên, trong trường hợp sau, rất khó để khẳng định liệu văn bản đó còn được coi là do AI tạo ra hay không,” công ty cho biết.
Về việc liệu watermark có thể phát hiện được trong văn bản chỉ được Claude hiệu đính hoặc chỉnh sửa hay không, Anthropic cho biết điều đó phụ thuộc vào “độ dài của văn bản và mức độ chỉnh sửa của Claude.” Nếu chỉ được chỉnh sửa nhẹ, “gần như tất cả các từ” sẽ do tác giả là con người viết và “gần như không có (hoặc rất ít) chỗ để watermark bám vào.”
Trong khi đó, mã nguồn (code) sẽ có ít watermark hơn so với các văn bản khác, vì mô hình cần phải tạo ra mã nguồn hoạt động được và không có sự tự do lựa chọn giữa nhiều phương án thay thế tương đương nhau.
“Mặc dù vậy, ở những nơi có sự lựa chọn tùy ý giữa các từ hoặc thuật ngữ cụ thể trong mã nguồn, watermark có thể được sử dụng, chẳng hạn như trong các phần chú thích (comments),” Anthropic cho biết. “Nhưng theo định nghĩa, nó sẽ có tác động không đáng kể đến mã nguồn thực tế được tạo ra.”
Anthropic cũng cho biết Claude sẽ không phải là chatbot AI duy nhất tạo ra văn bản có watermark, vì “các nhà phát triển mô hình lớn khác cũng đã ký vào cùng Bộ Quy tắc Thực hành này và sẽ triển khai watermark của riêng họ.”
Khi bạn mua hàng thông qua các liên kết trong bài viết của chúng tôi, chúng tôi có thể nhận được một khoản hoa hồng nhỏ. Điều này không ảnh hưởng đến tính độc lập trong biên tập của chúng tôi.
Anthony Ha là biên tập viên cuối tuần của TechCrunch. Trước đây, anh từng làm phóng viên công nghệ tại Adweek, biên tập viên cao cấp tại VentureBeat, phóng viên chính quyền địa phương tại Hollister Free Lance và phó chủ tịch phụ trách nội dung tại một công ty đầu tư mạo hiểm (VC). Anh hiện sống tại Thành phố New York.
Bạn có thể liên hệ hoặc xác minh thông tin từ Anthony bằng cách gửi email đến [email protected].
Xem tiểu sử

Bài viết được AI dịch và tổng hợp tự động từ TechCrunch: AI. Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.