Tin ngành
Lập trình viên chạy đua phát triển công cụ 'xóa dấu vết' nội dung AI
(giờ Việt Nam)
Tóm tắt AI
Sau khi Anthropic áp dụng watermark cho văn bản từ Claude, cộng đồng lập trình viên đã nhanh chóng tạo ra các công cụ nhằm loại bỏ dấu hiệu nhận diện này.
Bản dịch AI

Lập trình viên đua nhau tạo công cụ 'tẩy' nhãn AI
Nhiều lập trình viên đang tạo các công cụ gỡ dấu chìm (watermark) sau khi công ty Anthropic triển khai tính năng đánh dấu văn bản đầu ra của Claude.
Tuần trước, Anthropic thông báo áp dụng cơ chế đánh dấu "vô hình", một dạng watermark để phân biệt nội dung do AI và con người tạo ra. Cụ thể, công ty thiết lập các khuôn mẫu trong cách chọn từ và cụm từ của Claude mà người dùng thông thường không thể nhận biết, nhưng người có "chìa khóa" mã hóa có thể phát hiện được. Dấu chìm sẽ đi theo văn bản khi được sao chép và dán, giúp truy xuất nguồn gốc.
Trong khi nhiều người ca ngợi động thái mới giúp tăng tính minh bạch, số khác cho rằng cách đánh dấu này ảnh hưởng đến chất lượng sản phẩm đầu ra của Claude, chưa kể dấu chìm có thể bị gắn vào văn bản ngay cả khi họ chỉ dùng chatbot để hiệu đính, dịch thuật hoặc tóm tắt. Một số người cho biết đã hủy đăng ký Claude vì lý do này.
Theo Business Insider, mức độ quan tâm đến từ khóa "công cụ xóa dấu chìm AI" tại Mỹ trên Google Trends đã tăng 60% so với tuần trước. Thậm chí, nhiều lập trình viên và doanh nhân đã nhanh chóng phát triển các công cụ tẩy nhãn AI.

Một lập trình viên đang thao tác trên máy tính. Ảnh: BairesDev
Guillaume Meyer, nhà phát triển tại startup AI Memo, đã thực hiện dự án mã nguồn mở "Watermarks Remover" (Loại bỏ dấu chìm) chỉ vài ngày sau khi Anthropic công bố kế hoạch. Công cụ này gỡ bỏ siêu dữ liệu và các ký tự ẩn, sau đó viết lại văn bản sao cho vẫn giữ nguyên ý nghĩa, từ đó phá vỡ khuôn mẫu chọn từ ngữ vốn có thể chứa dấu chìm.
Meyer mất khoảng 5 tiếng để phát triển phiên bản đầu tiên và công cụ này hiện nhận được hơn 14.000 "sao" trên nền tảng dành cho lập trình viên GitHub, tương đương với 14.000 "lượt thích".
"Tôi hoàn toàn ủng hộ việc ghi nguồn nội dung, nhưng phản đối kỹ thuật đóng dấu. Hai việc này rất khác nhau", Meyer nói với Business Insider. Anh giải thích rằng AI có thể để lại dấu chìm khi tạo ra toàn bộ văn bản, nhưng cũng có thể làm vậy khi mọi người chỉ dùng nó để chỉnh sửa nhẹ. Anh gọi đây là "lời giải sai cho một vấn đề có thật".
Trong bài đăng trên X tuần này, chuyên gia đào tạo AI cho doanh nhân Sabrina Ramonov cho biết đã tạo ra một công cụ miễn phí hoạt động trên trình duyệt, có khả năng gỡ dấu chìm khỏi văn bản, tài liệu PDF, Word, trang web, hình ảnh và các tệp dữ liệu.
Nhà phát triển phần mềm Ansh Aneja ở Tokyo cũng triển khai công cụ xóa dấu chìm tập trung vào Claude ngay trong ngày Anthropic công bố kế hoạch, sau đó phát hành phiên bản mã nguồn mở MarkScrub. Trong bài đăng trên X tuần trước, Aneja thông báo công cụ này đã tăng từ 0 lên 8.500 người dùng chỉ trong một ngày.
Chia sẻ với Wired, kỹ sư Erik Hughes cho biết anh chỉ mất 15 phút để tạo ra công cụ hoạt động với Claude, giúp loại bỏ các ký tự vô hình và trông giống nhau, sắp xếp lại câu trong đoạn văn, đồng thời thay thế một số từ bằng từ đồng nghĩa.
Theo Leon Chlon, nhà nghiên cứu thỉnh giảng tại Đại học Oxford, một phương án khác để xóa dấu chìm là tóm tắt phản hồi của Claude, dịch sang một ngôn ngữ khác như tiếng Arab (vốn khác biệt hoàn toàn với tiếng Anh), sau đó dịch ngược lại.
Anthropic cũng thừa nhận rằng nội dung đã qua chỉnh sửa nhiều, diễn đạt lại hoặc dịch sang ngôn ngữ khác có thể không còn mang dấu chìm nữa. Điều này xảy ra do cơ chế đánh dấu được xây dựng dựa trên cách chọn từ và cụm từ của Claude.
Trong một bài đăng trên blog, startup này giải thích rằng các mô hình ngôn ngữ lớn như Claude hoạt động bằng cách tạo ra từng từ một. Khi cần quyết định từ tiếp theo, mô hình sẽ lựa chọn trong danh sách các "ứng viên" phù hợp dựa trên đoạn văn trước đó. Ví dụ, từ tiếp theo trong câu "Trời hôm nay lạnh và...", nhiều khả năng là "u ám" hoặc "xám xịt". Việc mô hình chọn từ nào thường không quan trọng với người đọc, vì ý nghĩa câu trong cả hai trường hợp đều giống nhau về cơ bản.
Kỹ thuật đánh dấu vô hình của Anthropic tận dụng những lựa chọn ít rủi ro như vậy, vốn xuất hiện nhiều lần trong văn bản đầu ra, để tạo ra một khuôn mẫu trong phản hồi của Claude. Các lựa chọn vẫn được thực hiện ngẫu nhiên, nhưng nguồn gốc của sự ngẫu nhiên lại khác. Thay vì dùng bộ tạo số ngẫu nhiên tùy ý để hiển thị từ tiếp theo, dấu chìm sử dụng "chìa khóa" và một số từ đứng trước để quyết định. Người giữ "chìa khóa" sẽ kiểm tra trật tự từ và xem có nhất quán với những lựa chọn mà Claude thực hiện theo dấu chìm hay không. Nếu có, văn bản đó có thể do AI tạo ra.
Anthropic lưu ý rằng không phải lúc nào mô hình cũng sẽ thiên về "u ám" hoặc "xám xịt". Cũng giống như văn bản không đánh dấu, "u ám" có thể được chọn trong câu này và "xám xịt" xuất hiện trong câu khác, tùy thuộc vào những từ đứng trước. Kỹ thuật đánh dấu vô hình cũng không ép Claude chọn một từ bất hợp lý mà mô hình vốn không cân nhắc.

Logo ứng dụng AI Claude của startup Anthropic trên điện thoại di động. Ảnh: Lưu Quý
Phát ngôn viên của Anthropic chia sẻ với Wired rằng công ty thêm dấu hiệu nhận biết vào sản phẩm đầu ra của Claude nhằm tuân thủ Đạo luật AI của Liên minh châu Âu (EU), và các công ty khác cũng đang làm điều tương tự.
"Xác định văn bản do AI tạo ra rất khó, bước đi mới này sẽ cung cấp cho mọi người công cụ để nhận diện. Văn bản từ những mô hình Claude được hỗ trợ, bao gồm Claude Code, sẽ chứa dấu vô hình. Nó không làm thay đổi ý nghĩa, chất lượng hay tính dễ đọc của phản hồi từ Claude", phát ngôn viên Anthropic nói, đồng thời cho biết công ty dự định cung cấp một giao diện lập trình ứng dụng (API) phát hiện văn bản để người dùng có thể chủ động hơn trong việc nhận diện văn bản AI.
Theo Konrad Kollnig, phó giáo sư tại Phòng thí nghiệm Luật và Công nghệ thuộc Đại học Maastricht, Đạo luật AI của EU và các điều khoản của Anthropic đều không cấm rõ ràng việc mọi người tạo hoặc chia sẻ công cụ xóa dấu chìm.
Tuy nhiên, Kollnig cảnh báo người dùng có thể gặp rắc rối nếu sử dụng chúng để đánh tráo nguồn gốc, biến sản phẩm AI thành của con người. Chính sách sử dụng của Anthropic nghiêm cấm mạo danh người khác bằng cách trình bày kết quả từ mô hình như thể đó là sản phẩm do con người tạo ra.
Anthropic không phải là công ty duy nhất ứng dụng kỹ thuật giúp nhận diện nội dung AI. Trước đó, Google đã dùng công nghệ SynthID để "đóng dấu" sản phẩm trí tuệ nhân tạo, OpenAI cũng áp dụng với hình ảnh và âm thanh. Tuy nhiên, Google bắt đầu nới lỏng khi bổ sung tùy chọn để người dùng chủ động bật/tắt dấu chìm trên ảnh, video, nhạc do Gemini tạo ra. Mạng xã hội X của Elon Musk cũng thêm nhãn "Tạo bằng AI" vào nội dung sản xuất bằng công nghệ này. Tuần trước, dịch vụ phát nhạc trực tuyến Spotify bắt đầu gắn nhãn "AI Persona" cho những hồ sơ chứa nội dung trí tuệ nhân tạo.
Thu Thảo tổng hợp
Bài viết được AI dịch và tổng hợp tự động từ VnExpress Khoa học Công nghệ. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.