Tin ngành
Anthropic thêm watermark vào văn bản AI, làn sóng công cụ 'tẩy' dấu vết bắt đầu xuất hiện
(giờ Việt Nam)
Tóm tắt AI
Để tuân thủ Đạo luật AI của EU, Anthropic đã tích hợp watermark ẩn vào văn bản từ Claude. Động thái này gây lo ngại về quyền riêng tư, dẫn đến sự ra đời của hàng loạt công cụ nhằm loại bỏ các dấu vết này.
Bản dịch AI
Theo tin từ IT ngày 19 tháng 8, Anthropic muốn giúp việc nhận diện văn bản do AI tạo ra trở nên dễ dàng hơn, nhưng một số nhà phát triển phần mềm đã bắt đầu xây dựng các công cụ chuyên dụng để loại bỏ những dấu hiệu này.

Công ty AI này cho biết vào tuần trước rằng, văn bản do một số mô hình Claude tạo ra sẽ chứa một loại "hình mờ không thể nhận biết" (imperceptible watermark). Vì hình mờ này được hình thành thông qua các mô hình thống kê trong cách chọn từ ngữ của Claude, nên ngay cả khi người dùng sao chép và dán văn bản, hình mờ vẫn sẽ được giữ lại.
Một số người cho rằng hình mờ AI là một bước đi đáng hoan nghênh nhằm tăng tính minh bạch cho nội dung. Tuy nhiên, cách làm này cũng làm dấy lên lo ngại trong giới công nghệ: ngay cả khi người dùng chỉ sử dụng Claude để hiệu đính, dịch thuật hoặc tóm tắt văn bản, các dấu hiệu liên quan vẫn có thể bị lan truyền cùng với nội dung cuối cùng. Trước đó, một số người dùng đã chia sẻ với Business Insider rằng họ đã hủy đăng ký Claude vì lý do này.
Phản ứng dữ dội này đã thúc đẩy một số người tìm cách vượt qua hình mờ. Tại Mỹ, lượt tìm kiếm "AI watermark remover" (công cụ xóa hình mờ AI) trên Google Trends đã tăng 60% so với tháng trước. Một số nhà phát triển và doanh nhân thậm chí đã bắt đầu tự tay xây dựng các công cụ để loại bỏ hình mờ AI khỏi văn bản và tệp tin.
Anthropic cho biết việc đưa vào hình mờ là để thực hiện các cam kết liên quan theo Đạo luật AI (AI Act) của Liên minh Châu Âu.
"Đây là giải pháp sai lầm cho một vấn đề có thật"
IT lưu ý rằng, Guillaume Meyer, một doanh nhân công nghệ tại Paris và là người sáng lập công cụ thương mại điện tử AI Memo, đã phát hành một dự án mã nguồn mở có tên "Watermarks Remover" chỉ vài ngày sau khi Anthropic công bố kế hoạch liên quan.
Meyer cho biết công cụ này sẽ xóa các ký tự ẩn và siêu dữ liệu, sau đó viết lại văn bản trong khi vẫn giữ nguyên ý nghĩa ban đầu, từ đó phá vỡ các mô hình chọn từ thống kê có thể mang hình mờ.
Anh tiết lộ rằng phiên bản đầu tiên của công cụ này mất khoảng 5 giờ để phát triển. Hiện tại, dự án đã nhận được hơn 14.000 lượt Star trên GitHub, một chỉ số đo lường mức độ phổ biến của các dự án trong cộng đồng nhà phát triển, tương tự như lượt "thích" trên mạng xã hội. Tuy nhiên, công cụ này không đảm bảo có thể loại bỏ hoàn toàn hình mờ.
Meyer chia sẻ với Business Insider: "Tôi hoàn toàn ủng hộ việc ghi nhận quyền tác giả nội dung, nhưng tôi phản đối công nghệ hình mờ này, có một sự khác biệt rất quan trọng giữa hai điều đó."
Meyer cho rằng vấn đề nằm ở chỗ công nghệ hình mờ "coi danh tính tác giả là một vấn đề trắng đen rõ ràng". Nếu AI được sử dụng để tạo hoàn toàn một đoạn văn bản, hệ thống có thể để lại hình mờ, nhưng ngay cả khi người dùng chỉ sử dụng AI để chỉnh sửa nhẹ, nó vẫn có khả năng để lại hình mờ.
Trong một bài đăng trên blog, Anthropic khẳng định hình mờ của họ không nhằm mục đích xác định danh tính tác giả của nội dung.
Đối với việc thêm hình mờ vào văn bản do AI tạo ra, Meyer nhận định: "Tôi nghĩ đây là một giải pháp sai lầm cho một vấn đề có thật."
Một làn sóng công cụ xóa hình mờ AI mới xuất hiện
Meyer không phải là người duy nhất cố gắng giải quyết vấn đề hình mờ AI.
Tuần này, Sabrina Ramonov, người cung cấp dịch vụ giáo dục AI cho các doanh nhân, đã chia sẻ trên X rằng cô đã phát triển một "Watermark Remover" miễn phí trên trình duyệt. Công cụ này tuyên bố có thể "xóa các dấu hiệu AI ẩn" khỏi văn bản, PDF, tài liệu Word, trang web, hình ảnh và tệp dữ liệu.
Đồng thời, nhà phát triển phần mềm Ansh Aneja đang làm việc tại Tokyo cho biết, ngay trong ngày Anthropic công bố tính năng này, anh đã phát triển một công cụ xóa hình mờ dành riêng cho Claude. Sau đó, anh tiếp tục phát hành một phiên bản mã nguồn mở cục bộ có tên MarkScrub.
Aneja chia sẻ trên X vào tuần trước rằng công cụ này đã tăng từ 0 lên 8.500 người dùng chỉ trong một ngày. Tuy nhiên, Business Insider không thể xác minh độc lập con số này.
Các dự án này hiện vẫn đang ở giai đoạn đầu và Business Insider cũng không thể đánh giá độc lập hiệu quả thực tế của chúng. Các công ty khác bao gồm Google và OpenAI cũng sử dụng hình mờ trong nội dung như hình ảnh, và hiện đã có rất nhiều công cụ tuyên bố có thể loại bỏ các hình mờ này.
Tuy nhiên, Thibaud Gloaguen, nhà nghiên cứu tại Phòng thí nghiệm Hệ thống An toàn, Đáng tin cậy và Thông minh thuộc ETH Zurich, cho biết những công cụ này một lần nữa phản ánh những hạn chế lâu nay của công nghệ hình mờ.
Anh nói với Business Insider: "Luôn có cách để xóa hình mờ." Anh lấy ví dụ rằng người dùng có thể diễn đạt lại toàn bộ văn bản để phá vỡ mô hình hình mờ ban đầu.
Một vùng xám pháp lý
Các công cụ xóa hình mờ AI hiện đang nằm trong vùng xám về mặt pháp lý. EU yêu cầu các công ty AI thêm các dấu hiệu bền vững vào nội dung được tạo ra, nhưng không quy định rõ liệu bên thứ ba có được phép chủ động xóa các dấu hiệu này hay không.
Một phát ngôn viên của Ủy ban Châu Âu nói với Business Insider rằng các hướng dẫn liên quan của EU yêu cầu hệ thống đánh dấu nội dung của các nhà cung cấp dịch vụ AI phải có khả năng chống lại các phương thức sửa đổi phổ biến cũng như các hành vi đối kháng nhắm vào hệ thống đánh dấu.
Phát ngôn viên này cũng cho biết các quy định về tính minh bạch của EU liệt kê rõ ràng việc xóa, tạo lại, sao chép và sửa đổi là những mối đe dọa tiềm ẩn mà các nhà cung cấp dịch vụ AI cần đánh giá.
Tuy nhiên, những yêu cầu này nhắm vào các nhà cung cấp dịch vụ AI. Dmitri Roussinov, giảng viên cao cấp tại Khoa Khoa học Máy tính và Thông tin của Đại học Strathclyde, cho biết Đạo luật AI không cấm rõ ràng việc bên thứ ba cố gắng xóa hình mờ AI.
Nhưng ông nói với Business Insider rằng, nếu công cụ xóa hình mờ tự sử dụng AI để tạo lại văn bản, thì nhà cung cấp công cụ đó cũng có thể cần phải thêm các dấu hiệu tương ứng cho nội dung AI được tạo lại theo luật pháp EU.
Konrad Kollnig, giáo sư trợ lý tại Phòng thí nghiệm Luật và Công nghệ thuộc Đại học Maastricht, cho biết hiện tại dường như không có quy định nào trong Đạo luật AI của EU hay điều khoản dịch vụ của Anthropic cấm mọi người phát triển hoặc chia sẻ các công cụ xóa hình mờ AI.
Tuy nhiên, nếu người dùng sử dụng các công cụ này để ngụy trang nội dung do AI tạo ra thành nội dung do con người sáng tạo, họ có thể gặp rắc rối. Chính sách sử dụng của Anthropic cấm người dùng mạo danh con người bằng cách tuyên bố kết quả do mô hình tạo ra là nội dung do con người tạo ra.
Khi Anthropic có kế hoạch ra mắt API phát hiện văn bản cùng lúc với việc phát hành mô hình thế hệ tiếp theo, vấn đề này có thể trở nên nổi cộm hơn. Hiện tại, Anthropic chưa công bố thời gian ra mắt cụ thể. Hình mờ sẽ áp dụng cho các mô hình mới được phát hành từ ngày 2 tháng 8 trở đi, đồng thời Anthropic cũng có kế hoạch dần dần áp dụng tính năng này cho các mô hình cũ.
Kollnig cho biết: "Tất cả các công nghệ hình mờ này đều có một vấn đề lớn chung: một khi công cụ phát hiện hình mờ được công khai, bất kỳ ai cũng có thể sử dụng trình phát hiện để kiểm tra nội dung do AI tạo ra, bao gồm cả văn bản và video, và phát triển thêm các công cụ để xóa hình mờ."
Bài viết được AI dịch và tổng hợp tự động từ IT Home. Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.