The Verge AI
85

Sản phẩm

Anthropic bổ sung watermark ẩn vào văn bản và hình ảnh do Claude tạo ra

(giờ Việt Nam)

Tóm tắt AI

Anthropic bắt đầu gắn watermark kỹ thuật số vào nội dung từ Claude nhằm tuân thủ quy định minh bạch AI của châu Âu, giúp nhận diện nguồn gốc mà không ảnh hưởng đến trải nghiệm người dùng.

Bản dịch AI

Claude will apply invisible watermarks to AI text and images

Anthropic đã cam kết bắt đầu gắn nhãn văn bản và hình ảnh do Claude tạo ra bằng dữ liệu máy có thể đọc được, nhằm nỗ lực tuân thủ các quy định của châu Âu về tính minh bạch của AI. "Văn bản được tạo ra sẽ chứa các hình mờ (watermark) nhúng, và các tệp được tạo ra sẽ bao gồm siêu dữ liệu nguồn gốc được ký kỹ thuật số ở những nơi được hỗ trợ," Anthropic cho biết trên một trang hỗ trợ Claude mới. Những thay đổi này không thể nhìn thấy bằng mắt thường, nhưng sẽ giúp người dùng và các nền tảng trực tuyến dễ dàng phát hiện liệu nội dung có phải do các mô hình Claude tạo ra hay không.

Những cập nhật này là một cam kết cho tương lai thay vì là điều sẽ có hiệu lực ngay lập tức. Các nghĩa vụ mới về dán nhãn và minh bạch AI theo Đạo luật AI của EU, vốn đã có hiệu lực từ ngày 2 tháng 8, bao gồm thời gian ân hạn tuân thủ bốn tháng cho các sản phẩm AI hiện có đã ra mắt trước ngày đó. Do đó, Anthropic cho biết các mô hình Claude mới sẽ gắn nhãn nội dung do AI tạo ra ngay từ ngày đầu tiên phát hành, nhưng việc hỗ trợ cho các mô hình hiện tại vẫn đang trong quá trình thực hiện.

Các dấu hiệu máy có thể đọc được sẽ được áp dụng trên toàn cầu cho các mô hình Claude được hỗ trợ, bao gồm Claude Platform (API), Claude, Claude Code, Claude Cowork và Claude Tag. Hai kỹ thuật đánh dấu khác nhau đang được sử dụng: đối với hình ảnh do Claude xử lý, C2PA — một tiêu chuẩn siêu dữ liệu nguồn gốc đã được Adobe, OpenAI và Google áp dụng — sẽ được áp dụng cho các tệp được hỗ trợ, nhưng quy trình đánh dấu văn bản do Claude tạo ra vẫn còn rất ít chi tiết.

Theo Anthropic, một "hình mờ không thể nhận thấy" được lồng trực tiếp vào văn bản do các mô hình Claude tạo ra mà không làm thay đổi ý nghĩa, chất lượng hoặc khả năng đọc của phản hồi từ chatbot. Anthropic không nêu tên hệ thống đóng dấu này, nhưng cho biết các hình mờ văn bản đó cũng sẽ được áp dụng khi các mô hình Claude được truy cập thông qua AWS, Google Cloud hoặc Microsoft Foundry.

"Vì hình mờ là một phần của văn bản, nó sẽ đi kèm với văn bản khi được sao chép và dán ở nơi khác, và có thể tồn tại qua một số chỉnh sửa," Anthropic cho biết trên trang hỗ trợ Claude. "Việc đóng dấu sẽ được áp dụng ở cấp độ mô hình, nghĩa là nó sẽ xuất hiện bất kể văn bản đó đến từ sản phẩm hay giao diện Claude nào."

Anthropic cũng đang nỗ lực cho phép người dùng và các bên thứ ba khác phát hiện các hình mờ và siêu dữ liệu nguồn gốc được nhúng trong nội dung do Claude tạo ra, và cho biết họ sẽ chia sẻ chi tiết về hệ thống phát hiện này trong các tài liệu kỹ thuật sắp tới. Hiện đã có một số công cụ được thiết kế để phát hiện siêu dữ liệu C2PA, bao gồm cả chatbot Gemini của Google, nhưng chưa rõ liệu chúng có hoạt động với các tệp do Claude tạo ra hay không. Tôi đã yêu cầu Anthropic làm rõ vấn đề này.

Đây là một bước tiến nữa hướng tới việc văn bản và hình ảnh do AI tạo ra được gắn thẻ rõ ràng trên các nền tảng trực tuyến, và là một chiến thắng tiềm năng cho những người muốn tránh tiêu thụ nội dung loại này. Những độc giả truyện fanfiction đã và đang xây dựng các hệ thống phát hiện sơ khai hơn để gắn cờ khi các công cụ Claude được sử dụng trong các tác phẩm fanwork trên AO3, nhưng các hệ thống đánh dấu này có thể được áp dụng rộng rãi hơn nhiều — nếu chúng thực sự hiệu quả.

Dữ liệu C2PA được biết là dễ dàng bị loại bỏ, đôi khi thậm chí vô tình khi phương tiện chứa nó được tải lên các nền tảng trực tuyến, và vẫn chưa rõ giải pháp đóng dấu văn bản của Anthropic mạnh mẽ đến mức nào. Ngay cả bản thân công ty cũng đang thận trọng cho rằng các hệ thống đánh dấu này còn lâu mới hoàn hảo, và bất kỳ nội dung nào thiếu các dấu hiệu có thể phát hiện được vẫn có thể bắt nguồn từ các mô hình AI tạo sinh.

Theo dõi các chủ đề và tác giả từ bài viết này để xem thêm các nội dung tương tự trên trang chủ cá nhân của bạn và nhận các bản cập nhật qua email.

STKB364_CLAUDE_A
AnthropicClaudeWatermarkMinh bạch AIBảo mật
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ The Verge AI. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.