Tin ngành
Meta tự phát triển hệ thống phát hiện AI: Tại sao không dùng luôn công nghệ của Google?
(giờ Việt Nam)
Tóm tắt AI
Thay vì tận dụng các giải pháp sẵn có, Meta đã ra mắt Content Seal để gắn watermark cho ảnh AI. Tuy nhiên, giới chuyên gia đặt dấu hỏi về tính hiệu quả khi so sánh với công nghệ SynthID của Google.
Bản dịch AI

Vào tháng 3, Hội đồng Giám sát của Meta đã kêu gọi công ty “thực hiện các cam kết công khai và sử dụng các công cụ của chính mình” để giúp ngăn chặn sự lan truyền của nội dung AI tạo sinh mang tính lừa đảo trên các nền tảng. Meta đã phản hồi vào tháng 7 bằng cách giới thiệu Content Seal — một công nghệ đóng dấu chìm (watermarking) vô hình giúp gắn cờ các hình ảnh được tạo ra bởi mô hình AI mới của công ty. Tuy nhiên, thông tin này thực chất chỉ là một chú thích nằm khuất trong thông báo của công ty về các công cụ tạo hình ảnh và video Muse.
Là một người dành nhiều thời gian để xem xét kỹ lưỡng các hệ thống dán nhãn AI, Content Seal không mang lại cho tôi sự tin tưởng. Đã có những giải pháp uy tín hơn như C2PA Content Credentials và SynthID của Google mà Meta hoàn toàn có thể sử dụng thay vì tung ra hệ thống riêng của mình một cách chậm trễ như vậy. Sau khi tìm hiểu lý do tại sao Meta lại ra mắt hệ thống riêng, tôi không tin rằng Meta đã suy nghĩ thấu đáo về vấn đề này.
Theo mô tả của Meta, Content Seal hoạt động tương tự như SynthID. Dấu chìm này, vốn vô hình với mắt người, cung cấp một “tín hiệu nguồn gốc ẩn” được nhúng vào các hình ảnh do AI tạo ra, sau đó có thể được quét và gắn cờ bởi một công cụ phát hiện, giúp người dùng trực tuyến phân biệt deepfake với nội dung xác thực. Giống như SynthID, Meta cũng cho biết các dấu chìm Content Seal vẫn còn nguyên vẹn và có thể được phát hiện ngay cả khi hình ảnh bị “cắt, nén, thay đổi kích thước hoặc chụp màn hình”.
Vậy, nếu Content Seal có chức năng tương tự… tại sao không chỉ đơn giản là áp dụng SynthID? Meta hiện đã là thành viên ban chỉ đạo của Liên minh Xác thực và Nguồn gốc Nội dung (C2PA) – tổ chức thúc đẩy tiêu chuẩn Content Credentials riêng biệt cùng với Google, vì vậy công ty đã cho thấy sự sẵn lòng hợp tác với các bên khác để giải quyết vấn đề phát hiện AI đang ngày càng gia tăng. SynthID cũng đã được OpenAI áp dụng, vì vậy rõ ràng Google cũng sẵn sàng mở công nghệ của mình cho các nhà cung cấp AI đối thủ vì mục tiêu cải thiện tính minh bạch.
Content Seal hiện có một số hạn chế dù có những điểm tương đồng với hệ thống của Google. Hiện tại, người dùng chỉ có thể phát hiện dấu chìm Content Seal thông qua một công cụ web chuyên dụng mà Meta đang thử nghiệm, nghĩa là Meta chưa tích hợp các khả năng phát hiện đó vào chatbot Meta AI như cách Google đã làm với Gemini. Tuy nhiên, có vẻ như điều này đang được triển khai. Người phát ngôn của Meta, Faith Eischen, nói với The Verge rằng công ty đang “khám phá các cách để đưa tính năng phát hiện đến gần hơn với nơi người dùng tiếp cận nội dung do AI tạo ra”. Xét thấy đây là nơi cần phát hiện AI nhất và đã cần từ lâu, tại sao nó lại không có sẵn ngay khi ra mắt?
Bản thân dấu chìm cũng chỉ được áp dụng cho các hình ảnh do Muse tạo ra trong ứng dụng Meta AI và trang web Meta.ai, nghĩa là người dùng trực tuyến không thể sử dụng nó để phát hiện nội dung được tạo bởi các mô hình AI cũ hơn của Meta. Hỗ trợ cho video được tạo cũng chưa có sẵn, mặc dù Meta cho biết tính năng này sẽ sớm ra mắt.


1/2 Đây là thông tin được hiển thị khi công cụ phát hiện của Meta gắn cờ thành công một hình ảnh được tạo hoặc chỉnh sửa bằng mô hình Muse của chính họ. Hình ảnh: Jess Weatherbed / The Verge
Meta đã áp đặt giới hạn hàng ngày về số lần bạn có thể kiểm tra hình ảnh bằng Content Seal thông qua công cụ phát hiện của họ. Eischen cho biết giới hạn này được thiết kế để hỗ trợ “sử dụng bình thường” đồng thời bảo vệ hệ thống phát hiện khỏi bị lạm dụng. Meta không làm rõ hành vi lạm dụng đó trông như thế nào — có lẽ là các nỗ lực bẻ khóa hệ thống để tránh bị phát hiện nội dung có dấu chìm — nhưng các công cụ phát hiện của Google và OpenAI cũng có những giới hạn tương tự. C2PA nổi bật là hệ thống duy nhất không giới hạn số lần người dùng có thể kiểm tra nội dung. Bất kỳ giới hạn nào đối với việc phát hiện đều đi ngược lại với mục tiêu cải thiện tính minh bạch của AI trên quy mô lớn, vì vậy đây có vẻ là một cơ hội bị bỏ lỡ để hệ thống của Meta làm tốt hơn SynthID.
Trên các nền tảng của riêng Meta như Facebook và Instagram vốn áp dụng nhãn AI, Eischen cho biết siêu dữ liệu không xác định “cùng với dấu chìm Content Seal” đang được sử dụng để giúp người dùng nhận diện nội dung do AI tạo ra. Khi tôi hỏi Meta liệu họ có đang hướng dẫn các nền tảng trực tuyến khác như TikTok và LinkedIn (những nơi quét và dán nhãn nội dung AI) về cách phát hiện Content Seal hay không, Eischen cho biết công ty “quyết tâm làm việc với các đối tác trong ngành để đảm bảo người dùng có trải nghiệm tốt nhất có thể”.
Điều đó cho thấy sự hỗ trợ rộng rãi hơn cho tiêu chuẩn này vẫn đang trong quá trình thực hiện, điều này có thể ngăn cản việc các hình ảnh do Muse tạo ra được dán nhãn hiệu quả bên ngoài các nền tảng của Meta. Khi tôi đưa một hình ảnh thử nghiệm mà tôi tạo bằng mô hình Muse của Meta vào Gemini và cổng phát hiện C2PA chính thức, không công cụ nào có thể xác nhận đó là do AI tạo ra. Ngoài ra còn có câu hỏi liệu Content Seal có thể được áp dụng cho các tệp hình ảnh và video cùng với SynthID và Content Credentials mà không gây xung đột với các tiêu chuẩn khác hay không. Meta đã không đưa ra bất kỳ làm rõ nào về vấn đề này trên hồ sơ.

“Giống như những bên khác, chúng tôi xây dựng Content Seal dựa trên các thông số kỹ thuật và sản phẩm của riêng mình. Cần nhiều phương pháp phối hợp cùng nhau để giải quyết vấn đề này trên toàn hệ sinh thái và chúng tôi rất vui khi được đóng góp vào nỗ lực đó,” Eischen nói. “Chúng tôi sẽ sớm chia sẻ thêm về Content Seal.”
Với việc Content Seal chỉ có thể phát hiện các hình ảnh được tạo bằng mô hình AI mới nhất của Meta, tôi tự hỏi công ty đã làm gì trong suốt thời gian qua. Meta đã cung cấp các công cụ tạo hình ảnh AI từ năm 2023, vì vậy họ đã tạo ra rất nhiều nội dung giả mạo không thể bị phát hiện bởi hệ thống độc quyền của chính mình. Họ cũng đã giới thiệu các thẻ AI cho Instagram và Facebook vào năm 2023, điều này đã khiến nhiều nhiếp ảnh gia tức giận vào thời điểm đó vì dán nhãn sai các bức ảnh thật là “Made by AI”.
Ba năm trôi qua, Meta vẫn chưa chắc chắn về cách định vị mình vừa là một nhà máy sản xuất nội dung AI, vừa là giải pháp để nhận diện chúng, đặc biệt là trên chính các nền tảng của mình. Ngay cả ban lãnh đạo cấp cao tại Meta dường như cũng lúng túng không biết nên làm gì tiếp theo.
Trong một cuộc phỏng vấn trên podcast của Lenny Rachitsky, người đứng đầu Instagram, Adam Mosseri, ban đầu ủng hộ ý tưởng rằng những người không thích nội dung do AI tạo ra nên được phép loại bỏ chúng khỏi nguồn cấp dữ liệu xã hội của họ — điều này nghe rất giống một tính năng lọc đòi hỏi một hệ thống dán nhãn AI đáng tin cậy. Ông thậm chí còn gợi ý rằng tính xác thực sẽ trở nên đáng khao khát hơn như một thứ mà AI không thể cung cấp.
“Trong một thế giới tràn ngập nội dung tổng hợp, tôi thực sự nghĩ rằng mọi người sẽ tìm kiếm sự sáng tạo, tính xác thực và con người nhiều hơn chứ không phải ít đi,” Mosseri nói.
“Tôi không nghĩ chúng ta nên lọc bỏ nội dung AI”
Tuy nhiên, trong cùng cuộc phỏng vấn đó, Mosseri nói “Tôi không nghĩ chúng ta nên lọc bỏ nội dung AI”, đồng thời khẳng định rằng “chúng ta nên cho bạn biết liệu nội dung đó có phải là nội dung AI hay không”. Mosseri cũng nhắc lại quan điểm mà ông từng bày tỏ trước đây rằng có thể “thực tế hơn khi gắn dấu vân tay cho phương tiện truyền thông thực thay vì phương tiện truyền thông giả”. Điều đó không làm cho Meta có vẻ tự tin vào khả năng phát triển một hệ thống dán nhãn AI khả thi của chính mình. Họ đã có rất nhiều thời gian để làm điều đó giữa việc biến các nền tảng xã hội của mình thành những nhà máy sản xuất nội dung rác như “shrimp Jesus” và các nội dung gây suy giảm trí tuệ khác, nhưng việc ra mắt Content Seal vẫn mang lại cảm giác như một sự vội vã.
Nó không mang lại lợi ích độc đáo nào cho người tiêu dùng so với hệ thống SynthID tương tự đã được thiết lập, mà thay vào đó chỉ tạo thêm một rào cản nữa mà mọi người phải vượt qua để xác minh nội dung AI. Có lẽ Meta nên áp dụng tiêu chuẩn đóng dấu chìm của Google thay vì tự làm, giống như cách OpenAI đã làm. Người dùng Facebook và Instagram có lẽ sẽ được hưởng lợi nhiều hơn nếu họ làm vậy. Eischen nói với tôi rằng Meta đã đóng góp nghiên cứu về đóng dấu chìm mã nguồn mở trong nhiều năm nay, vì vậy họ không tạo ra công nghệ này chỉ sau một đêm, nhưng tôi mong đợi một trải nghiệm người dùng tốt hơn từ kết quả đó.
Nếu Meta muốn dựa vào các giải pháp của riêng mình, họ sẽ cần nhiều hơn một bản sao SynthID nửa vời để chứng minh rằng họ thực sự nghiêm túc về tính minh bạch của AI — ít nhất là một hệ thống đáng tin cậy hơn. Reuters đã phát hiện ra rằng Content Seal không thể phát hiện hơn một nửa số hình ảnh do Muse tạo ra mà họ đã thử nghiệm sau khi chúng bị cắt xén.
Theo dõi các chủ đề và tác giả từ bài viết này để xem thêm các nội dung tương tự trong nguồn cấp dữ liệu trang chủ cá nhân của bạn và nhận cập nhật qua email.
Bài viết được AI dịch và tổng hợp tự động từ The Verge AI. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.