Tin ngành
Tài liệu nội bộ rò rỉ: Microsoft và OpenAI thừa nhận AI gây 'thảm họa' cho ngành báo chí
(giờ Việt Nam)
Tóm tắt AI
Tài liệu nội bộ tiết lộ các lãnh đạo Microsoft và OpenAI từng cảnh báo việc dùng dữ liệu báo chí huấn luyện AI là 'vụ trộm quy mô lớn', đồng thời thừa nhận AI đang triệt tiêu lưu lượng truy cập, tạo ra vòng lặp hủy diệt đối với các cơ quan truyền thông.
Bản dịch AI
Theo tin từ IT ngày 18 tháng 9, khi các tổ chức tin tức như tờ The New York Times (Mỹ) tiếp tục thúc đẩy vụ kiện chống lại Microsoft và OpenAI liên quan đến vấn đề bản quyền dữ liệu đào tạo, một loạt tài liệu nội bộ trước đây được đánh dấu là mật của hai công ty này hiện đã được công khai. Các tài liệu này cho thấy sự lo ngại của chính nhân viên tại Microsoft và OpenAI về những tác động của AI.
Trong đó, Brent Hecht, Giám đốc bộ phận Khoa học Ứng dụng của Microsoft, từng cảnh báo trong một tài liệu nội bộ rằng việc sử dụng nội dung tin tức để đào tạo AI là một "vụ trộm quy mô lớn chưa từng có", thậm chí ông còn gọi đây là "vụ trộm sức lao động lớn nhất trong lịch sử nhân loại". Trong một tài liệu khác, Hecht cũng đặt nghi vấn về quan điểm của Microsoft và OpenAI cho rằng việc sử dụng nội dung tin tức để đào tạo AI thuộc phạm vi "Sử dụng hợp lý" (Fair Use), đồng thời cho rằng hành vi thu thập dữ liệu tin tức quy mô lớn có thể đi ngược lại với tinh thần của khái niệm "Sử dụng hợp lý".
Đồng thời, các tài liệu nội bộ của Microsoft cũng từng đề cập đến rủi ro được gọi là "vòng lặp hủy diệt" (doom loop), trong đó các sản phẩm AI liên tục làm giảm lưu lượng truy cập và doanh thu của các trang tin tức, cuối cùng dẫn đến việc các cơ quan báo chí cắt giảm sản xuất nội dung, khiến chính các mô hình AI mất đi nguồn thông tin đáng tin cậy.
Trên thực tế, dữ liệu nội bộ của Microsoft dường như đã phản ánh xu hướng này. Dữ liệu của Microsoft cho thấy tỷ lệ nhấp chuột của một số cơ quan báo chí liên quan đến vụ kiện đã giảm từ 83% đến 93%, trong khi các cơ quan khác giảm từ 51% đến 94%. Các cơ quan báo chí cũng dẫn chứng các báo cáo về việc tỷ lệ nhấp chuột từ kết quả tìm kiếm của ChatGPT thấp và lưu lượng truy cập của chính họ bị sụt giảm, cho rằng các chatbot AI đang dần thay thế nhu cầu truy cập trực tiếp vào các trang web tin tức của người dùng.
CEO Satya Nadella của Microsoft khi làm chứng cũng thừa nhận rằng chatbot có thể cung cấp thông tin trực tiếp cho người dùng ngay trên nền tảng AI, từ đó làm giảm nhu cầu truy cập vào các trang web tin tức gốc của người dùng. Ông cho biết, điều này tương đương với việc chatbot "lấy đi lượt nhấp chuột từ các trang tin tức" bằng cách cung cấp thông tin trực tiếp.
Bên trong OpenAI cũng tồn tại quan điểm tương tự. Nick Turley, người đứng đầu bộ phận ChatGPT, từng xác nhận trong nội bộ rằng việc sử dụng nội dung tin tức để đào tạo các sản phẩm AI thương mại và để các sản phẩm này thay thế các nhà cung cấp tin tức có thể gây ra "mối đe dọa sinh tồn" đối với các nhà xuất bản.
Turley cho rằng khi chatbot đã cung cấp thông tin trực tiếp, người dùng "không có lý do chính đáng" để nhấp vào các liên kết gốc. Trong các cuộc thảo luận nội bộ, ông còn mô tả chatbot là "về cơ bản có tính thay thế" và tin rằng khi năng lực sản phẩm được nâng cao, mối quan hệ thay thế này sẽ càng trở nên mạnh mẽ hơn.
IT lưu ý rằng, các cơ quan báo chí đứng đầu là The New York Times còn cáo buộc nhân viên nội bộ của Microsoft và OpenAI từ lâu đã nhận thức được rằng các sản phẩm AI có thể xuất ra nội dung có độ tương đồng cao với dữ liệu đào tạo. Phía nguyên đơn cho biết họ đã thực hiện nhiều thử nghiệm nhằm cố gắng khiến các sản phẩm AI của Microsoft và OpenAI tái hiện trực tiếp nội dung bài báo, và kết quả cho thấy đã xuất hiện tình trạng tái hiện các đoạn nội dung dài.
Về vấn đề này, các cơ quan báo chí liên quan cho rằng Microsoft và OpenAI đã không thực hiện đầy đủ các biện pháp để ngăn chặn những kết quả đầu ra này, thậm chí còn áp dụng các biện pháp khiến các cơ quan báo chí khó kiểm tra mô hình AI hơn. Trên thực tế, một tài liệu nội bộ của Brent Hecht, Giám đốc bộ phận Khoa học Ứng dụng của Microsoft, cho biết công ty đã phát triển một cơ chế lọc có thể khiến các đơn vị sở hữu bản quyền dữ liệu đào tạo "khó biết được nội dung nào đã được sử dụng để đào tạo".
Đối với những cáo buộc trên, người phát ngôn của Microsoft phản hồi rằng các sản phẩm AI của Microsoft thuộc phạm vi sử dụng hợp lý có tính chuyển đổi và sẽ không thay thế các trang web tin tức. Microsoft cũng cho biết tài liệu nội bộ của Hecht chỉ đại diện cho quan điểm cá nhân của một nhân viên, không phải là phân tích pháp lý và cũng không đại diện cho lập trường của công ty Microsoft. Trong khi đó, tính đến thời điểm đưa tin, OpenAI vẫn chưa phản hồi yêu cầu bình luận về vấn đề này.
Bài viết được AI dịch và tổng hợp tự động từ IT Home ITHome. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.