Tin ngành
New York Times và các đơn vị truyền thông kiện OpenAI, Microsoft vi phạm bản quyền dựa trên bằng chứng nội bộ
(giờ Việt Nam)
Tóm tắt AI
Nhóm truyền thông lớn đã nộp đơn yêu cầu phán quyết tóm tắt, sử dụng các email và lời khai nội bộ của OpenAI và Microsoft để bác bỏ lập luận 'sử dụng hợp lý' trong vụ kiện bản quyền AI trị giá hàng tỷ USD.
Bản dịch AI

Một hồ sơ tòa án mới do The New York Times và các nguyên đơn khác đệ trình đã trích dẫn các email nội bộ và lời khai có tuyên thệ trước đây chưa từng được công bố từ các giám đốc điều hành của OpenAI và Microsoft.
The New York Times cùng một số công ty truyền thông khác đã đệ trình một bản tóm tắt yêu cầu phán quyết rút gọn lên Tòa án Quận Hoa Kỳ tại New York. Tham gia cùng The Times là tập đoàn Daily News (bao gồm Chicago Tribune và Denver Post) và Ziff Davis (sở hữu CNET, IGN và PCMag). Các nguyên đơn còn bao gồm Center for Investigative Reporting, đơn vị chủ quản của Mother Jones và The Intercept.
Theo Financial Times, các nguyên đơn đang yêu cầu bồi thường thiệt hại hàng tỷ đô la. Bản tóm tắt dài 92 trang này là một phần của vụ kiện đa quận hợp nhất, tập hợp nhiều vụ kiện khác nhau, bắt đầu từ vụ kiện của The New York Times được đệ trình vào tháng 12 năm 2023.
Các tuyên bố nội bộ của giới điều hành làm suy yếu lập luận về "sử dụng hợp lý" (fair use)
Bản tóm tắt dựa trên các email nội bộ, tin nhắn Slack và lời khai có tuyên thệ được tiết lộ trong quá trình thu thập chứng cứ, bao gồm cả những tuyên bố làm suy yếu lập luận về "sử dụng hợp lý" của các công ty AI.
Giám đốc khoa học ứng dụng của Microsoft, Brent Hecht, đã gọi hành vi này là "một vụ trộm đáng kinh ngạc với quy mô chưa từng có" và có khả năng là "vụ trộm sức lao động lớn nhất trong lịch sử nhân loại". Ông cũng viết rằng một lập luận "sử dụng hợp lý" thành công có thể "biến khái niệm 'sử dụng hợp lý' thành một trò hề". Microsoft nói với Financial Times rằng những bình luận này "phản ánh quan điểm cá nhân của một nhân viên" và "không phải là một phân tích pháp lý".
Văn phòng Bản quyền Hoa Kỳ cũng kết luận vào tháng 5 năm 2025 rằng "sử dụng hợp lý" không thể áp dụng rộng rãi do quy mô khổng lồ mà các công ty AI sao chép dữ liệu. Quan chức giám sát báo cáo này sau đó đã bị chính quyền Trump sa thải.
Theo bản tóm tắt, Nick Turley, người đứng đầu bộ phận ChatGPT của OpenAI, đã viết rằng các nhà xuất bản đang phải đối mặt với một "mối đe dọa hiện hữu". Ông cho biết các sản phẩm này "về cơ bản là thay thế, chấm hết" và sẽ ngày càng thay thế các sản phẩm của nhà xuất bản "khi chúng trở nên tốt hơn". Một kỹ sư của OpenAI nói thêm rằng "dù chúng tôi hiển thị các liên kết nổi bật đến đâu, người dùng cũng sẽ không nhấp vào".
CEO Satya Nadella của Microsoft đã xác nhận dưới tuyên thệ rằng các cuộc trò chuyện với chatbot đã thay thế việc truy cập vào các nguồn tin gốc. Trong một tuyên bố gửi tới FT, Microsoft cho biết lời khai của ông liên quan đến "các nguyên tắc rộng lớn và những thay đổi đang diễn ra trong cách mọi người tìm kiếm và tiêu thụ thông tin". Công ty cho biết đây không phải là "kết luận về các câu hỏi bản quyền" vốn là trọng tâm của vụ kiện.
Một tài liệu nội bộ của Microsoft mô tả một chu kỳ tự củng cố mà họ gọi là "vòng lặp diệt vong" (doom loop).
Chiến lược nội dung AI của chúng tôi đã khởi đầu một 'vòng lặp diệt vong' gây tổn hại đến hiệu suất của các mô hình và toàn bộ web cùng một lúc: Thật vô cùng bất thường khi một sản phẩm cuối cùng lại đe dọa nền tảng kinh tế của các nhà cung cấp thiết yếu của chính nó, nhưng đó là tình thế mà chúng tôi đã tạo ra cho hoạt động kinh doanh LLM của mình đối với 'chuỗi cung ứng nội dung'.
Dữ liệu của chính Microsoft cho thấy tỷ lệ nhấp (CTR) trên Copilot thấp hơn nhiều so với tìm kiếm Bing truyền thống. Tỷ lệ này giảm từ 87 đến 93 phần trăm đối với The New York Times, 83 đến 91 phần trăm đối với tập đoàn Daily News và 51 đến 94 phần trăm đối với Ziff Davis.
OpenAI nội bộ mô tả tin tức địa phương, một mảng kinh doanh cốt lõi của tập đoàn Daily News, là một "truy vấn khá phổ biến" trong ChatGPT. Các nghiên cứu khác cũng phát hiện ra rằng câu trả lời của chatbot làm giảm mạnh lưu lượng truy cập vào web mở.
Đồng sáng lập OpenAI, Greg Brockman, đã thảo luận về khả năng xử lý tin tức của các mô hình trong một tin nhắn nội bộ.
nhân tiện thì chúng ta rất giỏi về tin tức. mỗi khi tôi làm bất cứ thứ gì mang tính tạo sinh trên NYT, nó dường như dự đoán câu tiếp theo khá tốt.
Các biện pháp vượt tường phí và hạn chế về giấy phép làm phức tạp thêm lập luận bào chữa của OpenAI
Các nguyên đơn mô tả cách OpenAI vượt tường phí một cách có hệ thống và phớt lờ các điều khoản dịch vụ. Khi một nhân viên nói với Brockman về "một thủ thuật để vượt qua tường phí của nytimes", ông đã trả lời "à hay đấy". Khoảng năm 2017, Brockman cũng viết rằng ông "cực kỳ có động lực bởi hàng tỷ đô la" mà ông hy vọng kiếm được từ việc thương mại hóa công nghệ của OpenAI.
Đại diện doanh nghiệp của OpenAI làm chứng rằng ông không biết phương pháp nào để phát hiện nội dung có tường phí trong dữ liệu huấn luyện và không có nỗ lực nào để loại bỏ nó. Quy trình thu thập dữ liệu (crawling) tiêu chuẩn của công ty "không bao gồm việc xem xét Điều khoản Sử dụng hoặc Dịch vụ của các trang web".
Nadella làm chứng dưới tuyên thệ rằng "bất cứ thứ gì có tường phí đều nên được cấp phép bởi bất kỳ ai muốn sử dụng nó". Ông nói rằng ông đã buộc OpenAI phải huấn luyện lại các mô hình của mình nếu biết công ty đã thu thập nội dung có tường phí và sử dụng nó để huấn luyện.
OpenAI cũng đã mua lại "New York Times Annotated Corpus", một bộ sưu tập gồm 1,8 triệu bài báo, thông qua một bên thứ ba. Giấy phép của nó hạn chế việc sử dụng vào mục đích "giáo dục ngôn ngữ phi thương mại, nghiên cứu và phát triển công nghệ". Các nhân viên OpenAI biết rằng việc sử dụng bộ dữ liệu này để huấn luyện các mô hình "sẽ không phù hợp", nhưng vẫn thực hiện.
Các nguyên đơn cáo buộc OpenAI che giấu bằng chứng và thách thức cả bốn yếu tố của "sử dụng hợp lý"
Theo bản tóm tắt, ngay sau khi các vụ kiện được đệ trình, OpenAI đã xây dựng một bộ lọc để ngăn chặn đầu ra có khả năng cao được lấy từ các ấn phẩm của nguyên đơn. Nội dung từ các công ty không kiện vẫn không bị ảnh hưởng. Các nguyên đơn lập luận rằng bộ lọc này không được thiết kế để bảo vệ bản quyền mà để ngăn họ thu thập bằng chứng.
Hecht của Microsoft đã bày tỏ lo ngại rằng OpenAI có thể triển khai một bộ lọc như vậy, gọi đó là một "sự che đậy vô tình". Ông cảnh báo rằng điều đó sẽ dẫn đến việc "những người có quyền đối với nội dung có ít khả năng giám sát hơn về những gì đã được sử dụng để huấn luyện". Mặc dù vậy, bản tóm tắt vẫn bao gồm nhiều ví dụ về các đầu ra có vấn đề, với việc ChatGPT tái tạo các bản sao chính xác và tóm tắt các bài báo của NYT theo yêu cầu, bao gồm cả các bài báo nằm sau tường phí.
Các nguyên đơn cũng lập luận rằng lập luận "sử dụng hợp lý" thất bại trên cả bốn yếu tố theo luật định. Họ cho rằng việc sử dụng này mang tính thay thế và thương mại thay vì mang tính chuyển đổi, trong khi các bài báo là những tác phẩm biểu đạt nằm ở cốt lõi của bảo hộ bản quyền. Các bị đơn cũng sao chép toàn bộ tác phẩm, mặc dù các chuyên gia của chính họ thừa nhận rằng không có tác phẩm đơn lẻ nào là cần thiết.
Về tác hại thị trường, các nguyên đơn chỉ ra các thị trường cấp phép hiện có và những thị trường có thể phát triển trên thực tế. OpenAI và Microsoft đã ký các thỏa thuận cấp phép với các nhà xuất bản khác, cũng như Amazon, Google, Meta và Perplexity. Tuy nhiên, thay vì trả tiền cho nội dung của các nguyên đơn, các bị đơn đã lấy nó miễn phí và trao đổi với nhau, bản tóm tắt lập luận.
Một thị trường cấp phép đang hoạt động khiến lập luận "sử dụng hợp lý" trở nên khó duy trì hơn. Các bị đơn không thể khẳng định một cách đáng tin cậy rằng việc cấp phép là không thể khi họ đã trả tiền cho nội dung tương đương từ các nhà xuất bản khác.
AI có thể tạo ra một triệu bài báo "rác" (pink slime) với giá 6.800 đô la
Các nguyên đơn cũng thách thức lập luận rằng các mô hình AI không cạnh tranh với các nhà xuất bản, làm suy yếu thêm lập luận "sử dụng hợp lý". Họ lập luận rằng các sản phẩm của OpenAI cho phép người dùng làm tràn ngập thị trường bằng "pink slime", nghĩa là các tin tức giả chất lượng thấp, thường là đạo văn. Với giá API của OpenAI, việc tạo ra một triệu bài báo kiểu tin tức, mỗi bài 500 từ, có giá khoảng 6.800 đô la mà không cần đến một nhà báo nào. Bản tóm tắt trích dẫn Prism News, đơn vị chỉ sử dụng bốn nhân viên để vận hành 200 ấn phẩm do AI tạo ra dưới danh nghĩa các tòa soạn tin tức địa phương và các trang web sở thích.
OpenAI đã công bố một công cụ có tên "Media Manager" vào năm 2024, được cho là cho phép các nhà xuất bản từ chối việc thu thập dữ liệu. Theo bản tóm tắt, dự án này đã bị hủy bỏ.
Các nguyên đơn đang yêu cầu tòa án xác định hành vi vi phạm bản quyền và bác bỏ lập luận "sử dụng hợp lý". Họ cũng muốn mỗi bài báo được coi là một tác phẩm riêng biệt khi tính toán bất kỳ khoản bồi thường thiệt hại theo luật định nào.
Các phán quyết của tòa án trước đây đã nghiêng về phía "sử dụng hợp lý", và Bộ Tư pháp Hoa Kỳ, dưới chính quyền Trump, cũng đã đứng về phía các phòng thí nghiệm AI. OpenAI và Microsoft có khả năng sẽ sớm trình bày quan điểm của họ, tập trung vào "sử dụng hợp lý" và tính chất chuyển đổi trong công việc của họ. Các tài liệu nội bộ hiện đã được công khai sẽ không làm cho lập luận đó trở nên dễ dàng hơn.

Bài viết được AI dịch và tổng hợp tự động từ The Decoder: AI News. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.