IT Home
92

Tin ngành

New York Times kiện OpenAI: Cáo buộc sao chép trái phép hàng triệu bài báo để huấn luyện AI

(giờ Việt Nam)

Tóm tắt AI

New York Times cáo buộc OpenAI cố tình sao chép hàng triệu bài báo có bản quyền để huấn luyện mô hình AI, gây thiệt hại nghiêm trọng đến lưu lượng truy cập của các nhà xuất bản. Vụ kiện đòi bồi thường hàng tỷ USD trong bối cảnh tranh cãi về quyền sử dụng dữ liệu đào tạo AI.

Bản dịch AI

Theo giờ Bắc Kinh ngày 18 tháng 9, dựa trên các tài liệu pháp lý mới nhất được đệ trình bởi The New York Times, OpenAI đã sao chép hàng triệu bài báo có bản quyền dù biết rõ hành động này gây ra "mối đe dọa hiện hữu" đối với các nhà xuất bản, nhằm xây dựng công nghệ AI với giá trị tiềm năng lên tới con số "thiên văn".

Hiện tại, The New York Times và các cơ quan truyền thông khác đang yêu cầu OpenAI bồi thường thiệt hại hàng tỷ USD. Trọng tâm của vụ kiện này là liệu OpenAI và đồng bị đơn Microsoft có vi phạm luật bản quyền thông qua việc sử dụng nội dung của các nhà xuất bản để huấn luyện mô hình của họ hay không.

Các luật sư của The New York Times cho biết OpenAI được thúc đẩy bởi lợi ích thương mại nên đã thu thập một lượng lớn nội dung của tờ báo này. Họ cáo buộc rằng đồng sáng lập OpenAI, Greg Brockman, từng viết vào khoảng năm 2017 rằng ông "bị thúc đẩy sâu sắc bởi những khối tài sản khổng lồ" và hy vọng đạt được số tài sản đó thông qua việc thương mại hóa công nghệ của OpenAI.

Các tài liệu được The New York Times đệ trình vào thứ Năm đã tiết lộ những bằng chứng mới. Đây là một trong những vụ kiện được chú ý nhất trong hàng chục vụ kiện mà các chủ sở hữu bản quyền đã khởi xướng chống lại các công ty AI. Các chủ sở hữu bản quyền cáo buộc những công ty này đã chiếm dụng tài liệu liên quan để huấn luyện các mô hình AI, vốn đang đe dọa đến công việc của những người sáng tạo nội dung là con người.

OpenAI luôn lập luận rằng theo luật bản quyền, việc sử dụng nội dung công khai để huấn luyện mô hình thuộc phạm vi "sử dụng hợp lý" (fair use), một cơ sở pháp lý tương tự như lý do mà các công cụ tìm kiếm sử dụng khi truy cập vào nội dung liên quan. Công ty cho biết các mô hình ngôn ngữ lớn của họ chuyển đổi nội dung gốc thay vì sao chép chúng, và sẽ không trở thành sản phẩm thay thế cho The New York Times hay các ấn phẩm khác.

Tuy nhiên, các luật sư của The New York Times cho rằng: "Các bị đơn đã nhiều lần sao chép toàn bộ hàng triệu bài báo có bản quyền mà không được phép, nhằm phát triển các sản phẩm AI thương mại có tính chất thay thế".

Luật sư của The New York Times cũng cho biết OpenAI đã thực hiện điều này trong khi biết rõ các công cụ AI của họ có khả năng thay thế tài liệu gốc. Theo tài liệu đệ trình hôm thứ Năm, người đứng đầu bộ phận ChatGPT của OpenAI từng viết rằng các sản phẩm AI gây ra "mối đe dọa hiện hữu" đối với các nhà xuất bản, những sản phẩm này "phần lớn có tính thay thế, đơn giản là vậy, và khi chúng càng trở nên tốt hơn thì tính thay thế sẽ càng mạnh mẽ hơn".

Vụ kiện cũng trích dẫn lời của Brent Hecht, Giám đốc Khoa học Ứng dụng tại Microsoft. Ông Hecht được cho là đã viết rằng việc huấn luyện các mô hình ngôn ngữ lớn bằng nội dung có bản quyền là "một vụ trộm kinh ngạc với quy mô chưa từng có", và việc thắng kiện trong vụ án này sẽ "biến khái niệm 'sử dụng hợp lý' thành trò cười".

Microsoft phát hiện ra rằng so với các công cụ tìm kiếm truyền thống, người dùng sử dụng công cụ trả lời bằng AI của họ có tỷ lệ nhấp vào nội dung gốc thấp hơn từ 83% đến 93%.

Trong một tuyên bố, Microsoft cho biết: "Những nhận xét này phản ánh quan điểm cá nhân của một nhân viên, không phải là một phân tích pháp lý".

Các tài liệu pháp lý cũng cáo buộc rằng OpenAI đã sử dụng các biện pháp "vượt ranh giới và mang tính lừa dối" để lấy nội dung sau tường phí (paywall), và Brockman - người hiện là Chủ tịch OpenAI và thực tế là nhân vật số hai của công ty - đã biết về hành vi này vào thời điểm đó. Tài liệu cho biết khi một nhân viên nói với Brockman rằng "có cách để vượt qua tường phí của The New York Times", Brockman đã trả lời: "À, tốt đấy".

Trong lời khai cho vụ án, CEO Microsoft Satya Nadella cho biết nếu lúc đó "biết OpenAI thu thập và sử dụng thông tin sau tường phí để huấn luyện", ông sẽ thực hiện quyền của Microsoft theo thỏa thuận giữa hai công ty vào thời điểm đó để yêu cầu OpenAI "huấn luyện lại các mô hình của họ".

Microsoft cho biết hôm thứ Năm rằng lời khai của Nadella "đề cập đến các nguyên tắc rộng lớn và những thay đổi trong cách mọi người tìm kiếm và tiêu thụ thông tin", chứ không phải là "kết luận về vấn đề bản quyền" cốt lõi của vụ án.

OpenAI chưa phản hồi ngay lập tức yêu cầu bình luận. Công ty trước đó từng tuyên bố: "Vụ kiện này không phải là cuộc chiến giữa sáng tạo của con người và AI, mà là việc The New York Times muốn tìm kiếm một khoản lợi nhuận bất chính bằng cách hy sinh sự tiến bộ mang lại lợi ích cho tất cả mọi người".

OpenAIBản quyềnNew York TimesPháp lý AITin tức AI
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ IT Home. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.