IT Home ITHome
88

Tin ngành

Vụ kiện bản quyền OpenAI: GPT-5 bị cáo buộc có khả năng 'viết hộ' tiểu thuyết của George R.R. Martin

(giờ Việt Nam)

Tóm tắt AI

Các tác giả đang kiện OpenAI vì sử dụng trái phép dữ liệu từ LibGen để huấn luyện AI, đồng thời tiết lộ nhân viên OpenAI từng đặt mục tiêu để GPT-5 hoàn thiện bộ tiểu thuyết 'A Song of Ice and Fire'.

Bản dịch AI

Theo tin từ IT ngày 9 tháng 9, trang tin công nghệ torrentfreak hôm qua (8 tháng 9) đã đăng tải bài viết cho biết nhiều tác giả sách trong tuần này đã đệ trình kiến nghị phán quyết tóm tắt lên Tòa án Liên bang New York, yêu cầu thẩm phán xác định OpenAI đã sao chép tác phẩm mà không được phép, đồng thời khẳng định hành vi này không cấu thành "sử dụng hợp lý" (fair use).

Vụ kiện này bắt nguồn từ vụ kiện tập thể do Hiệp hội Tác giả Hoa Kỳ (Authors Guild) khởi xướng chống lại OpenAI và Microsoft vào năm 2023, trong đó hiệp hội này lập luận rằng OpenAI đã tự ý sử dụng tác phẩm của các tác giả liên quan để huấn luyện AI mà không có sự cho phép.

Theo các tài liệu được tiết lộ, kiến nghị liên quan đến 194 đầu sách, hiện đang tìm kiếm sự xác nhận về trách nhiệm pháp lý chứ chưa yêu cầu phán quyết về số tiền bồi thường. Các tác giả cáo buộc OpenAI từng lấy sách từ LibGen và trong bài báo nghiên cứu về GPT-3, họ đã đổi tên "Libgen1", "Libgen2" thành "Books1", "Books2". Nguyên đơn cho rằng việc thay đổi tên gọi này nhằm mục đích làm mờ đi mối liên hệ giữa dữ liệu huấn luyện và LibGen.

Tác giả của bộ tiểu thuyết "A Song of Ice and Fire" (tạm dịch: Khúc ca của băng và lửa), ông George R. R. Martin, là một trong những nguyên đơn của vụ kiện này. Bộ tiểu thuyết sau đó đã được HBO chuyển thể thành loạt phim truyền hình "Game of Thrones" (Trò chơi vương quyền).

Trong kiến nghị, các nguyên đơn đã trích dẫn bài đăng công khai của nhân viên OpenAI là Tarun Gogineni làm bằng chứng. OpenAI đã thuê Gogineni vào năm 2022 để phụ trách việc nâng cao chất lượng viết lách của các mô hình; nguyên đơn cho rằng ông này biết rõ các mô hình liên quan có thể gây ảnh hưởng đến nghề nghiệp của các tác giả và gọi tác động này là "sự gián đoạn kinh tế có thể chấp nhận được".

Vào năm 2025, tức gần 2 năm sau khi Martin khởi kiện, Gogineni đã đăng bài cho biết "nhiệm vụ nghiên cứu" của ông là để mô hình GPT viết ra "2 cuốn sách cuối cùng" của bộ "A Song of Ice and Fire". Ông còn giả định thêm rằng ngay cả khi Martin qua đời, GPT-5 cũng có thể "tự động hoàn thiện" loạt tác phẩm này. IT đính kèm ảnh chụp màn hình liên quan như sau:

Vụ kiện cũng liên quan đến Microsoft, các tác giả lập luận rằng Microsoft có khả năng giám sát các hành vi liên quan của OpenAI và hưởng lợi từ đó, do đó phải chịu trách nhiệm liên đới. Hồ sơ vụ kiện cho biết, thông qua 3 thỏa thuận ký kết vào các năm 2019, 2021 và 2023, Microsoft đã đầu tư tổng cộng khoảng 13 tỷ USD vào OpenAI (IT chú thích: theo tỷ giá hiện tại tương đương khoảng 87,467 tỷ Nhân dân tệ).

Kiến nghị cho biết, vào mùa hè năm 2022, OpenAI đã xóa các tệp LibGen do lo ngại về pháp lý. Đây được cho là 2 tập dữ liệu duy nhất mà OpenAI từng xóa trong số các kho ngữ liệu huấn luyện của mình. Dựa vào đó, nguyên đơn lập luận rằng các mô hình GPT đời đầu đã sử dụng những tài liệu này, và vấn đề nguồn gốc dữ liệu không thể bị triệt tiêu bởi mục đích huấn luyện.

Cùng ngày, OpenAI đã đệ trình kiến nghị phản tố, lập luận rằng việc họ sử dụng sách để huấn luyện mô hình thuộc phạm vi "sử dụng hợp lý" theo quy định của pháp luật.

Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ IT Home ITHome. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.