Tin ngành
Microsoft khẳng định Copilot hiếm khi sao chép nội dung từ New York Times
(giờ Việt Nam)
Tóm tắt AI
Trong hồ sơ pháp lý mới, Microsoft cho biết Copilot rất ít khi trích dẫn nguyên văn các bài báo hay sách, bác bỏ cáo buộc vi phạm bản quyền từ New York Times và các tác giả.
Bản dịch AI


Lauren Feiner
là phóng viên chính sách cấp cao tại The Verge, chuyên đưa tin về sự giao thoa giữa Thung lũng Silicon và Đồi Capitol. Cô đã dành 5 năm đưa tin về chính sách công nghệ tại CNBC, viết về các vấn đề chống độc quyền, quyền riêng tư và cải cách kiểm duyệt nội dung.
Microsoft cho biết trong các hồ sơ pháp lý mới khi đấu tranh với các cáo buộc vi phạm bản quyền từ các nhà xuất bản như The New York Times và các tác giả sách rằng, Copilot của họ hiếm khi sao chép lại dù chỉ là những câu hoàn chỉnh từ các bài báo và sách, chứ chưa nói đến những đoạn nội dung đáng kể có thể thay thế cho bản gốc.
Là một phần trong quá trình thu thập chứng cứ của vụ kiện, Microsoft đã cung cấp 8,2 triệu nhật ký trò chuyện của Copilot cho một chuyên gia do các nhà xuất bản tin tức thuê. Hãng khẳng định các nhật ký này được chọn lọc cụ thể “vì chúng chứa các từ khóa liên quan đến việc sử dụng trang web của các Nguyên đơn Tin tức, và do đó có khả năng cao nhất chứa các tác phẩm của các Nguyên đơn Tin tức”. Microsoft cho biết kết quả phân tích cho thấy 59.545 trong số đó chứa ít nhất 16 từ trùng khớp với nội dung tin tức được sử dụng để làm nền tảng cho mô hình AI. Theo Microsoft, một chuyên gia của Trung tâm Báo chí Điều tra (CIR) đã tìm thấy 51 trường hợp “trùng lặp đáng kể” với các tác phẩm của CIR trong tập dữ liệu. Tương tự, một chuyên gia trong vụ kiện của các tác giả cũng phát hiện ra rằng trong 8,2 triệu cuộc hội thoại với Copilot, chỉ có 24 phản hồi chứa ít nhất 30 từ trùng khớp. Microsoft khẳng định chỉ có 10 trong số 212 cuốn sách được đánh giá là có sự trùng lặp. The Times, CIR và Hiệp hội Tác giả (Authors Guild) đã không phản hồi ngay lập tức các yêu cầu bình luận.
Microsoft lập luận rằng những con số này củng cố cho quan điểm của họ rằng việc sử dụng nội dung có bản quyền cho các tập dữ liệu huấn luyện AI nên được coi là sử dụng hợp lý (fair use). Hãng cho biết, mặc dù các hệ thống như Copilot dựa vào việc sử dụng tài liệu có bản quyền, nhưng các hệ thống tạo ra lại được sử dụng cho những mục đích khác biệt đáng kể so với bản gốc. Microsoft kết luận rằng việc chúng đôi khi tái tạo lại các đoạn văn bản “khó có thể làm suy yếu mục đích mang tính chuyển đổi của việc huấn luyện LLM”.
Các hồ sơ này được đệ trình như một phần trong cuộc chiến pháp lý do các nhà xuất bản và tác giả khởi xướng chống lại Microsoft và OpenAI. Các nguyên đơn cho rằng hai công ty này đã xây dựng sản phẩm dựa trên tác phẩm của họ và hiện đang cạnh tranh trực tiếp với họ, một phần bằng cách sao chép lại nội dung có bản quyền. Các khiếu nại của các nhà xuất bản tin tức và tác giả sách đã được hợp nhất dưới sự thụ lý của một thẩm phán để hợp lý hóa quy trình, bất chấp sự phản đối từ phía các nguyên đơn. Microsoft đã nộp hồ sơ vào thứ Sáu khi lập luận để thẩm phán đưa ra phán quyết tóm tắt, điều này sẽ kết thúc vụ kiện ở giai đoạn sớm. (Chính quyền Trump tuần này cũng đã đệ trình một tuyên bố quan tâm trong vụ kiện của New York Times, ủng hộ OpenAI). Nếu thẩm phán đứng về phía các nhà xuất bản và tác giả, cuộc chiến pháp lý sẽ tiếp tục tại tòa.
Theo dõi các chủ đề và tác giả từ bài viết này để xem thêm các nội dung tương tự trên trang chủ cá nhân của bạn và nhận thông tin cập nhật qua email.
Bài viết được AI dịch và tổng hợp tự động từ The Verge AI. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.