VnExpress Khoa học Công nghệ
85

Tin ngành

OpenAI bị cáo buộc thuê người đọc lén hội thoại của người dùng ChatGPT

(giờ Việt Nam)

Tóm tắt AI

OpenAI được cho là đang triển khai dự án bí mật mang tên Project Lily, thuê hàng trăm nhân sự để kiểm duyệt các đoạn hội thoại thực tế của người dùng nhằm huấn luyện AI.

Bản dịch AI

OpenAI thuê người đọc hội thoại ChatGPT của người dùng

OpenAI thuê người đọc hội thoại ChatGPT của người dùng

OpenAI được cho là đang thực hiện dự án bí mật có tên Project Lily, trong đó công ty thuê hàng trăm người xem xét các đoạn hội thoại thực tế của người dùng ChatGPT.

Theo điều tra của 404 Media, OpenAI đang vận hành dự án kiểm duyệt nội bộ mang tên Project Lily nhằm nâng cao chất lượng phản hồi của mô hình. Công ty tuyển dụng người đánh giá với mức thù lao hơn 50 USD mỗi giờ. Công việc chính của họ là đọc các đoạn hội thoại để chấm điểm câu trả lời của ChatGPT.

Hệ thống tiêu chí đánh giá tập trung vào việc loại bỏ văn phong máy móc, các biểu tượng cảm xúc thừa hoặc thái độ nịnh hót. Đội ngũ kiểm duyệt cũng phải đảm bảo ChatGPT không xưng "tôi" theo kiểu nhân hóa như con người. Một người tham gia dự án tiết lộ rằng công việc này mang tính lặp đi lặp lại, trong khi bộ quy tắc hướng dẫn thường xuyên thay đổi và thậm chí còn mâu thuẫn nhau.

Dù các cuộc trò chuyện sẽ trải qua bước "làm sạch và ẩn danh" – nghĩa là người kiểm duyệt không nhìn thấy thông tin định danh người dùng – đại diện OpenAI thừa nhận với 404 Media rằng bộ lọc vẫn có thể để lọt một số dữ liệu cá nhân, nhất là trong những cuộc trò chuyện ngắn.

Trong nhiều cuộc trò chuyện, người dùng yêu cầu ChatGPT giữ bí mật nội dung. Thực tế, một số người còn coi ChatGPT như bạn tâm giao hay chuyên gia tư vấn tâm lý và sẵn sàng chia sẻ những bí mật thầm kín nhất. Tuy nhiên, các bản hội thoại được cung cấp cho người kiểm duyệt được cho là còn bao gồm cả "bản tóm tắt bộ nhớ người dùng", tóm lược những câu hỏi, mối quan tâm, sở thích, bối cảnh và thậm chí có thể cả vị trí của họ.

Một người dùng đang sử dụng ứng dụng AI ChatGPT. Ảnh: Trọng Đạt

Một người dùng đang sử dụng ứng dụng AI ChatGPT. Ảnh: Trọng Đạt

Theo thiết lập mặc định, tính năng "Cho phép sử dụng dữ liệu để cải thiện sản phẩm" đều được bật sẵn trên hầu hết các dịch vụ chatbot phổ thông hiện nay, kể cả gói trả phí. Người dùng chỉ có thể tắt tùy chọn này trong phần cài đặt, nhưng hành động đó cũng không có hiệu lực hồi tố đối với những dữ liệu đã bị thu thập và đưa vào tập dữ liệu trước đó.

Khi được hỏi về việc có thông báo rõ ràng tới người dùng hay không, OpenAI dẫn tới trang FAQ từ nhiều năm trước, trong đó có nhắc đến việc con người tham gia đánh giá dữ liệu. Tuy nhiên, 404 Media cho biết sau khi báo cáo được đăng tải, OpenAI đã âm thầm cập nhật trang này, bổ sung hướng dẫn cách từ chối thu thập dữ liệu nhưng lại loại bỏ nội dung đề cập đến yếu tố nhân sự kiểm duyệt là con người.

Theo Tom's Hardware, tình trạng này không chỉ diễn ra tại OpenAI. Gemini cũng công khai trong phần điều khoản riêng tư rằng "con người có thể xem xét một số đoạn chat được lưu". Anthropic cũng áp dụng chính sách tương tự. Việc thu thập và đánh giá thủ công cho thấy các mô hình AI hiện đại vẫn phụ thuộc rất lớn vào sức lao động của con người thay vì tự hoàn thiện thuần túy bằng thuật toán.

Huy Đức tổng hợp

Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ VnExpress Khoa học Công nghệ. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.