Thủ thuật
404 Media tiết lộ 'Dự án Lily': OpenAI thuê người kiểm duyệt chat của người dùng để tối ưu AI
(giờ Việt Nam)
Tóm tắt AI
OpenAI triển khai dự án nội bộ mang tên 'Lily', thuê nhân sự với mức lương hơn 50 USD/giờ để đánh giá các đoạn chat ẩn danh của người dùng, nhằm tinh chỉnh độ chính xác và loại bỏ phong cách trả lời sáo rỗng của ChatGPT.
Bản dịch AI
Theo tin từ IT ngày 15 tháng 9, như đã biết, nhật ký trò chuyện của các nền tảng như ChatGPT được sử dụng để tối ưu hóa mô hình. Tuy nhiên, trước đây, cơ chế xử lý này vẫn là một ẩn số. 404 Media vừa công bố một báo cáo tiết lộ toàn bộ quy trình OpenAI thực hiện kiểm duyệt thủ công đối với các bản ghi trò chuyện, giới thiệu cách thức vận hành của việc kiểm duyệt và thực tế là các nhân viên kiểm duyệt đôi khi đọc được thông tin cá nhân của người dùng.

Dự án đánh giá nội bộ này của OpenAI có mật danh là Project Lily. Trang tin này đã tiếp cận được các tài liệu hướng dẫn vận hành, hồ sơ nhóm làm việc trên Slack, các mẫu đối thoại thực tế của ChatGPT và hệ thống chấm điểm dùng để phân loại các đoạn hội thoại. Những người làm công việc này được gọi là "người kiểm duyệt câu lệnh" (prompt reviewers). Công việc của họ không quá phức tạp: xem xét các bản ghi trò chuyện thực tế của người dùng đã được ẩn danh, đánh giá chất lượng phản hồi của ChatGPT; đánh giá xem câu trả lời có đúng trọng tâm hay không, đồng thời kiểm tra xem văn bản phản hồi có xuất hiện quá mức các "cách nói kiểu AI", giọng điệu giáo điều bề trên, biểu tượng cảm xúc, hay giọng điệu nịnh nọt hay không. Các phản hồi bị cấm sử dụng cách diễn đạt nhân hóa và không được phép bịa đặt "trải nghiệm cá nhân". Nói cách khác, ChatGPT có thể nói "Tôi đã tìm thấy một số thông tin liên quan", nhưng không được viết kiểu "Là một đầu bếp, tôi thích..." hoặc "Tôi hiểu cảm giác này".
Một nhân viên kiểm duyệt cho biết công việc này "rất máy móc và lặp đi lặp lại", nhưng mức lương theo giờ được cho là hơn 50 USD (IT lưu ý: tỷ giá hiện tại tương đương khoảng 336,3 nhân dân tệ), một mức thù lao khá hấp dẫn đối với công việc không quá khó khăn này. Nhân viên này cũng đề cập rằng hướng dẫn vận hành của dự án liên tục thay đổi và thường xuyên mâu thuẫn giữa các phiên bản, điều mà hầu hết các nhà phát triển phần mềm đều có thể thấu hiểu.
Tuy nhiên, nhân viên này cho rằng đại đa số người dùng không biết nội dung trò chuyện của mình sẽ bị người khác đọc. Điều này đặc biệt đáng lo ngại vì không ít người dùng coi ChatGPT là nơi trút bầu tâm sự tạm thời, nơi tư vấn tâm lý, và thổ lộ những bí mật sâu kín nhất với AI.
Mặc dù các bản ghi trò chuyện được cho là đã trải qua một vòng xử lý ẩn danh và nhân viên kiểm duyệt không nhìn thấy tên người dùng, nhưng OpenAI đã thừa nhận với 404 Media rằng khâu lọc vẫn có khả năng bỏ sót một phần dữ liệu cá nhân, và các phiên hội thoại ngắn có xác suất xảy ra vấn đề này cao hơn. Trang tin này cũng chỉ ra rằng trong rất nhiều cuộc đối thoại, người dùng đã yêu cầu rõ ràng ChatGPT phải giữ bí mật nội dung trò chuyện. Phiên bản hội thoại được chuyển đến cho nhân viên kiểm duyệt thậm chí còn đi kèm với một "bản tóm tắt bộ nhớ người dùng", trong đó tổng hợp các câu hỏi, sở thích, thông tin ngữ cảnh của người dùng và thậm chí có thể bao gồm cả thông tin vị trí.
Điểm mấu chốt là: Project Lily không kiểm tra chuyên biệt xem nội dung câu trả lời có chính xác về mặt thực tế hay không, mà chỉ đánh dấu những lỗi hiển nhiên. Điều này có nghĩa là vẫn còn ít nhất một (hoặc nhiều) đội ngũ khác đang thực hiện đánh giá hiệu quả độc lập. Tương tự, việc kiểm duyệt chấm điểm này cũng là một quy trình độc lập với việc kiểm tra an toàn thủ công nhằm phát hiện xem người dùng có ý định làm hại người khác (hoặc làm hại chính mình) hay không.
Sự tồn tại của dự án này cũng cho thấy, trái ngược với ấn tượng công chúng mà các công ty AI cố gắng xây dựng, sự tiến bộ lặp đi lặp lại của các mô hình lớn không chỉ dựa vào nâng cấp kỹ thuật và tập dữ liệu huấn luyện chất lượng hơn; mà vẫn cần một lượng đáng kể con người có năng lực tương ứng tham gia vào đó.
Đại đa số các chatbot dành cho người dùng phổ thông đều có cài đặt tương tự: "Cho phép sử dụng nhật ký trò chuyện của bạn để cải thiện sản phẩm". Hầu như tất cả các sản phẩm trò chuyện đều mặc định bật cài đặt này, và nhiều gói đăng ký trả phí cũng không ngoại lệ. Tuy nhiên, đối với khách hàng doanh nghiệp, thương mại và giáo dục, cài đặt này mặc định bị tắt trên ChatGPT.
Nhưng công tắc chuyển đổi này không có hiệu lực hồi tố. Nghĩa là, các bản ghi trò chuyện lịch sử đã được lưu vào cơ sở dữ liệu của ChatGPT sẽ tiếp tục được giữ lại trừ khi người dùng chủ động yêu cầu xóa. Ngoài ra, thao tác xóa cũng không thể truy hồi: ngay cả khi người dùng xóa cuộc trò chuyện, nội dung tương ứng có thể đã bị thu thập, hoàn tất xử lý ẩn danh và lưu trữ trong một tập dữ liệu nào đó.
404 Media đã gửi câu hỏi về vấn đề này, ban đầu OpenAI không phản hồi: liệu người dùng có được thông báo rõ ràng rằng nhật ký trò chuyện có thể được con người xem xét hay không. Sau đó, công ty chỉ cung cấp một liên kết đến trang câu hỏi thường gặp, trang này đề cập rằng việc kiểm duyệt thủ công sẽ được thực hiện vì mục đích tối ưu hóa mô hình. Sau khi xác minh, thông báo này đã tồn tại ít nhất hai năm, và thời gian thực tế có thể lâu hơn. Sau khi bài báo chuyên sâu này được công bố, OpenAI đã sửa đổi trang trợ giúp, bổ sung hướng dẫn về cách người dùng chọn không tham gia thu thập dữ liệu; nhưng trong tài liệu đã sửa đổi vẫn không đề cập đến việc sẽ có nhân viên đọc nội dung hội thoại.
Cách thức thu thập dữ liệu và kiểm duyệt thủ công như vậy là phổ biến ở các nhà cung cấp dịch vụ lớn. Gemini của Google đã ghi rõ trong trung tâm quyền riêng tư rằng "một phần nhật ký trò chuyện được lưu lại có thể được con người xem xét". Anthropic cũng giữ lập trường tương tự và đã lập một trang web riêng để giải thích vấn đề này. Trong khi đó, thái độ của Perplexity vẫn chưa rõ ràng, chính sách quyền riêng tư của họ không xác nhận cũng không phủ nhận việc nhân viên có thể truy cập nhật ký trò chuyện.
Bài viết được AI dịch và tổng hợp tự động từ IT Home. Liên kết bài gốc ở phía trên. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.