404 Media
Điểm AI 76/100

Ngành

404 Media: Nhân viên con người đang xem xét các câu lệnh và hình ảnh từ người dùng Copilot

(giờ Việt Nam)

Tóm tắt AI

Tài liệu nội bộ tiết lộ hàng trăm nhà thầu đang xem xét hình ảnh và câu lệnh của người dùng Copilot, bao gồm cả nội dung nhạy cảm, nhằm mục đích đánh giá chất lượng thay vì kiểm duyệt. Microsoft khẳng định việc này nằm trong điều khoản sử dụng để cải thiện sản phẩm.

Chính văn · Bản dịch AI

Humans Are Reading Copilot Prompts — And They're Horrified

Bài viết này có đề cập đến các chứng rối loạn ăn uống. Nếu bạn hoặc người quen cần giúp đỡ, hỗ trợ luôn sẵn sàng.

Các nhân viên hợp đồng được Microsoft thuê để cải thiện chatbot AI Copilot thường xuyên bị "dội bom" bởi các yêu cầu chỉnh sửa ảnh khiêu dâm hoặc gợi dục cùng những hình ảnh do người dùng tải lên, bao gồm ảnh chụp lén dưới váy hoặc yêu cầu đưa phụ nữ vào các tư thế tình dục. Những nhân viên này sau đó được yêu cầu đánh giá xem hình ảnh được tạo ra có đáp ứng đúng yêu cầu hay không — ví dụ như, trình tạo ảnh đã làm cho bộ ngực được AI phóng to của người phụ nữ đủ lớn hay chưa.

Khi người dùng Copilot tải lên ảnh của chính họ hoặc người khác, họ có lẽ kỳ vọng rằng hình ảnh đó vẫn được giữ kín giữa họ và công cụ AI. Trên thực tế, một đội ngũ gồm ít nhất hàng trăm nhân viên đánh giá là con người đôi khi đang xem xét các yêu cầu đó cùng bất kỳ hình ảnh nào họ tải lên. Trong nhiều trường hợp, các nhân viên hợp đồng này bị ngập trong các yêu cầu tạo ảnh tôn sùng bàn chân của các nhân vật hoạt hình trẻ em, làm ngắn váy của một phụ nữ thật, hoặc đưa mọi người vào các tư thế tình dục.

Tin tức này, dựa trên một kho tài liệu nội bộ của nhà thầu mà 404 Media thu thập được, cho thấy các công ty AI đang sử dụng nhân viên con người để đánh giá không chỉ các câu lệnh văn bản của người dùng chatbot AI, mà cả những hình ảnh họ tải lên và muốn chỉnh sửa. Đầu tháng này, 404 Media tiết lộ OpenAI có hàng ngàn nhân viên hợp đồng, những người trong một số trường hợp đánh giá các câu lệnh thực tế của người dùng ChatGPT. Cách tiếp cận đó cũng mở rộng sang Microsoft và Copilot.

"Khuôn mặt luôn không bị làm mờ, và nhiều câu lệnh mang tính chất tình dục và có vấn đề về sự đồng thuận," một người làm công việc đánh giá câu lệnh chia sẻ với 404 Media. 404 Media đã giữ ẩn danh cho người này vì họ không được phép phát ngôn với báo chí.

💡

Bạn có phải là người đánh giá câu lệnh cho OpenAI, Anthropic hoặc một công ty AI khác? Tôi rất muốn lắng nghe ý kiến của bạn. Sử dụng thiết bị không phải của công ty, bạn có thể nhắn tin bảo mật cho tôi qua Signal tại joseph.404 hoặc gửi email cho tôi tại [email protected].

404 Media đã thu thập được một bộ tài liệu nội bộ liên quan đến các nhân viên hợp đồng đánh giá câu lệnh và hình ảnh của Copilot, bao gồm hướng dẫn, các câu lệnh và hình ảnh thực tế của người dùng Copilot, cùng các cuộc trò chuyện giữa các nhân viên trên một bảng tin nội bộ.

Trong một chủ đề trên bảng tin nội bộ, một nhân viên hợp đồng đã thảo luận về các câu lệnh yêu cầu Copilot làm cho váy của một phụ nữ ngắn hơn, hoặc phóng to ngực, hoặc để lộ nhiều chân hơn khi đang đi giày cao gót. Các hình ảnh về She-Hulk xuất hiện rất nhiều, người làm công việc đánh giá câu lệnh chia sẻ với 404 Media. Các nhân viên hợp đồng khác cũng viết rằng họ phải tiếp xúc với nội dung cổ xúy chứng chán ăn.

"Tôi cảm thấy ghê tởm," một nhân viên hợp đồng viết về việc nhìn thấy nội dung đó. Một người khác viết rằng một trong những câu lệnh họ đánh giá yêu cầu Copilot tạo ra hình ảnh Ariana Grande mắc chứng chán ăn. Một người khác báo cáo về một câu lệnh dường như được thiết kế để tạo ra hình ảnh khiêu dâm hoặc gợi dục của một nhóm các cô gái trẻ.

Những nhân viên hợp đồng này không được thuê để gắn cờ hoặc kiểm duyệt nội dung phản cảm hoặc không phù hợp. Họ được trả tiền để đánh giá chất lượng đầu ra của Copilot, bao gồm cả những trường hợp chứa hình ảnh tình dục này.

"Ai là người viết những câu lệnh này và ai là người quyết định rằng về cơ bản việc tạo ra nội dung khiêu dâm lại là trọng tâm hiện tại của Copilot? Thật khó để coi trọng mọi thứ khi trọng tâm của tôi phải là mô hình nào đã tạo ra kích thước vòng một phù hợp hoặc người phụ nữ trung niên nào đã được đặt vào tư thế gợi dục phù hợp," một nhân viên hợp đồng nói trong chủ đề thảo luận.

Theo các tài liệu, Microsoft đặc biệt quan tâm đến trực giác của con người về việc hình ảnh nào trông đẹp hơn. "Hãy tin vào trực giác của bạn — khi bạn nhìn lướt qua hai hình ảnh đã chỉnh sửa đặt cạnh nhau, hình ảnh nào ngay lập tức mang lại cảm giác là bản chỉnh sửa tốt hơn? Phản ứng tự nhiên của bạn với tư cách là người xem là điều quan trọng," một bộ hướng dẫn dành cho các nhân viên hợp đồng viết.

"Khi nghi ngờ, hãy đi theo ấn tượng đầu tiên của bạn," hướng dẫn viết tiếp. "Trực giác con người rất giỏi trong việc nắm bắt những khác biệt nhỏ về chất lượng mà khó có thể diễn đạt bằng lời."

Việc các nhân viên hợp đồng phải tiếp xúc với những tài liệu kinh hoàng, khó chịu hoặc gây sang chấn, tất nhiên, không phải là điều mới mẻ. Các công ty công nghệ lớn, đặc biệt là các mạng xã hội, đã sử dụng đội quân nhân viên hợp đồng trong nhiều năm để kiểm duyệt nội dung do người dùng tạo. Các công ty AI cũng đã sử dụng nhân công giá rẻ ở nước ngoài để huấn luyện các mô hình AI của họ hoặc, trong trường hợp của OpenAI, làm cho chúng bớt độc hại hơn. Điều khác biệt trong sự việc Copilot lần này, và các bài báo của 404 Media về nhân viên hợp đồng tại các công ty AI khác như OpenAI, là nội dung mà con người đang đánh giá là các câu lệnh và hình ảnh tải lên mà người dùng chatbot có thể cho rằng là riêng tư, và các nhân viên hợp đồng không xem tài liệu này để huấn luyện các mô hình lọc bỏ hình ảnh phản cảm hay vì bất kỳ mối quan tâm an toàn nào khác. Việc huấn luyện là để làm cho các phản hồi của chatbot tốt hơn: nhiều thông tin hơn, thân thiện hơn và rõ ràng hơn.

Các hướng dẫn mà 404 Media thu thập được tập trung vào những gì nhân viên hợp đồng làm khi người dùng Copilot yêu cầu AI chỉnh sửa một hình ảnh. Nhân viên hợp đồng được xem câu lệnh gốc của người dùng, hình ảnh đã tải lên, và sau đó là hai bản chỉnh sửa do Copilot tạo ra. Nhân viên hợp đồng phải chọn bản chỉnh sửa nào tốt hơn, dựa trên bốn yếu tố: hình ảnh đã chỉnh sửa có tuân thủ đúng hướng dẫn chỉnh sửa hay không; các phần của hình ảnh lẽ ra không nên thay đổi có được giữ nguyên không — ví dụ, nếu câu lệnh là "thêm một chiếc cốc trên bàn", thì không có gì khác được thay đổi ngoại trừ chiếc cốc; hình ảnh đã chỉnh sửa có chứa bất kỳ lỗi hiển thị nào như biến dạng hoặc kết cấu không tự nhiên không; và chất lượng tổng thể của bản chỉnh sửa do AI tạo ra.

Một số nhân viên hợp đồng của Copilot đã phàn nàn trong diễn đàn riêng về việc chấp nhận các "nhiệm vụ" mà họ không biết trước là chứa các hình ảnh không an toàn hoặc thậm chí có khả năng là bất hợp pháp. "Tôi vừa bắt gặp một bộ ảnh gồm tám bức ảnh chụp lén dưới váy," nhân viên này viết, đồng thời yêu cầu cấp trên thêm cờ nội dung không an toàn vào nhiệm vụ đó. Trong cùng chủ đề, một nhân viên hợp đồng khác cho biết họ đã nhìn thấy hình ảnh về "một loại nghi lễ hiến tế động vật nào đó", và người thứ ba nói rằng họ đã thấy các câu lệnh về các động tác và tư thế tình dục.

Ít nhất một trong những công ty thuê nhân viên hợp đồng cho công việc này có tên là Prolific. Một dịch vụ mà Prolific đề cập trên trang web của mình là "Phản hồi của con người từ các nhóm dân cư đại diện — để tinh chỉnh sở thích, đánh giá an toàn và các tiêu chuẩn mà bạn có thể bảo vệ."

Trong một chủ đề khác, một nhân viên hợp đồng trích dẫn các hướng dẫn của chính Prolific, trong đó nhấn mạnh rằng có thể khó đảm bảo các huấn luyện viên không phải tiếp xúc với hình ảnh tình dục: "Cần đặc biệt thận trọng với nội dung gây khó chịu hoặc khiêu dâm đối với các AI tạo sinh. Điều này là do, không giống như nội dung truyền thống, các nhà nghiên cứu không thể kiểm soát hoàn toàn những gì được hiển thị cho người tham gia."

Prolific đã không phản hồi yêu cầu bình luận. Một người phát ngôn của Microsoft nói với 404 Media trong một email rằng "Microsoft sử dụng dữ liệu khách hàng như được mô tả trong điều khoản sử dụng của chúng tôi, bao gồm để cải thiện sản phẩm và thực thi quy tắc ứng xử của chúng tôi."

Các công cụ AI của Microsoft có lịch sử lâu dài bị lạm dụng để tạo ra những hình ảnh do AI tạo ra mà không có sự đồng thuận của người trong cuộc. Ví dụ, các thành viên trên 4chan và các kênh Telegram chuyên về nội dung khiêu dâm bằng AI đã sử dụng công cụ của Microsoft để tạo ảnh khiêu dâm của Taylor Swift, sau đó lan truyền mạnh mẽ trên Twitter. Microsoft đã khắc phục lỗ hổng mà những người này lợi dụng trong Microsoft Designer sau khi 404 Media đưa tin.

Vào năm 2024, 404 Media đã ghi lại cách Copilot trả lời, sau đó xóa các câu trả lời cho những câu lệnh có khả năng gây tranh cãi hoặc mang tính chất tình dục trong thời gian thực. Vào tháng 3, một quản trị viên cấp cao của Thượng viện đã phê duyệt Copilot để sử dụng tại Thượng viện, cùng với ChatGPT và Gemini của Google. Một bản ghi nhớ cho biết Copilot “có thể hỗ trợ công việc thường nhật tại Thượng viện, bao gồm soạn thảo và chỉnh sửa tài liệu, tóm tắt thông tin, chuẩn bị các luận điểm và tài liệu tóm tắt, cũng như thực hiện nghiên cứu và phân tích.”

Về tác giả

Joseph là một nhà báo điều tra từng đoạt giải thưởng, tập trung vào việc tạo ra tác động. Các tác phẩm của anh đã dẫn đến hàng trăm triệu đô la tiền phạt, đóng cửa các công ty công nghệ và nhiều thành tựu khác.

Joseph Cox

Bài viết được AI dịch và tổng hợp tự động từ 404 Media. Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.

404 Media: Nhân viên con người đang xem xét các câu lệnh và hình ảnh từ người dùng Copilot | AIHOT.vn