IT Home
85

Tin ngành

Xiaohongshu mạnh tay xóa sổ hàng loạt tài khoản AI độc hại và nội dung vi phạm

(giờ Việt Nam)

Tóm tắt AI

Xiaohongshu vừa thông báo xử lý hơn 3.500 tài khoản vi phạm, bao gồm các nội dung AI biến tướng hoạt hình, lôi kéo trẻ em chat khiêu dâm và cổ xúy tự hại, đồng thời nâng cấp hệ thống kiểm duyệt để ngăn chặn từ sớm.

Bản dịch AI

Theo tin từ IT ngày 4 tháng 8, Xiaohongshu tối nay đã công bố hai thông báo quản lý, lần lượt thông tin về tiến độ xử lý các nội dung vi phạm liên quan đến trẻ vị thành niên và chiến dịch chuyên biệt về an toàn du lịch mùa hè.

Tính đến ngày 4 tháng 8, trong chiến dịch chuyên biệt "Qinglang · Bảo vệ trẻ vị thành niên trên mạng", nền tảng đã xử lý tổng cộng hơn 84.000 bài viết vi phạm, hơn 105.000 bình luận vi phạm và 3.571 tài khoản vi phạm.

Xiaohongshu tuyên bố rằng nền tảng đã áp dụng các biện pháp xử lý nghiêm khắc đối với ba loại hành vi vi phạm điển hình, IT tóm tắt như sau:

Thứ nhất là cố tình xuyên tạc nội dung hoạt hình kinh điển, một số tài khoản sử dụng công nghệ AI để tạo ra "hoạt hình độc hại", ví dụ như tài khoản " X" đã tạo ra các video "Teletubbies" phiên bản kinh dị một cách ác ý, tài khoản này đã bị khóa vĩnh viễn và toàn bộ các bài viết liên quan đã bị gỡ bỏ.

Thứ hai là dụ dỗ trẻ vị thành niên kết bạn không lành mạnh, tài khoản "" sử dụng các thuật ngữ của ngành công nghiệp đen/xám như "" (tuyển người đồng hành), " hf" (không phí hội viên) làm mồi nhử, lừa gạt trẻ vị thành niên rời khỏi nền tảng để tham gia các dịch vụ trò chuyện nhạy cảm, tài khoản này đã bị khóa vĩnh viễn.

Thứ ba là xúi giục trẻ vị thành niên tự làm hại bản thân, tài khoản " * Q" đã đăng tải các hình ảnh và văn bản cực đoan có xu hướng tự làm hại như "Yêu tôi thì hãy mua lưỡi lam cho tôi", tài khoản này đã bị khóa vĩnh viễn và các nội dung liên quan đã bị xóa bỏ. Xiaohongshu cho biết đã nâng cấp mô hình nhận diện rủi ro, thực hiện chặn trước đối với các hành vi né tránh kiểm duyệt ác ý như ám hiệu trong các nhóm kín, hình ảnh biến thể.

Về chiến dịch chuyên biệt an toàn du lịch mùa hè, kể từ tháng 7, Xiaohongshu đã triển khai quản lý đối với "các điểm du lịch nguy hiểm, thông tin du lịch giả mạo", tổng cộng đã xóa bỏ hơn 10.000 thông tin vi phạm. Đối với các bài viết về các hạng mục có rủi ro cao như leo núi Via Ferrata, chèo thuyền vượt thác, xích đu vách đá, bơi lội tại hồ Sayram, nền tảng đã thực hiện ẩn kết quả tìm kiếm và hạn chế lưu lượng truy cập, can thiệp vào hơn 20 nhóm từ khóa tìm kiếm có nguy cơ mất an toàn và hiển thị thanh cảnh báo an toàn. Đồng thời, nền tảng cũng tiến hành rà soát và xử lý chuỗi cung ứng lừa đảo núp bóng dưới danh nghĩa "AB " (chia tiền kiểu AB), "" (bạn đồng hành du lịch), "" (đi chung xe, ghép đoàn). Trong nửa đầu năm, nền tảng đã phối hợp với cảnh sát nhiều địa phương bắt giữ 4 nhóm tội phạm đen/xám chuyên đăng ký tài khoản chuyên nghiệp giả mạo và 14 nghi phạm.

Về quản lý năng lực kinh doanh du lịch, nền tảng đã tập trung xử lý hơn 2.000 tài khoản tiếp thị giả mạo, hơn 6.000 tài khoản doanh nghiệp tiếp thị không có giấy phép, và hơn 9.000 tài khoản cá nhân cũng như hướng dẫn viên du lịch tiếp thị không có giấy phép. Nền tảng khẳng định sẽ "không khoan nhượng" với bất kỳ hành vi nào xâm phạm quyền và lợi ích hợp pháp của trẻ vị thành niên, đồng thời tiếp tục củng cố trách nhiệm chủ thể.

Đọc thêm:

"Cơ quan Quản lý Không gian mạng Trung Quốc sẽ chấn chỉnh hoạt hình độc hại: Sử dụng công nghệ AI để chế giễu các hình tượng hoạt hình kinh điển, cố tình phóng đại các yếu tố bạo lực và kinh dị"

Tuyên bố quảng cáo: Các liên kết chuyển hướng bên ngoài trong bài viết (bao gồm nhưng không giới hạn ở siêu liên kết, mã QR, mật khẩu, v.v.) được sử dụng để truyền tải thêm thông tin, tiết kiệm thời gian chọn lọc, kết quả chỉ mang tính chất tham khảo, tất cả các bài viết của IT đều bao gồm tuyên bố này.

XiaohongshuAn toàn AIQuản lý nội dungAI độc hạiBảo vệ trẻ em
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ IT Home. Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.