Thủ thuật
Tại sao văn bản AI ngày càng dễ bị phát hiện? Lỗi nằm ở các lớp bảo mật
(giờ Việt Nam)
Tóm tắt AI
Các chuyên gia cho rằng việc áp dụng các lớp bảo mật và hậu huấn luyện đã khiến văn bản từ AI trở nên đơn điệu, dễ bị nhận diện hơn so với các mô hình gốc tự do.
Bản dịch AI
Về lý thuyết, các LLM có thể viết đa dạng như con người, nhưng thực tế thì không. Bradley Emi, CTO của công cụ phát hiện văn bản AI Pangram, lập luận trong một bài blog rằng quá trình hậu huấn luyện (post-training) và các rào cản an toàn đã khiến văn bản do AI tạo ra dễ bị nhận diện. Các hệ thống như ChatGPT, Claude hay Gemini học các quy tắc hành vi để tránh đưa ra các kết quả nguy hiểm hoặc kiểm duyệt một số tuyên bố chính trị nhất định. Điều này làm thu hẹp đáng kể phạm vi biểu đạt của chúng, một hiệu ứng được gọi là "mode collapse" (sụp đổ chế độ).

Theo Emi, các mô hình nền tảng (base models) – tức những mô hình thô trước khi qua hậu huấn luyện – có khả năng viết với sự đa dạng hơn, vì vậy công cụ phát hiện của Pangram không gắn cờ chúng. Điều tương tự cũng áp dụng cho các mô hình tinh chỉnh (fine-tunes) chuyên biệt hẹp chỉ được huấn luyện trên văn bản của Hemingway hoặc một số subreddit nhất định, cũng như các kết quả đầu ra bị lỗi như văn bản rời rạc. Tuy nhiên, điều này chỉ áp dụng cho văn bản AI không có hình mờ (watermark). Các hình mờ có khả năng sẽ luôn hoạt động hiệu quả, ngay cả với sự đa dạng của một mô hình nền tảng.
Tin tức AI không cường điệu – Được chọn lọc bởi con người
Đăng ký THE DECODER để đọc không quảng cáo, nhận bản tin AI hàng tuần, báo cáo tiên phong "AI Radar" độc quyền sáu lần một năm, quyền truy cập toàn bộ kho lưu trữ và tham gia phần bình luận của chúng tôi.
Đăng ký ngay
Bài viết được AI dịch và tổng hợp tự động từ The Decoder: AI News. Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.