Thủ thuật
Công cụ phát hiện AI đang gieo rắc sự ngờ vực trong giáo dục
(giờ Việt Nam)
Tóm tắt AI
Việc lạm dụng các công cụ phát hiện AI thiếu chính xác đang gây ra những hệ lụy nghiêm trọng, đặc biệt là tình trạng đổ oan cho người dùng không phải bản ngữ và làm xói mòn niềm tin trong môi trường học thuật.
Bản dịch AI

Đây là The Stepback, bản tin hàng tuần phân tích một câu chuyện thiết yếu từ thế giới công nghệ. Để biết thêm tin tức về cách AI đang thay đổi cuộc sống hàng ngày của chúng ta, hãy theo dõi Emma Roth. The Stepback sẽ gửi đến hộp thư của người đăng ký vào lúc 8 giờ sáng theo giờ ET. Đăng ký nhận The Stepback tại đây.
Khởi đầu như thế nào
Từ rất lâu trước khi ChatGPT trở nên phổ biến, các nhà giáo dục và biên tập viên đã thường xuyên sử dụng các công cụ chống đạo văn để kiểm tra xem người viết có trung thực với tác phẩm của họ hay không. Các công cụ này hoạt động bằng cách so sánh một văn bản với cơ sở dữ liệu chứa nội dung từ khắp nơi trên web, các bài báo học thuật và nhiều nguồn khác để kiểm tra các câu và cụm từ trùng lặp. Một số công cụ, như Turnitin, đưa ra tỷ lệ phần trăm nhằm minh họa mức độ trùng lặp giữa bài viết của sinh viên với các tác phẩm khác. Do khả năng xảy ra kết quả dương tính giả và sự không chắc chắn về việc liệu tác phẩm có bị sao chép cố ý hay không, một số nhà giáo dục đã ngừng sử dụng công cụ cụ thể đó.
Nhưng giờ đây, cuộc săn lùng nội dung sao chép đang tiến hóa thành một cuộc chiến chống lại các tác phẩm do AI tạo ra. Ngay khi sinh viên bắt đầu sử dụng ChatGPT, Google Gemini và Microsoft Copilot, các giáo viên cũng nhanh chóng áp dụng cái gọi là công cụ phát hiện AI. Một cuộc khảo sát từ Center for Democracy and Technology cho thấy 43% giáo viên từ lớp 6 đến lớp 12 tại Mỹ đã thường xuyên sử dụng các công cụ phát hiện AI trong giai đoạn 2024-2025. Một số trường đại học vốn đã sử dụng Turnitin trong hệ thống quản lý học tập của họ nhận thấy dịch vụ này tự động kích hoạt tính năng phát hiện AI khi công cụ được ra mắt vào năm 2023.
Thay vì so sánh các đoạn nội dung văn bản, các công cụ phát hiện AI như GPTZero, Pangram và công cụ do Turnitin tạo ra dựa vào các mô hình AI của riêng chúng để đoán xem liệu một thứ gì đó có thể không phải do con người viết hay không — một quy trình được cho là còn mơ hồ hơn cả việc đối chiếu văn bản trên web. Như GPTZero đã lưu ý, các công cụ phát hiện AI sử dụng thuật toán để phân tích cách dùng từ, nhịp điệu và cấu trúc của văn bản, cũng như nhận diện các kiểu mẫu về độ dài và giọng điệu thường thấy trong văn bản do AI viết. Đánh giá mang tính chủ quan tương đối này không vững chắc bằng việc đối chiếu văn bản trực tuyến và có thể bị đánh lừa bởi những người viết sử dụng tiếng Anh như ngôn ngữ thứ hai. Mặc dù vậy, Turnitin cho biết công cụ phát hiện AI của họ gắn cờ sai ít hơn 1% nội dung do con người viết là AI, trong khi Pangram tuyên bố tỷ lệ dương tính giả của họ chỉ là 1 trên 10.000. GPTZero cũng khẳng định họ có tỷ lệ nhầm lẫn nội dung của con người thành AI thấp tương tự.
Tình hình hiện tại
Mọi người trên mạng đã bắt đầu cáo buộc lẫn nhau là “nghe giống AI”, nhưng sự sẵn có của các công cụ phát hiện AI chỉ như đổ thêm dầu vào lửa cho cuộc săn phù thủy LLM. Trong một số trường hợp nổi cộm, các cáo buộc viết bằng AI đã ảnh hưởng trực tiếp đến sinh kế và danh tiếng của nhiều người. Tháng trước, nhà xuất bản Minotaur đã hủy bỏ hợp đồng sách trị giá 2 triệu đô la vì lo ngại rằng tác giả Jerry Falade đã sử dụng AI — điều mà ông kịch liệt phủ nhận.
Có trường hợp của Thierry Rignol, một công dân Pháp đã kiện Yale vào năm ngoái sau khi một giáo sư cáo buộc anh sử dụng AI để viết một phần bài thi cuối kỳ, dẫn đến việc bị điểm liệt và đình chỉ học một năm. Vị giáo sư đã sử dụng GPTZero để quét bài viết của Rignol nhằm tìm dấu hiệu của AI, nhưng đơn kiện lập luận rằng “các công cụ giám sát và phát hiện AI được biết đến là nhắm mục tiêu không công bằng vào những người không sử dụng tiếng Anh là tiếng mẹ đẻ” như Rignol. Vào tháng 2, một sinh viên tại Đại học Adelphi đã thắng kiện nhà trường sau khi giáo sư của anh cũng đưa ra cáo buộc tương tự rằng anh sử dụng AI để viết bài luận. Mặc dù đơn kiện không nêu rõ giáo sư đã sử dụng công cụ AI nào để kiểm tra bài luận của sinh viên, Đại học Adelphi có thỏa thuận cấp phép với Turnitin.
Một nghiên cứu năm 2023 của Stanford cho thấy các công cụ phát hiện AI gắn cờ sai các bài luận do người không sử dụng tiếng Anh là tiếng mẹ đẻ viết là AI thường xuyên hơn so với người bản ngữ. (Nhiều dịch vụ vẫn lập luận rằng công cụ của họ chính xác khi xử lý văn bản do người không phải bản ngữ viết.) Những công cụ này cũng có thể thiên kiến đối với những người viết có sự khác biệt về thần kinh (neurodivergent).
Như Đại học California, Los Angeles (UCLA) đã chỉ ra, các công cụ phát hiện AI được huấn luyện để nhận diện các kiểu mẫu có thể cho thấy việc sử dụng AI, chẳng hạn như các thuật ngữ và cụm từ lặp đi lặp lại, văn bản nghe quá trang trọng hoặc quá suồng sã, và cách diễn đạt vô nghĩa. Một số công cụ, như QuillBot, cũng đo lường tính “không thể dự đoán” của văn bản, vì theo UCLA, “AI có xu hướng đưa ra các lựa chọn ngôn ngữ ‘rõ ràng’ nhất hoặc phổ biến nhất so với văn bản do con người tạo ra”. Chúng cũng có thể tìm kiếm cấu trúc câu không thay đổi xuyên suốt như một dấu hiệu khác của AI. Nhưng những phép đo này tự thân chúng không khẳng định chắc chắn là AI, vì một số người có thể chỉ đơn giản là có phong cách viết với những đặc điểm đó.
Mặc dù Turnitin quảng cáo tỷ lệ dương tính giả thấp, họ vẫn duy trì rằng công cụ của mình “có thể không phải lúc nào cũng chính xác” và không nên được sử dụng để đưa ra các hành động kỷ luật đối với sinh viên. Grammarly cảnh báo rằng người dùng “không bao giờ nên chỉ dựa vào kết quả của một công cụ phát hiện AI”, trong khi GPTZero nói rằng “không có công cụ phát hiện AI nào có thể thực sự hoàn hảo 100%”. OpenAI thậm chí đã đóng cửa công cụ phát hiện văn bản AI của riêng mình vào năm 2023 do độ chính xác thấp.
Nhưng các cáo buộc viết bằng AI vẫn đang lan tràn trên web. Tuần trước, trong một video phát sóng tới hơn 3,5 triệu người theo dõi trên các kênh xã hội của mình, Jack, con trai của Ozzy Osbourne, đã cáo buộc nhà báo kiêm cộng tác viên của Verge là Kat Tenbarge sử dụng AI để viết một bài báo cho Rolling Stone, đồng thời khoe kết quả từ một công cụ phát hiện AI có tên Getsolved như là “bằng chứng” cho tuyên bố của mình. Tenbarge đã bác bỏ cáo buộc này trong một video và một bài đăng trên trang web của cô, nhưng Osbourne vẫn chưa rút lại cáo buộc hay xóa video, để mặc Tenbarge phải đối phó với những kẻ quấy rối.
Có vô số ví dụ về các cáo buộc sai lầm, từ người viết cho đến sinh viên, với nhiều người buộc tội không thừa nhận các tuyên bố miễn trừ trách nhiệm đi kèm với một số công cụ phát hiện AI này.
Điều gì sẽ xảy ra tiếp theo
Sự không chắc chắn xung quanh các công cụ phát hiện AI là đủ để một số cơ sở giáo dục ngừng sử dụng chúng hoàn toàn. Đại học Yale, Đại học Johns Hopkins, Đại học Vanderbilt, Đại học Georgetown và những trường khác đã vô hiệu hóa hoặc hạn chế việc sử dụng các công cụ phát hiện AI. Viện Công nghệ Massachusetts (MIT) cũng cảnh báo rằng “các công cụ phát hiện AI không hiệu quả”.
Thay vì dựa vào các công cụ để loại bỏ AI, nhiều trường học đang khuyến khích các nhà giáo dục suy nghĩ lại về bài giảng của họ. Ví dụ, Đại học Chicago gợi ý yêu cầu sinh viên đọc chậm lại, chia nhỏ các bài tập viết dài và yêu cầu sinh viên phản tư về tác phẩm của mình. Đại học Stanford cho biết các giáo sư có thể cân nhắc tổ chức đánh giá ngay tại lớp học, trong khi MIT khuyên các giáo sư nên tạo không gian cho sinh viên tiết lộ liệu họ có sử dụng AI để hỗ trợ làm bài tập hay không mà không bị phạt.
Với việc AI ngày càng phổ biến trong và ngoài lớp học, các nỗ lực để phân biệt đâu là văn bản do con người viết hay do máy móc cũng đang gia tăng. Một số nền tảng trực tuyến chỉ đang làm trầm trọng thêm sự nghi ngờ xung quanh việc sử dụng AI. Substack đã tích hợp Pangram vào ứng dụng của mình, cho phép người dùng quét các blog để tìm nội dung nghi ngờ do AI tạo ra, trong khi LinkedIn đã thêm nút “có vẻ là rác AI” (seems like AI slop) trên các bài đăng. Kết quả là một kỷ nguyên mới của sự mất lòng tin, nơi độc giả liên tục đặt câu hỏi liệu những gì họ đang đọc có phải là AI hay không, và những người viết là con người thực thụ đang cố gắng hết sức để không bị nghe giống như AI.
Nhân tiện
Đọc bài này
Theo dõi các chủ đề và tác giả từ câu chuyện này để xem thêm các nội dung tương tự trong nguồn cấp dữ liệu trang chủ cá nhân hóa của bạn và nhận các bản cập nhật qua email.

Bài viết được AI dịch và tổng hợp tự động từ The Verge: AI. Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.