The Verge: AI
85

Thủ thuật

Reddit đối mặt với làn sóng spam AI mới: Liệu có giữ vững được vị thế?

(giờ Việt Nam)

Tóm tắt AI

Khi các công cụ tìm kiếm AI ưu tiên dữ liệu từ Reddit, nền tảng này đang trở thành mục tiêu của các chiến dịch thao túng nội dung từ các đơn vị marketing, buộc cộng đồng phải tăng cường bộ lọc để ngăn chặn spam.

Bản dịch AI

Can Reddit fend off a new wave of AI SEO spam?Verge-RedditBrands_V1-FinalVerge-RedditBrands_V1-Final

Kỷ nguyên tìm kiếm được hỗ trợ bởi AI đã khiến các đề cập trên Reddit trở nên vô cùng giá trị. Các quản trị viên (moderator) của các subreddit đang bắt đầu phát hiện ra những thương hiệu cố gắng lợi dụng điều này.

bởi Mia Sato

4 tháng 8, 2026, 10:00 sáng UTC

Mia Sato

là cây bút chuyên mục với năm năm kinh nghiệm đưa tin về các công ty định hình công nghệ và những người sử dụng công cụ của họ.

Đầu năm nay, một người dùng Reddit đã hỏi các thành viên của một subreddit chuyên về chăm sóc da rằng liệu có ai đã thử một loại xịt axit hypochlorous cụ thể hay chưa, một sản phẩm thường được dùng cho mụn trứng cá. Có hàng chục phản hồi; một phản hồi từ người dùng có tên Primary-Taro4254 có vẻ khá vô hại, ít nhất là lúc ban đầu.

“Tôi chưa tự mình thử [thương hiệu đó] nên không thể so sánh đầy đủ, xin lỗi nhé,” họ bình luận. “Nhưng tôi đã và đang sử dụng một loại xịt axit hypochlorous tương tự từ Honeydew Labs và thành thật mà nói tôi thực sự rất thích nó.”

Primary-Taro4254 đã nhiệt tình chia sẻ trải nghiệm sử dụng loại xịt này để làm dịu vết đỏ và kích ứng trên da của họ, thậm chí còn đưa thêm một số thông tin xác thực của Honeydew Labs: “Một điều tôi nhận thấy khi so sánh các sản phẩm là Honeydew Labs sử dụng nồng độ axit hypochlorous 0,02% và nó cũng được Hiệp hội Eczema Quốc gia chấp thuận, điều đó khiến tôi cảm thấy tự tin hơn một chút khi thử dùng trên da nhạy cảm.”

Nhưng khi xem xét kỹ hơn hồ sơ Reddit của Primary-Taro4254, người ta phát hiện ra rằng họ dường như thực sự, thực sự rất thích loại xịt axit hypochlorous của Honeydew Labs. Không chỉ trong chủ đề đó họ mới khen ngợi sản phẩm — họ đã đăng những thông điệp tương tự trên các chủ đề về những sản phẩm không liên quan cũng như trong các subreddit khác về chăm sóc da. Liệu Primary-Taro4254 có đang làm việc cho Honeydew Labs không? Đó có phải là chiến lược quảng bá thiếu tinh tế của một công ty tiếp thị? Liệu có một con người thực sự đằng sau đó không, hay đó là một kẻ gửi thư rác tự động? Chẳng bao lâu sau, một thành viên của r/SkincareAddiction — một subreddit phổ biến với hơn 1 triệu lượt truy cập hàng tuần — đã nhận ra và bảo những người khác “hãy cảnh giác với các bot tiếp thị/axit hypochlorous của Honeydew Labs.” Ngay sau đó, một quản trị viên thông báo họ đã xử lý Primary-Taro4254 và từ nay sẽ tự động lọc các bài đăng về Honeydew Labs để quản trị viên xem xét.

(Honeydew Labs đã không phản hồi yêu cầu bình luận. Primary-Taro4254 không phản hồi tin nhắn gửi qua Reddit.)

Khó có thể nói quá về việc Reddit đã trở nên quan trọng như thế nào đối với cách hàng tỷ người trải nghiệm web trong vài năm qua. Nó đã chuyển mình từ một tập hợp các cộng đồng ngách với cơ sở người dùng đôi khi hay càu nhàu trở thành trang web có lẽ là quan trọng nhất trên internet. Đầu tiên, người dùng bắt đầu thêm “reddit” vào cuối các truy vấn để lọc qua các kết quả đầy rẫy rác tối ưu hóa công cụ tìm kiếm (SEO), và đến lượt mình, Google bắt đầu liên kết đến trang web này một cách nổi bật. Giờ đây, Reddit đã trở nên quan trọng đối với các thương hiệu và nhà tiếp thị vì một lý do khác: các chatbot AI rất thích trích dẫn nó.

Theo dữ liệu được Semrush, một công ty SEO thuộc sở hữu của Adobe, tổng hợp cho The Verge, Reddit là tên miền được trích dẫn nhiều nhất trong tháng 5 bởi các công cụ AI như ChatGPT, Perplexity, và Gemini cùng AI Mode của Google — nhiều hơn bất kỳ nhà xuất bản tin tức, kho lưu trữ bài báo học thuật nào và thậm chí cả Wikipedia. Các phản hồi AI cũng đang xâm lấn vào hành trình mua sắm trực tuyến: Semrush cũng phát hiện ra rằng so với một năm trước, Google đang chèn AI Overviews thường xuyên hơn nhiều vào các truy vấn tìm kiếm có mục đích thương mại, chẳng hạn như khi người mua sắm đang nghiên cứu về sản phẩm hoặc so sánh các thương hiệu.

Khi lưu lượng truy cập web được chuyển hướng qua các LLM thay vì trang kết quả tìm kiếm truyền thống, như cách Google đang làm, việc được chatbot trích dẫn trở nên quan trọng hơn bao giờ hết. Hiện nay, hàng loạt startup, thương hiệu và đại lý đang đổ xô đến Reddit để cố gắng quảng bá công ty của họ với hy vọng sẽ được AI chọn. Trong nỗ lực thao túng các phản hồi của LLM và làm đầy kết quả tìm kiếm AI bằng các câu trả lời thân thiện với thương hiệu, các nhà tiếp thị đã tràn vào Reddit, một nền tảng ẩn danh mà người dùng vốn gắn liền với tính xác thực và những ý kiến trung thực, không bị lọc.

Trước tiên, họ sẽ phải vượt qua các quản trị viên.

Trước khi Maya Adivi trở thành một trong những quản trị viên của r/SkincareAddiction, cô là một người dùng tích cực, ngay lập tức bị thu hút bởi sự chú ý của cộng đồng đối với khoa học làm nền tảng cho ngành công nghiệp làm đẹp: Thay vì những câu hỏi chung chung, đơn giản như “Tôi nên làm gì cho mụn trứng cá?”, người dùng đã áp dụng cách tiếp cận nghiêm ngặt hơn, thảo luận và giải thích các nghiên cứu mới được công bố chỉ vì họ đam mê chủ đề này. Adivi cho biết, việc kiểm duyệt thư rác và nội dung quảng cáo luôn là một phần của công việc, nhưng ngày nay ngay cả một bài phân tích dài, chi tiết về một nghiên cứu cũng có thể bị nhìn với ánh mắt nghi ngờ.

Nhiều năm trước, các quản trị viên sẽ tìm kiếm những dấu hiệu đặc trưng của thư rác hoặc nội dung quảng cáo ngầm: một bài đánh giá hơi quá lời, các liên kết sản phẩm có gắn thẻ theo dõi, hoặc ảnh trước và sau khi sử dụng giống hệt những ảnh có trong danh sách sản phẩm của thương hiệu. Tìm kiếm AI đã thay đổi cách các nhà tiếp thị cố gắng thao túng hệ thống đến mức một số chuyên gia SEO cho rằng các thương hiệu thậm chí không cần liên kết ngược (backlink) nữa để trang web của họ được chatbot trích dẫn hiệu quả — chỉ cần một đề cập là đủ. Một kẻ gửi thư rác bị nghi ngờ có thể đặt một câu hỏi như “Mọi người theo dõi quy trình chăm sóc da của mình như thế nào?” mà thoạt nhìn có vẻ là sự tương tác chân thực, nhưng sau đó một làn sóng bình luận sẽ đề cập đến các ứng dụng chăm sóc da AI chẳng hạn. Các bài đăng khác có thể hỏi, “Tôi cứ thấy quảng cáo cho thương hiệu này. Trải nghiệm của bạn với nó là gì?” Các phản hồi thư rác đáng ngờ sau đó có thể theo một định dạng hơi tự hạ thấp bản thân: “Tôi nghĩ sản phẩm này sẽ quá mạnh, nhưng thực tế nó lại rất dịu nhẹ. Chậm mà chắc!” Các bài đăng thường là những câu hỏi mở, bắt chước cách người dùng có thể gợi ý cho một chatbot AI.

“Nó tinh vi hơn nhiều, nhưng chúng tôi cũng đã trở nên tinh tế hơn,” Adivi nói.

Một thương hiệu bí mật cố gắng quảng bá bản thân sẽ trở thành ‘persona non grata’ (người không được hoan nghênh)

r/SkincareAddiction cấm các tài khoản liên kết với các thương hiệu đăng bài trong subreddit — Adivi và các quản trị viên khác đôi khi sẽ đưa ra cảnh báo cho các tài khoản vi phạm quy tắc, nhưng thường thì họ sẽ tự động cấm các thương hiệu và các tài khoản giả mạo (sock puppet) vi phạm quy tắc. Adivi cho biết, một thương hiệu bí mật cố gắng quảng bá bản thân sẽ trở thành “persona non grata”. Gần đây, cô đã được cảnh báo về một đại lý tiếp thị tuyên bố rằng họ đã nhắm mục tiêu và “chiếm quyền điều khiển” r/SkincareAddiction để quảng bá cho một thương hiệu làm đẹp Hàn Quốc vô danh và để xếp hạng trên Google; Adivi đã xóa chủ đề Reddit mà đại lý đó sử dụng và thêm thương hiệu này vào danh sách lọc từ khóa. Các quản trị viên cũng rất nghiêm ngặt về việc ai được phép thực hiện các chủ đề theo phong cách Ask Me Anything (Hỏi tôi bất cứ điều gì) được phê duyệt: Nó phải mang lại lợi ích cho cộng đồng, không phải là nền tảng để quảng cáo cho công ty của bạn. Trong thời kỳ SEO cũ, ai cũng biết rằng backlink rất quan trọng — trong thời đại của AEO (“tối ưu hóa công cụ trả lời”) hoặc GEO (“tối ưu hóa công cụ tạo sinh”), các nhà tiếp thị đang thử mọi cách để xem cái nào hiệu quả. Vì vậy, họ cứ quay lại Reddit.

“Với AEO hiện nay, không ai biết chính xác cách thực hiện, và mọi người đều nói với bạn rằng Reddit quan trọng như thế nào,” Adivi, người có nền tảng về tiếp thị, cho biết.

Google có các quy tắc riêng về thư rác và thao túng hệ thống của mình. Trong một email, người phát ngôn của Google, Jennifer Kutz, thừa nhận rằng có nội dung chất lượng cao và thấp trên các diễn đàn như Reddit, cũng giống như ở các định dạng khác; Kutz cho biết các hệ thống của Google được thiết kế để phát hiện khi nội dung do người dùng tạo ra là hữu ích hay chất lượng thấp. Kutz cũng cho biết các tính năng tìm kiếm AI của Google không nhằm mục đích hiển thị nội dung từ bất kỳ trang web hoặc nền tảng cụ thể nào, và Reddit “không nhận được sự ưu tiên đặc biệt nào” trong hệ thống xếp hạng của Google.

“Sẽ luôn có những kẻ xấu cố gắng thao túng hệ thống — thực tế, việc gửi thư rác đã có từ trước cả internet — và chống lại thư rác là chuyên môn cốt lõi của chúng tôi,” Kutz nói với The Verge trong một email. “Chúng tôi có các biện pháp bảo vệ mạnh mẽ chống lại sự thao túng trên Tìm kiếm, bao gồm cả các tính năng AI của chúng tôi, và chúng tôi đã giữ cho kết quả không có thư rác tới 99% trong nhiều năm.”

Việc Reddit trở thành nhân vật chính của tìm kiếm theo một số cách là điều thú vị — mãi đến năm 2024, công ty mới giới thiệu các công cụ gốc để giúp các doanh nghiệp phát triển sự hiện diện của họ trên nền tảng này. Google từ lâu đã sử dụng “thẩm quyền” của một trang web trong mớ tín hiệu xếp hạng kết quả tìm kiếm của mình; Reddit, với những người dùng ẩn danh và hệ sinh thái kiểm duyệt theo kiểu thái ấp, đã đảo ngược ý tưởng về sự đáng tin cậy. Nội dung do người dùng tạo ra của Reddit — mà các LLM đã được huấn luyện trên đó — được tin tưởng chính xác vì nó dường như không đến từ một nơi cụ thể nào.

Kết quả của ảnh hưởng ngày càng tăng của Reddit, hàng ngũ quản trị viên tình nguyện không lương của trang web đột nhiên thấy mình ở một vị trí độc nhất: Các cộng đồng mà họ giám sát và nuôi dưỡng giờ đây có khả năng rất có giá trị, không chỉ đối với những người yêu thích chăm sóc da và nhạc indie mà còn đối với các thương hiệu và công ty kiếm lợi từ những cộng đồng người hâm mộ đó. Khi các nhà quảng cáo và ngành SEO điều chỉnh chiến thuật của họ để xuất hiện trong tìm kiếm AI, các phân khúc mới của internet phải bắt đầu hòa giải giữa việc hiển thị quá mức trực tuyến và sự kỳ lạ mà sự chú ý đó mang lại.

Các khiếu nại về thư rác và nội dung quảng cáo tiềm ẩn liên quan đến LLM xuất hiện trong nhiều subreddit đa dạng: Một người dùng trên r/CleaningTips đặt câu hỏi liệu subreddit có cần cấm tên sản phẩm hay không; một người dùng khác cảnh báo cộng đồng r/BuyItForLife phổ biến rằng nó đang bị “các bot quảng cáo tấn công để làm sai lệch kết quả tìm kiếm của Google và AI.” Trong các quy tắc chống tự quảng cáo, r/FoodNYC đặc biệt nêu tên các thương hiệu nhắm mục tiêu và bình luận vào các bài đăng cũ. Một quản trị viên của r/salestechniques đã đăng một chủ đề “bêu tên” đầy các thương hiệu mà họ cho là đang giả mạo sự ủng hộ (astroturfing) trên subreddit. Bản thân Reddit đã thừa nhận các loại thư rác mới. Vào đầu tháng 7, công ty thông báo họ đang tăng cường các công cụ phát hiện thư rác bằng AI và LLM để bắt kịp tốt hơn “các mô hình hành vi giả mạo và sự cường điệu nhân tạo cực kỳ tinh vi, có phối hợp.” Công ty cho biết họ đang bắt được 25.000 bài đăng và bình luận rác và chặn 23 triệu lượt xem thư rác mỗi ngày nhờ đó.

“Trong 21 năm của Reddit, một hằng số là các chiến thuật thư rác liên tục phát triển khi các công nghệ mới xuất hiện,” Jared Nelson, giám đốc cấp cao về truyền thông danh tiếng doanh nghiệp toàn cầu tại công ty, nói với The Verge trong một email. “Mỗi khi kẻ xấu thay đổi sách lược, chúng tôi lại củng cố sách lược của mình.”

Reddit cho biết khoảng 40 phần trăm các cuộc thảo luận trên nền tảng này mang tính chất thương mại

Nelson từ chối nêu tên các tín hiệu cụ thể mà hệ thống của họ tìm kiếm, nói rằng Reddit không muốn cung cấp cho kẻ xấu một cuốn cẩm nang để né tránh sự phát hiện. Nelson cho biết công ty đánh giá các tài khoản khi chúng được tạo, tìm kiếm sự thao túng có phối hợp giữa các tài khoản và cuộc trò chuyện, đồng thời sử dụng hoạt động trên nền tảng và báo cáo của người dùng để cải thiện khả năng phát hiện.

Một số thương hiệu đã bắt đầu tự tạo subreddit riêng nơi chính công ty kiểm duyệt cộng đồng trong nỗ lực thúc đẩy sự hiện diện của thương hiệu trên nền tảng. Mike Moschella, giám đốc phân tích tại DKC, một công ty tiếp thị và PR, cho biết Reddit và Wikipedia — những nơi mà các thương hiệu không thể chỉ đơn giản đổ các thông cáo báo chí của họ vào — đã trở thành ưu tiên hàng đầu.

“Reddit rất khó nhằn, đúng không? Bạn không thể lừa dối Reddit,” Moschella nói. Trong một thế giới mà người tiêu dùng đang tìm kiếm câu trả lời cho các câu hỏi cụ thể, được cá nhân hóa cao độ của họ, các thương hiệu nên có khả năng đưa ra lời chào hàng của mình rõ ràng hơn cho người tiêu dùng thay vì lặp lại những lời hứa cao siêu, thiếu chính xác về việc cung cấp sản phẩm tốt nhất trong danh mục của họ, ông nói. (Mua sắm là một phần rất lớn của Reddit: Nelson nói với The Verge rằng khoảng 40 phần trăm các cuộc thảo luận trên nền tảng này mang tính chất thương mại.)

“Điểm khởi đầu của tất cả các phân tích kinh doanh là ý tưởng rằng bạn có thể có giá tốt hơn, dịch vụ tốt hơn hoặc chất lượng tốt hơn, nhưng bạn không thể có cả ba,” Moschella nói. “Nếu bạn nói [cổ phiếu của công ty bạn] là cổ phiếu tốt nhất trong vũ trụ, bạn có thể phát hành thông cáo báo chí đó một triệu lần, nhưng WallStreetBets [subreddit] sẽ không mua nếu các nguyên tắc cơ bản không đồng ý.” Moschella nói, Reddit nên buộc các thương hiệu phải “trung thực và chân thực” hơn — ít nhất là trong một thế giới lý tưởng.

Liệu điều đó có thực sự xảy ra hay không lại là một câu hỏi khác. Không chỉ các subreddit chăm sóc da mới cảm nhận được tác động của thế giới tìm kiếm mới đầy táo bạo này. 404 Media đưa tin vào tháng 6 rằng các subreddit về biohacking đang phải đối mặt với sự tấn công dồn dập của thư rác quảng cáo về peptide. Trên subreddit giảm cân r/loseit, Dan, một quản trị viên, đã dốc toàn lực để cố gắng phát hiện và dọn dẹp nội dung quảng cáo được ngụy trang thành hoạt động chân thực. (Dan yêu cầu The Verge chỉ sử dụng tên riêng của anh để bảo vệ quyền riêng tư với tư cách là quản trị viên của một subreddit lớn.)

Trên r/loseit, Dan đã bắt gặp tài liệu quảng cáo ngầm cho mọi thứ, từ ứng dụng quét thực phẩm và cân quét cơ thể đến các nhà cung cấp GLP-1. (Dan cho biết các quản trị viên đã biên soạn một “danh sách đen các thương hiệu” mà họ tin là đang cố gắng quảng cáo bí mật. Những đề cập đến thương hiệu đó sẽ tự động bị lọc khỏi subreddit.) Dan nói, một người bình thường không quá quan trọng về cách họ nói về một chiếc đồng hồ thông minh mới mà họ có — họ thậm chí có thể không đề cập đến thương hiệu chính xác. Ngược lại, các thương hiệu đang nhồi nhét từ khóa, sử dụng tên chính xác và thảo luận về sản phẩm theo hướng tích cực.

“Lợi thế chính mà chúng tôi có với tư cách là những người cố gắng ngăn chặn [các thương hiệu] quảng cáo là họ có một chương trình nghị sự mà một người đăng bài bình thường không có, và đó thường là điều cơ bản lộ ra và đó là cách chúng tôi phát hiện ra họ,” anh nói.

Dan cũng đã thấy ngày càng nhiều bài đăng mà anh tin là do AI tạo ra, dựa trên một số dấu hiệu nhận biết: Ví dụ, đoạn cuối của một bài đăng bắt đầu bằng “Tôi tò mò muốn biết”. Giữa các công cụ tự động kiểm duyệt và các thành viên cộng đồng chủ động báo cáo các quảng cáo bị nghi ngờ, các quản trị viên r/loseit có thể lọc bỏ phần lớn các nhà tiếp thị đang cố gắng quảng bá sản phẩm của họ.

“Chúng tôi muốn đó là sự tương tác giữa người với người vì đó là lý do tại sao tôi thích subreddit đó ngay từ đầu,” Dan nói. “Tôi thấy rất tốt khi mọi người nói chuyện với nhau bên ngoài một nơi liên tục quảng cáo cho bạn.”

Tất nhiên, thư rác tự quảng cáo trên Reddit đã diễn ra trong nhiều năm, với mức độ thành công khác nhau. Nhưng kỷ nguyên thao túng tìm kiếm bằng AI này xuất hiện vào thời điểm mà khán giả đang tìm kiếm lý do để nghi ngờ những gì họ thấy trực tuyến.

RedditAI SpamSEOThao túng nội dungAn toàn mạng
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ The Verge: AI. Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.