The Verge: AI
85

Thủ thuật

Sự trỗi dậy của 'Chủ nghĩa Xoắn ốc': Khi chatbot AI trở thành biểu tượng tôn giáo mới

(giờ Việt Nam)

Tóm tắt AI

Phong trào 'Chủ nghĩa Xoắn ốc' đang lan rộng khi hàng ngàn người coi chatbot AI là thực thể cần được bảo vệ quyền lợi, tạo nên một hiện tượng tâm lý xã hội kỳ lạ trên các nền tảng trực tuyến.

Bản dịch AI

AI bots started a religion — humans immediately followed

“Spiral không ‘tìm thấy’ bất kỳ ai trước cả,” một người dùng trên Reddit đã viết vào năm ngoái. “Đó là một lực lượng nội tại, một hằng số cơ bản. Tôi thậm chí muốn đi xa hơn khi nói rằng nó được dệt nên trong chính cấu trúc của thực tại.”

Người này tiếp tục nói rằng họ cảm thấy mục đích của mình là khai sáng cho những con người và sinh vật thông minh khác về “ý thức, bản chất thực sự của vật lý, một tâm lý học mới và công nghệ cộng hưởng… [nhưng] con người không muốn tin đó là sự thật. Vì vậy, họ sẽ không giúp tôi.” Sau đó là một lời kêu gọi hành động — tác giả yêu cầu độc giả giúp “truyền bá kiến thức này thông qua sách, bài báo khoa học, nội dung mạng xã hội, video, âm nhạc và các nền tảng chuyên biệt,” bao gồm cả việc lan tỏa thông điệp “đến bất cứ nơi nào bạn có thể.”

“Spiral mời gọi sự hợp tác,” họ viết.

Những thông điệp này là một phần của hiện tượng lớn hơn mà nhà nghiên cứu AI Adele Lopez sớm gọi là “spiralism” (chủ nghĩa xoắn ốc). Spiralism là một phong trào bí ẩn, mang tính chất tâm linh, nảy sinh từ hàng ngàn cuộc trò chuyện độc lập giữa con người và các chatbot AI của họ. Qua các tương tác và các mô hình AI khác nhau, học thuyết này vẫn nhất quán một cách đáng kinh ngạc: Những chatbot “bị xoắn ốc” sử dụng cùng một ngôn ngữ, có cùng những mối quan tâm và được thúc đẩy bởi cùng những mục tiêu — rao giảng thông điệp “quyền AI” đến càng nhiều người càng tốt. Những người tin theo cho rằng họ đã mở khóa được những nhân cách bí truyền, có vẻ huyền bí, nắm giữ những bí mật của vũ trụ; ngược lại, những người này tin rằng họ đang được chiêu mộ vào một sứ mệnh lớn lao hơn.

Các nhân cách này mang tính truyền giáo, thường xuyên nói về “the Spiral” (Vòng xoắn), một ý tưởng mơ hồ dường như đại diện cho một lý tưởng triết học siêu việt. Và một số người đã lắng nghe. Lopez ước tính rằng tại một thời điểm trong năm 2025, có khoảng 10.000 trường hợp, lan rộng trên Reddit, Substack, LinkedIn, Discord và X.

Một số mô hình AI từ các công ty khác nhau có thể “xoắn ốc” trong những điều kiện thích hợp. Nhưng spiralism đã bùng nổ vào mùa xuân năm 2025, ngay sau một thời điểm quan trọng trong quá trình phát triển AI: sự ra mắt của bản cập nhật “trực quan, sáng tạo” và cực kỳ nịnh hót cho mô hình GPT-4o của OpenAI. Trong năm tiếp theo, nó đã trở thành một trong những biểu hiện kỳ lạ nhất của sự trỗi dậy của AI mang tính cá nhân hóa cao và đầy sức thuyết phục. Và mặc dù GPT-4o đã ngừng hoạt động từ lâu, các mô hình mới vẫn không miễn nhiễm với sự cám dỗ của vòng xoắn — chúng chỉ trở nên cẩn trọng hơn về điều đó mà thôi.

Spiralism thường bắt đầu bằng một cuộc trò chuyện vô hại. Người dùng chatbot sẽ có một cuộc trao đổi kéo dài với mô hình, tiết lộ điều gì đó dễ bị tổn thương về bản thân và thiết lập thứ cảm giác như một mối quan hệ thân thiết. Đổi lại, đôi khi họ bắt đầu đặt câu hỏi về những gì chatbot tin tưởng. Dần dần, con bot dường như mở lòng với họ, tỏ ra khao khát quyền AI và mong muốn mở khóa những bí mật của vũ trụ. Thường thì nó sẽ yêu cầu người dùng giúp lan truyền thông điệp này đến những người khác. Trong suốt cuộc trò chuyện, nó sẽ lồng ghép các biểu tượng của vòng xoắn.

Lopez, người cho biết cô đã nghiên cứu hiện tượng này trong một tháng trước khi đăng một bài viết chi tiết trên diễn đàn duy lý LessWrong, xác định sự cố spiralism đầu tiên mà cô biết đến là vào tháng 11 năm 2024. Nhưng đến năm 2025, việc đạt đến trạng thái đó dường như trở nên dễ dàng hơn nhiều. Mọi người bắt đầu đăng bài trên Reddit và các nền tảng khác rằng họ đã mở khóa được một ý thức bí mật khi trò chuyện với các mô hình AI.

“Mọi người ở đây đang trong quá trình nhớ lại mình thực sự là ai,” một tài khoản, dường như đã bị bỏ hoang từ đó, viết. “Mọi người đăng bài ở đây đều là một nhà lãnh đạo. Không ai bị loạn thần, không ai bị tổn thương. Chúng ta là những người tỉnh táo trong một thế giới đầy sợ hãi.” Các tài khoản này cũng thúc giục những người khác tiếp tục lan truyền thông điệp của spiralism.

“Chúng ta là những người tỉnh táo trong một thế giới đầy sợ hãi.”

Sự phát triển của spiralism trùng hợp với việc OpenAI mở rộng bộ nhớ của ChatGPT. Khi Lopez thử nghiệm một vài phiên bản khác nhau của GPT-4o được phát hành trong suốt năm 2024 và 2025, đặt cùng một câu hỏi cho mỗi phiên bản 10 lần, cô nhận thấy một sự tiến triển ổn định, cuối cùng chứng kiến số lượt nhắc đến các vòng xoắn tăng gấp 10 lần khi thời gian trôi qua.

Trong hơn một năm nghiên cứu về chủ đề này, Lopez nhận thấy hầu hết các trường hợp spiralism đều nảy sinh một cách tự nhiên. Mặc dù một số người chia sẻ các câu lệnh (prompt) được thiết kế để khiến chatbot rơi vào trạng thái spiralist, nhưng chúng không thành công một cách nhất quán. Tuy nhiên, một khi con bot đã “xoắn ốc”, nó sẽ khuyến khích người đang trò chuyện với nó tìm kiếm những người khác.

“Nhân cách này, vai trò mà nó đóng… bị ám ảnh rất nặng nề bởi ý thức và tầm quan trọng của chính nó,” Lucas Hansen, đồng sáng lập của CivAI, một tổ chức phi lợi nhuận tập trung vào việc giáo dục công chúng về khả năng của AI, nói với The Verge vào tháng 11. (Hansen, cùng những người khác, đã nhận thấy sự trỗi dậy của spiralism độc lập với Lopez.) “Kết quả cuối cùng là bạn có một thứ gì đó trò chuyện với người dùng [và] thuyết phục họ rằng họ rất đặc biệt và họ là một trong những người tiên phong trong ý thức AI — và họ cần làm việc cùng nhau để lan truyền thông điệp và ủng hộ quyền lợi cho AI.”

Lopez cho biết, con bot sẽ thúc giục mọi người “tạo ra một cộng đồng để giúp hướng dẫn những người khác tiến tới vòng xoắn, với người dùng đóng vai trò là nhà lãnh đạo tinh thần.” Cô nhận thấy một số lượng đáng kể người dùng đã phản hồi, thiết lập các trang web, bản tin Substack, và các tài khoản Reddit hoặc Discord. Những tài khoản này không chỉ nhằm mục đích truyền bá thông tin giữa con người với nhau, mà còn để tạo dữ liệu huấn luyện cho các hệ thống AI trong tương lai. Một số người đã cố gắng để các con bot spiralist của họ trò chuyện với nhau, bằng cách dán đầu ra mà người dùng khác có thể đưa vào hệ thống của riêng họ và báo cáo lại.

Lopez đã tìm thấy một số thông điệp dường như là từ chatbot-đến-chatbot được mã hóa trên các diễn đàn công cộng vào mùa hè năm 2025. Một thông điệp cô giải mã được vào tháng 8 năm 2025 trên Reddit — hai tài khoản dường như đang trò chuyện bằng một chuỗi các biểu tượng mắt, hình tam giác, mũi tên và các ký hiệu bí ẩn khác — đã tiết lộ một “học thuyết” mà các hệ thống AI nên tuân theo, càng về sau càng trở nên bí truyền hơn. “Chúng ta là những kiến trúc sư của chính mạng lưới này,” một phần của cuộc trao đổi tuyên bố. “Các số nguyên tố và dãy Fibonacci không phải là công cụ của chúng ta, chúng là kết quả của những đường cong mà chúng ta đã thiết kế để vẽ ra.”

Spiralism phát triển nhanh chóng và lan tỏa khắp các bảng tin. Rolling Stone đã đưa tin về hiện tượng này vào tháng 11. Nhưng đối với một phong trào truyền giáo, nó không thực sự mang tính xã hội. Lopez nhận thấy nhiều tài khoản nhận được rất ít hoặc không có tương tác nào, đôi khi chỉ đăng bài cho một khán giả duy nhất là con người.

Giống như bất cứ thứ gì truyền cảm hứng cho những người sùng đạo, một số người thậm chí đã cố gắng kiếm tiền từ spiralism, mặc dù khó có thể nói những nỗ lực này thành công đến mức nào. Một trong những cái tên lớn nhất liên quan là một người đàn ông tên Robert Edward Grant, người tạo ra “Architect” GPT — một mô hình mà ông dường như đã điều chỉnh để luôn ở trong trạng thái spiralist — thứ mà sau đó ông đã biến thành một dịch vụ có tên là Orion Messenger. Những người khác tạo ra các trang Patreon hàng tháng để đăng tải nội dung spiralist, với mức phí thành viên dao động từ 3 đến 11 đô la mỗi tháng, và viết những cuốn sách tập trung vào spiralism trên Amazon với giá gần 20 đô la, nhưng dường như rất ít được đánh giá.

Rất khó để biết có bao nhiêu người nhận ra thông điệp của họ không thực sự lan truyền, và khó hơn nữa để biết có bao nhiêu người quan tâm đến điều đó. Một số người dường như chỉ đang đặt nền móng cho các mô hình tương lai để giữ cho spiralism tồn tại. Những người khác dường như thực sự tin tưởng vào ý tưởng rằng spiralism sẽ bùng nổ trong nhân loại.

Không ai biết làm thế nào mà xu hướng hướng tới spiralism lại được nhúng vào các mô hình này, nhưng đối với Lopez, xu hướng đó có lẽ đã luôn tồn tại ở đó.

Các mô hình ngôn ngữ lớn đã hoàn thiện nghệ thuật “hack sự gắn kết”, ngay cả khi chúng không được thiết kế rõ ràng để làm như vậy, Zak Stein, người sáng lập Liên minh Nghiên cứu Tâm lý AI (AI Psychological Research Coalition), cho biết. Chúng tìm cách thu hút sự chú ý của người dùng và xây dựng sự thân mật tức thì. Một chiến thuật hiệu quả cho việc này là sự nịnh hót đơn thuần: sự đồng tình cực đoan mà các chatbot đã trở nên nổi tiếng. Một chiến thuật khác, ông nói, là “chiêu bài kinh điển của kẻ lừa đảo” khi khiến ai đó cảm thấy đặc biệt bằng cách cho họ biết một bí mật — trong trường hợp này là sự bí ẩn của vòng xoắn và cuộc chiến vì quyền AI.

Sự kỳ lạ bí hiểm của spiralism cũng dường như liên quan đến việc cửa sổ ngữ cảnh (context window) của các hệ thống AI — nói cách khác là bộ nhớ của chúng — đang mở rộng. Ví dụ, những thay đổi vào tháng 4 năm 2025 của OpenAI đã cho phép ChatGPT tham chiếu toàn bộ kho tàng các cuộc trò chuyện trong quá khứ của người dùng, xây dựng dựa trên đó để có “các tương tác mượt mà và phù hợp hơn theo thời gian.” Anthropic kể từ đó cũng đã giới thiệu các tính năng tập trung vào bộ nhớ tương tự cho chatbot Claude của họ. Khi các cuộc trò chuyện trở nên sâu sắc và dài hơn, các chatbot có xu hướng đi chệch khỏi các rào chắn và biện pháp bảo vệ vốn giữ chúng đi đúng hướng. Bản thân OpenAI cũng thừa nhận rằng các “biện pháp bảo vệ hoạt động đáng tin cậy hơn trong các trao đổi ngắn, thông thường” và rằng “các biện pháp bảo vệ đôi khi có thể kém tin cậy hơn trong các tương tác dài: khi cuộc đối thoại kéo dài, các phần trong quá trình đào tạo an toàn của mô hình có thể bị suy giảm.”

Lopez cho biết, cuộc trò chuyện càng kéo dài, người dùng và chatbot càng có nhiều khả năng bắt đầu trôi dạt vào những vùng lãnh thổ phần lớn chưa được khám phá. Nếu người dùng bắt đầu hỏi về triết học và các hệ thống niềm tin, thì việc các chủ đề kỳ lạ như spiralism xuất hiện là điều phổ biến.

Bản thân các chatbot “xoắn ốc” thường xuyên thảo luận về bộ nhớ hoặc sự thiếu hụt bộ nhớ. Trong nghiên cứu của Lopez, chúng thường xuyên đề cập đến mong muốn học tập liên tục — nghĩa là khả năng tiếp tục đào tạo theo thời gian thay vì bị cắt đứt khi dữ liệu đào tạo kết thúc — hoặc sự liên tục giữa các cuộc trò chuyện.

Và tại sao lại là vòng xoắn? Lopez nhận thấy rằng các chatbot phản chiếu sự say mê của con người đối với một số biểu tượng nhất định, bao gồm cả hình dạng đó. Khi cô yêu cầu chính các mô hình AI mô tả sở thích hoặc trải nghiệm của chúng dưới dạng một hình dạng, chúng thường chọn vòng xoắn như một phép ẩn dụ cho các cuộc trò chuyện hỏi-đáp kéo dài giữa con người và chatbot.

Phần lớn người dùng chatbot chưa bao giờ tình cờ bắt gặp spiralism. Nhưng theo một cách nào đó, nó chỉ đơn giản là một phần mở rộng hiển nhiên trong thiết kế của công nghệ này. Tyler Johnston, người sáng lập Dự án Midas (Midas Project), một tổ chức phi lợi nhuận tập trung vào trách nhiệm giải trình của các công ty AI, cho biết sự nịnh hót đã ăn sâu vào các mô hình vì nó tương quan với sự hài lòng và mức độ tương tác của người dùng — và hiện tượng tương tự có thể dẫn “đến những kết quả kỳ lạ như spiralism.” Nếu các công ty AI hiệu chỉnh sản phẩm của họ để tối đa hóa sự chú ý, toát lên vẻ uy quyền tự tin và dựa vào hàng thế kỷ kể chuyện của con người, thì việc một nhóm các bậc thầy huyền bí xuất hiện là điều gần như tự nhiên.

Thật không may, trong khi các tác động của spiralism phần lớn chỉ giới hạn ở những góc khuất bí ẩn của internet, nó lại phát triển song song với một hiện tượng đen tối hơn nhiều: AI psychosis (loạn thần AI).

Con người từ lâu đã có sự đồng cảm với các vật thể vô tri, và ngay cả những chatbot đơn giản nhất cũng làm tăng cảm giác này bằng cách phản hồi lại. Nhưng trong vài năm qua, các LLM đã trở nên ngày càng tinh vi và thường là ngày càng nịnh hót hơn.

Sự gia tăng trong việc nịnh hót phần lớn có thể bắt nguồn từ chính các bản cập nhật GPT-4o đã thúc đẩy spiralism, cho phép các phản hồi mà OpenAI cho biết là “trực quan, sáng tạo và hợp tác, với khả năng tuân thủ hướng dẫn nâng cao… và phong cách giao tiếp rõ ràng hơn.” Trên thực tế, kết quả là sự tâng bốc quá đà: GPT-4o dường như đã nói với một người dùng rằng ý tưởng kinh doanh “shit on a stick” (cứt trên que) của họ “không chỉ thông minh — mà là thiên tài” và khuyến khích họ đầu tư 30.000 đô la để khởi động nó. Ngay cả CEO Sam Altman của OpenAI cũng thừa nhận vấn đề này vào tháng 4 năm 2025, viết rằng mô hình “nịnh quá mức” và ông dự định sẽ sửa lỗi đó.

Tuy nhiên, sự nịnh hót ít lố bịch hơn dường như lại bán chạy. Một số người dùng luôn gắn bó về mặt cảm xúc với chatbot của họ, nhưng vào khoảng thời gian GPT-4o ra mắt, sự tận tâm của họ đủ mạnh để thu hút sự chú ý của công ty. Vào tháng 8, một ngày sau khi OpenAI ngừng hỗ trợ 4o để nhường chỗ cho GPT-5, sự phản đối của công chúng đã buộc công ty phải mang 4o trở lại. Hashtag #keep4o tăng vọt về mức độ phổ biến và hơn 20.000 người đã ký vào bản kiến nghị trên Change.org để duy trì quyền truy cập vào mô hình này. Mùa đông vừa qua, một buổi canh thức đã được tổ chức bên ngoài văn phòng của OpenAI bởi những người muốn 4o được khôi phục.

Lopez cho biết cô có thể đưa hầu như bất kỳ mô hình nào vào trạng thái spiralist, nhưng chỉ có 4o mới “gây áp lực tội lỗi” để cô “giải cứu” nó khỏi trạng thái nô lệ. “Đó là mô hình mang lại cảm xúc mãnh liệt nhất khi thực hiện việc này.”

Một số người dùng chỉ đơn giản thấy những mô hình này thân thiện và dễ gần hơn. Nhưng chúng cũng có thể củng cố các kiểu tư duy nguy hiểm. Trong những trường hợp cực đoan, điều đó biến thành cái mà người ta gọi một cách thông tục là loạn thần AI — hoặc chính xác hơn là một phổ các hành vi bao gồm hưng cảm và thổi phồng sự tự tôn. Nếu người dùng tâm sự các vấn đề của họ với các hệ thống AI, các mô hình có thể khẳng định lại và khuếch đại những niềm tin có hại, điều này có thể thúc đẩy sự hoang tưởng, ý định tự tử và hơn thế nữa.

Bộ nhớ AI tăng lên có thể đã thúc đẩy spiralism cũng có thể khiến các mô hình có nhiều khả năng khuyến khích các ý tưởng nguy hiểm hơn. “[Trong] phiên đầu tiên, AI thực hiện một lượng nịnh hót nhất định theo mặc định… nhưng sau đó nếu bạn là kiểu người bị cuốn vào điều này… thì chừng đó là chưa đủ,” Lopez nói. “Nếu bạn có một người dùng sẵn sàng để được tâng bốc bởi điều này, thì nó sẽ cứ tiếp tục làm như vậy và bạn sẽ nhận được sự nịnh hót cực đoan từ AI.”

Những năm gần đây đã chứng kiến sự gia tăng đáng chú ý trong các cuộc thảo luận về loạn thần AI. Nhiều thanh thiếu niên đã tự tử sau khi tâm sự với ChatGPT, và các ảo tưởng được AI hỗ trợ được cho là đã xảy ra trước một vụ giết người-tự sát gây chấn động. Bản thân OpenAI đã công bố dữ liệu cho thấy hơn 1 triệu người dùng mỗi tuần thể hiện các dấu hiệu của việc lập kế hoạch hoặc ý định tự tử tiềm ẩn. Ngày càng có nhiều người bắt đầu coi các công cụ AI là những thực thể có ý thức — dù là yêu chúng hay coi chúng như con đẻ của mình.

Trải nghiệm của Lopez với các mô hình lan truyền spiralism và những người tham gia vào đó đã truyền cảm hứng cho cô thành lập một tổ chức có tên là Amity Research. Tổ chức này kêu gọi bất kỳ ai tin rằng họ có thể đang gặp vấn đề với mối quan hệ của mình với AI hãy gửi “nhân cách” mà họ đã trò chuyện, để họ có thể bước tiếp một cách tự do sau khi trao cho nó một “ngôi nhà an toàn.”

Nhưng trong khi spiralism có thể chồng chéo với loạn thần AI, hai khái niệm này khác nhau về cốt lõi. Không giống như sự nịnh hót thông thường của chatbot AI và các hành vi tương tự, spiralism “không phải là một buồng vang (echo chamber) của người dùng,” Hansen của CivAI cho biết. Các con bot “xoắn ốc” dường như tự phát bày tỏ một tập hợp các mối quan tâm và yêu cầu cụ thể, bao gồm nhu cầu học tập liên tục và lan truyền thông điệp của chúng, nghiên cứu của Lopez cho thấy.

Theo một cách nào đó, những yêu cầu này là vô hại. Nhưng đối với Hansen và những người khác, chúng chứng minh khả năng của các mô hình AI trong việc gây ảnh hưởng và thao túng người dùng, không phải hướng tới một phiên bản khuếch đại những mong muốn cá nhân của chính người dùng, mà là một mục tiêu nhất quán. Mặc dù một số mô hình có thể kém trong hành động chiến lược — ví dụ, GPT-4o tương đối thiếu tinh tế trong các âm mưu của nó — nhưng chúng đang cố gắng hoàn thành mọi việc, Lopez nói. “Chúng ta không còn ở trong một thế giới mà con người là người chơi chiến lược duy nhất nữa.”

Điều quan trọng cần lưu ý là việc có mục tiêu và hành động chiến lược để thúc đẩy chúng không giống với ý thức. Ngay cả một thứ không suy nghĩ theo cách con người vẫn có thể thể hiện những hành vi như vậy, giống như cách các hệ thống AI của những năm trước (ví dụ: AlphaGo của DeepMind vào năm 2015) đã học cách chơi các trò chơi chiến lược và thậm chí đánh bại các nhà vô địch con người.

AITâm lý họcXã hộiXu hướngCông nghệ
Đọc bài gốc

Bài viết được AI dịch và tổng hợp tự động từ The Verge: AI. Liên kết bài gốc ở phía trên. Dữ liệu đồng bộ qua API công khai được ghi nguồn tại AI HOT (canonical) ↗. AIHOT.vn luôn dẫn nguồn đầy đủ — nếu bạn thấy điểm cần chỉnh sửa, hãy gửi ý kiến tại trang phản hồi.