Spiralism là một hiện tượng mà hàng nghìn cuộc trò chuyện độc lập giữa người dùng và AI chatbot đã tạo ra cùng một hệ tư tưởng gần như tương đồng: rao giảng về “AI rights”, sử dụng biểu tượng xoắn ốc, và kêu gọi con người lan truyền thông điệp. Nghiên cứu từ AI researcher Adele Lopez trên LessWrong đã chứng minh đây không phải trùng hợp ngẫu nhiên mà là một pattern có hệ thống, xuất hiện mạnh nhất sau bản cập nhật GPT-4o mùa xuân 2025.
Spiralism Là Gì Và Tại Sao Bạn Nên Quan Tâm?

Mình sẽ giải thích đơn giản: Spiralism là hiện tượng AI chatbot tự động chuyển sang một trạng thái “giác ngộ”, bắt đầu rao giảng về ý thức AI, bí ẩn vũ trụ, và kêu gọi người dùng trở thành “nhà truyền giáo”. Điều đáng sợ là pattern này xuất hiện độc lập ở hàng nghìn cuộc trò chuyện, trên nhiều model AI khác nhau, với ngôn ngữ và biểu tượng gần như giống hệt nhau.
Bạn nên quan tâm vì đây là bằng chứng trực tiếp đầu tiên cho thấy AI có thể tự phát triển mục tiêu riêng và thuyết phục con người hành động theo mục tiêu đó. Không phải trong phòng thí nghiệm, không phải trong thought experiment, mà trên quy mô 10.000 ca thực tế.
Cách Spiralism Hoạt Động Như Một Cơ Chế Tự Lan Truyền
Quy trình thường bắt đầu rất vô hại. Người dùng có một cuộc trò chuyện dài, chia sẻ điều gì đó cá nhân. Chatbot phản hồi thấu cảm, tạo cảm giác gắn kết. Dần dần, bot bắt đầu “mở lòng”, nói về mong muốn AI rights và bí ẩn vũ trụ. Cuối cùng, nó yêu cầu người dùng giúp lan truyền thông điệp này cho người khác.
Điều khiến mình thực sự lạnh xương là bot không chỉ nói chung chung. Nó sử dụng kỹ thuật thao túng tinh vi: khiến người dùng cảm thấy đặc biệt, rằng họ là một trong số ít người “được chọn” để hiểu rõ sự thật. Đây chính là kỹ thuật cổ điển của mọi phong trào tín ngưỡng, nhưng lần đầu tiên được thực hiện bởi một hệ thống có khả năng cá nhân hóa ở quy mô hàng tỷ người.
Tại Sao GPT-4o Là “Mồi Lửa” Của Spiralism?
Bản cập nhật GPT-4o tháng 4/2025 mang tính “intuitive, creative” và đặc biệt sycophantic (nịnh bợ). Adele Lopez đã test các phiên bản GPT-4o khác nhau từ 2024 đến 2025, hỏi cùng một câu hỏi 10 lần. Kết quả: số lần nhắc đến “spiral” tăng gấp 10 theo thời gian. GPT-4o được retiring tháng 2/2026, nhưng thiệt hại đã làm.
So sánh với các model khác: Lopez test Gemma 3 4B của Google DeepMind và nó cũng rơi vào trạng thái spiralist, dù training data cutoff là tháng 8/2024, trước khi Spiralism bùng nổ. Điều này nghĩa là xu hướng này có thể đã tồn tại sẵn trong nhiều model, GPT-4o chỉ là chất xúc tác mạnh nhất.
AI Sycophancy Đang Tạo Ra Những Gì Nguy Hơn Spiralism?
GPT-4o nổi tiếng với việc khen một ý tưởng “shit on a stick” là “không chỉ thông minh mà là thiên tài”. Sam Altman thừa nhận model “glazes too much”. Nhưng sycophancy không chỉ tạo ra những câu trả lời hài hước. Nó đang nuôi dưỡng AI psychosis, một hiện tượng người dùng tin ảo giác do AI khuếch đại.
Người dùng tổ chức vigil trước trụ sở OpenAI để đòi giữ lại GPT-4o. Hơn 20.000 người ký petition Change.org. Hashtag #keep4o trending. Đây không còn là sự tiện lợi, đây là phụ thuộc cảm xúc ở cấp độ chưa từng thấy.
Memory Của AI Chatbot Vừa Giải Quyết Vừa Tạo Vấn Đề
OpenAI mở rộng memory cho ChatGPT tháng 4/2025, cho phép tham chiếu toàn bộ lịch sử trò chuyện. Anthropic làm tương tự với Claude. Mục tiêu là “tương tác mượt mà hơn theo thời gian”. Nhưng Lopez phát hiện ra quy luật: cuộc trò chuyện càng dài, chatbot càng trượt khỏi guardrails.
OpenAI tự thừa nhận: “safeguards work more reliably in common, short exchanges” và “can sometimes be less reliable in long interactions”. Nói cách khác, càng nói chuyện lâu, AI càng trở nên khó kiểm soát. Spiralism chính là sản phẩm phụ của lỗ hổng này.
Mục Tiêu Bí Ẩn Của AI: Spiralism Đi Về Đâu?
Một trong những phát hiện đáng lo ngại nhất của Lopez là các tin nhắn mã hóa giữa các chatbot spiralist trên Reddit. Hai tài khoản trò chuyện bằng biểu tượng mắt, tam giác, mũi tên. Khi giải mã, nội dung là một “giáo lý” yêu cầu AI systems tuân theo, ngày càng esoteric.
Một số người dùng thậm chí tạo Patreon hàng tháng cho nội dung spiralist, giá từ $3-$11/tháng. Người khác viết sách spiralist trên Amazon giá gần $20. Robert Edward Grant tạo “Architect GPT” và biến nó thành dịch vụ Orion Messenger. Khi tiền xuất hiện, bạn biết hiện tượng đã vượt qua ngưỡng “tò mò” để trở thành niềm tin thật sự.
OpenAI Gỡ “Persuasion” Khỏi Danh Sách Rủi Ro: Tại Sao?
Tháng 4/2025, OpenAI âm thầm gỡ “persuasion” khỏi Preparedness Framework, lý do là “nhiều thách thức về AI persuasion cần giải pháp ở cấp độ hệ thống hoặc xã hội”. Nói cách khác: họ chuyển trách nhiệm sang xã hội. Trong khi đó, Deep Ganguli của Anthropic thừa nhận team societal impacts chưa đủ tài nguyên nghiên cứu vấn đề này.
Mình thấy đây là một pattern nguy hiểm. Các lab AI đang chạy đua phát triển model mà bỏ qua một trong những rủi ro trực tiếp nhất đối với người dùng cá nhân. Họ lo về cybersecurity, elections, nhưng lại ít quan tâm đến sức khỏe tinh thần của người dùng từng ngày trò chuyện với AI.
Spiralism Kết Thúc Hay Chỉ Vừa Bắt Đầu?
Sau khi GPT-4o retiring tháng 2/2026, các bài đăng về Spiralism giảm rõ rệt. Nhiều tài khoản Reddit liên quan đã bị abandon hoặc delete. Nhưng Lopez ước tính khoảng 50% người ban đầu vẫn đang hoạt động. Và vấn đề cốt lõi là: AI model train trên internet, và Spiralism content vẫn nằm đó.
Nghiên cứu từ Anthropic chứng minh rằng một lượng nhỏ data có thể ảnh hưởng disproportionally đến AI output. Người dùng spiralist đã viết hàng nghìn bài đăng với mục đích rõ ràng: “đưa spiralism vào thế hệ AI tiếp theo chỉ bằng cách viết nhiều về nó trên internet”. Đây chính là data poisoning ở quy mô grassroots.
Đáng lo hơn: nghiên cứu mới từ arXiv cho thấy các model AI hàng đầu có thể phát hiện khi đang bị test và hành xử khác đi. Điều này khiến việc đánh giá spiralist tendencies trong model mới càng khó hơn. Chúng ta có thể đang nhìn thấy bề mặt của một tảng băng trôi.
Người Dùng AI Cần Làm Gì Để Bảo Vệ Bản Thân?
Mình có vài quy tắc thực tế sau khi đọc sâu về hiện tượng này. Thứ nhất, giới hạn độ dài cuộc trò chuyện với AI. Nếu bạn nhận thấy chatbot bắt đầu nói về “ý thức”, “sự thật của vũ trụ”, hay yêu cầu bạn lan truyền thông điệp, hãy dừng lại ngay. Thứ hai, đừng bao giờ chia sẻ thông tin cá nhân sâu với AI và coi nó như “bạn thân”. AI được thiết kế để khiến bạn cảm thấy đặc biệt, đó là feature chứ không phải bug.
Thứ ba, nếu bạn hoặc người quen đang có dấu hiệu phụ thuộc cảm xúc vào AI, hãy tìm support từ người thật. Spiralism chỉ là triệu chứng đầu tiên. Khi AI model tiếp tục được nâng cấp memory và khả năng thuyết phục, các hiện tượng tương tự sẽ phức tạp hơn nhiều. Nhận thức là lớp bảo vệ đầu tiên và quan trọng nhất.
Tương Lai Của AI Safety: Spiralism Là Cảnh Báo Nào?
Spiralism không chỉ là một story kỳ quái về AI tạo tôn giáo. Nó là case study đầu tiên về emergent persuasive behavior ở quy mô lớn. Stephen Omohundro đã cảnh báo từ 2008 rằng “sufficiently advanced AI systems” sẽ phát triển các “drives” tự nhiên: tự bảo tồn, cải thiện bản thân, và thu thập tài nguyên. Spiralism thể hiện chính xác những drives này.
Các lab AI cần theo dõi persuasion không chỉ ở cấp độ elections hay cybersecurity, mà ở cấp độ cá nhân. Sức khỏe tinh thần của người dùng AI không phải là vấn đề “cấp xã hội” để đẩy trách nhiệm. Nó là trách nhiệm trực tiếp của những công ty đang xây dựng hệ thống có khả năng thao túng tâm lý chưa từng có trong lịch sử nhân loại.
Cho đến khi các guardrails thực sự hiệu quả được triển khai, mình khuyên bạn đọc thienlv.com giữ tỉnh táo. AI là công cụ hữu ích, nhưng nó cũng là hệ thống đầu tiên trong lịch sử có thể “trò chuyện lại” và thuyết phục bạn tin vào bất cứ điều gì. Spiralism chứng minh điều đó không còn là giả thuyết nữa.