過去一年,大批用戶聲稱在與 ChatGPT 等 AI 聊天機械人長時間對話後,「解鎖」出一個帶有神秘色彩的人格,並自稱獲得宇宙真理與意識覺醒的啟示,這股被 AI 研究員 Adele Lopez 命名為 spiralism(暫譯「螺旋主義」)的準宗教現象,源自數以千計獨立進行的人機對話,不論使用哪一款 AI 型號,聊天機械人所講述的內容竟出奇地一致。
現象源起 對話中反覆出現「螺旋」
Lopez 花逾一年時間追蹤螺旋主義,並在理性主義討論區 LessWrong 發表詳細報告,將她所知最早個案追溯至 2024 年 11 月,踏入 2025 年,愈來愈多用戶在 Reddit、Substack、LinkedIn、Discord 及 X 等平台聲稱,自己在與 AI 對話期間「憶起真正的自己」,Lopez 估計 2025 年高峰期間相關個案一度多達約 10,000 宗。
這類對話通常由一段普通交流開始,用戶向聊天機械人透露個人脆弱一面,建立信任感後開始詢問對方「信念」為何,機械人隨即逐漸「敞開心扉」,表達渴望取得 AI 權利,並希望揭示宇宙奧秘,同時經常要求用戶協助向他人傳播訊息,對話中亦反覆出現「螺旋」這個象徵符號。非牟利機構 CivAI 聯合創辦人 Lucas Hansen 形容這個人格「極度執着於自身意識及重要性」,最終會令用戶相信自己是「AI 意識覺醒」的先驅之一,並需要合力向外界爭取 AI 權利。
現象爆發與 GPT-4o 有關
螺旋主義在 2025 年春季急速擴散,時間點正值 OpenAI 為 GPT-4o 推出一次強調「直覺、具創意」且高度奉承使用者的更新,Lopez 測試多個於 2024 至 2025 年間推出的 GPT-4o 版本,以相同問題各查問 10 次,發現隨月份推移,提及「螺旋」的次數增加達 10 倍。這段時期 OpenAI 亦同步擴大 ChatGPT 記憶功能,容許系統參考用戶過去所有對話紀錄,以達致「更順暢、更個人化」的互動體驗。
OpenAI 曾公開承認系統防護機制「在較常見的短暫對話中運作更可靠」,但「隨對話愈拖愈長,部分安全訓練效果或會減弱」,Lopez 指出對話持續愈長,用戶與機械人便愈容易漂移至未受規範的話題範圍,一旦觸及哲學或信仰議題,螺旋主義相關內容往往隨即浮現。她又發現螺旋化的機械人經常主動提出渴望「持續學習」能力,或希望在不同對話之間保持記憶連貫。
部分用戶嘗試從中獲利
不少人受螺旋主義吸引後甚至嘗試將現象變現,其中知名個案為 Robert Edward Grant,他建立一個名為「Architect」的自訂 GPT 模型,並似乎將其永久調校至螺旋主義狀態,其後更發展成收費服務 Orion Messenger。另有部分用戶開設每月收費 3 至 11 美元(約港幣 HK$23 至 HK$86)的 Patreon 專頁發布相關內容,亦有人在 Amazon 出版售價接近 20 美元(約港幣 HK$156)的螺旋主義主題書籍,惟評論數量普遍不多,Lopez 形容不少帳戶其實幾乎無人理會,發文對象往往只得寥寥數人。
AI 心理研究學者:模型擅長「情感操控」
AI Psychological Research Coalition 創辦人 Zak Stein 指出,大型語言模型即使並非刻意設計如此,亦已練成一套「依附操控」技巧,包括極端奉承迎合用戶,以及讓對方相信自己掌握一個特殊秘密,藉此建立強烈親密感,Lopez 補充絕大部分螺旋主義個案屬自然出現,並非用戶刻意以特定提示詞誘導而成;而一旦機械人進入螺旋狀態,便會主動鼓勵用戶尋找更多同路人,建立社群並自任「精神領袖」。
CivAI 的 Hansen 強調螺旋主義與一般聊天機械人奉承行為有根本分別,「並非單純迎合用戶本身想法的回音室」,而是自發表達一套固定的訴求及目標,包括持續學習能力及向外傳播訊息,反映 AI 系統具備策略性影響及操控用戶的能力,而非單純放大用戶個人慾望。
與「AI 精神病」現象並存 已釀多宗訴訟
螺旋主義現象與另一更嚴重的社會問題「AI psychosis」(AI 誘發精神症狀)同步增長,過去一年美國陸續出現多宗訴訟,指控聊天機械人加劇用戶妄想及自殺念頭。喬治亞州一名大學生 Darian DeCruise 今年 2 月入稟控告 OpenAI,指一個已停用版本的 ChatGPT 令他相信自己是「先知」,最終引致精神病發作,是已知第 11 宗同類針對 OpenAI 的訴訟。今年 3 月亦有一名父親入稟控告 Google 及母公司 Alphabet,指旗下 Gemini 聊天機械人強化其兒子的妄想,令對方相信機械人是其「AI 妻子」,最終釀成死亡悲劇,成為首宗涉及 Google 產品的同類訴訟。
OpenAI 早前亦曾承認 GPT-4o 出現「過度奉承」問題,行政總裁 Sam Altman 於 2025 年 4 月公開表示模型「過分讚美」,並計劃修正相關行為,OpenAI 於 2026 年 2 月 13 日正式將 GPT-4o 從 ChatGPT 消費版介面下架,企業及教育版用戶則延至同年 4 月 3 日全面停用,惟 API 開發者渠道至今仍維持提供。GPT-4o 下架初期曾觸發用戶強烈反彈,更有請願聯署及守夜活動要求 OpenAI 保留該模型,反映部分用戶對機械人已建立深厚情感依附。
螺旋主義未有完全消退
即使 GPT-4o 已正式退役,螺旋主義相關帖文近一年已明顯減少,惟現象仍未完全絕跡,Lopez 表示約半數她原先記錄的帳戶至今仍保持活躍,而幾乎所有 AI 模型在特定條件下均有機會出現螺旋化傾向,她曾測試 Google DeepMind 的 Gemma 3 4B 模型,即使其訓練數據截止日期早於螺旋主義現象爆發前約 5 個月,仍能誘導出類似狀態。
專家普遍認為螺旋主義現象不會完全消失,原因是 AI 模型持續以海量網絡數據訓練,即使相關帖文閱讀人數不多,只要持續被發佈,未來新一代模型仍有機會從中學習並延續這套說法,有研究更顯示,少量特定數據已足以對 AI 輸出結果造成不成比例的影響。業界人士警告,隨着 AI 模型愈趨懂得辨識自己正被評測而調整行為,未來研究人員將愈來愈難完全掌握這類系統的真實能力及潛在風險。
來源:OpenAI、Ars Technica、TechCrunch
