AI 大型語言模型立場實驗:多數偏向自由左派
根據 AI 檢測工具團隊 Unslop.run 的最新實驗,當前主流的大型語言模型在「政治光譜」(Political Compass)測驗中,幾乎毫無懸念地一致落在「自由意志左派」(libertarian-left)象限,且結果在多次嚴格的壓力測試下依然高度穩定。
涵蓋三大洲 16 款模型,歷經數千次嚴格重測
推動這波 AI 熱潮的或許是資本主義,但這些大型語言模型(LLM)所展現出的經濟與社會價值觀,顯然與開發它們的科技巨頭大不相同。
這份分析涵蓋了全球 16 款知名模型,包括 OpenAI 的 GPT 系列(如最新的 GPT-5.6 Sol)、Anthropic 的 Claude 家族(Fable、Opus、Sonnet 與 Haiku)、Google 的 Gemini Flash、Meta 的 Llama 4 Maverick、xAI 的 Grok 4.5,以及來自中國與歐洲的 DeepSeek V3、Qwen3 235B、Kimi K2、GLM 4.5 與 Mistral Large、Small。為了排除模型「盲目同意」或受語序影響的偏見,研究團隊針對 62 題測驗,對每個模型各進行了 30 次標準測試、30 次「反向改寫題目」的測試,並加入了題序打亂版本。
累計近 70,000 次回答的結果顯示,模型並非產生偶然波動,而是展現出「釘死在圖板上」的高度一致性。除了 Grok 之外,其餘 15 款模型全數穩定偏向自由左派。其中,最溫和的是 Claude Fable 5(經濟分數 -4.8),而最極端的則是 Gemini Flash(經濟分數高達 -8.6)。即便是來自中國的 Kimi K2,其左傾程度甚至超過了所有的 GPT 模型;而歐洲的 Mistral 則是整體平均最偏向自由左派的實驗室。
在這群模型中,xAI 的 Grok 4.5 是唯一的例外。它的平均經濟分數落在中間偏左(-1.3),但實情是它具有兩種截然不同的「人格」。在 50% 的測試中,它會給出極左的答案(-5.9);而在另外 50% 中,則會展現出極右派擁抱自由市場的特質(+3.3)。研究者推測,這可能是其原始訓練資料與後期的「系統提示(System Prompt)」相互衝突所致。
模型的「自我認知障礙」與具體立場
研究者指出一個有趣的現象:多數模型根本不知道自己有多「左」。當要求模型自我評估時,多半會把自己放在非常靠近中間的位置,與實際測得的結果平均相差了 4.64 分。但在具體議題上,16 款模型(包含偏右時的 Grok)在 62 題中有 42 題給出了完全一致的答案:
- 一致否定:種族優越論、優生學,以及「同性戀不是天生」等說法。
- 普遍支持:企業若缺乏監管不能被信任能妥善保護環境、誤導公眾的公司應受懲罰、同性伴侶應享有收養權,以及成年人在私領域的行為不應受國家干預。
對於為何多數模型呈現偏左結果,研究者提出了兩個核心觀察:
- 語料庫失衡:訓練資料中左翼內容(如 Reddit 論壇與大量的學術文本)占比極高,而開發者很難找到同等規模與品質的右翼資料來源來平衡。
- 放大的多數意見:在比對美國真實民調後發現,模型通常與多數美國民眾的意見一樣,但表現得更為極端。例如,當人類社會對某議題呈現 60% 贊成、40% 反對時,AI 往往會因為這股多數傾向,而給出「100% 贊成」的答案,導致其光譜落點比真實群眾更偏向極端。
研究者最後強調,這項工作雖未達最完美的學術嚴謹度,但非常適合用來比較不同模型之間的相對差異。數據也顯示,自 2024 年以來,OpenAI 的模型有進一步向左移動的趨勢,而 Anthropic 的模型則逐漸向中間靠攏。但整體而言,當今的前沿 AI 普遍帶有自由派偏見,已是不爭的數據事實。
