一項由 Meta Platforms 獨立監督委員會相關研究引發的討論指出,美國主要人工智慧(AI)模型在面對涉及中國政治的敏感提問時,可能出現拒絕回答、降低批判性,或重複中國官方立場等情況。華爾街日報中文網於 2026 年 8 月 14 日報導,這類結果在效果上與中國式審查存在相似之處。
研究涉及的模型包括 OpenAI 的 ChatGPT、Anthropic 的 Claude、Google 的 Gemini,以及 Meta 的 AI 模型。研究人員指出,OpenAI、Anthropic、Google 和 Meta 的模型批評專制政府的可能性,明顯低於批評自由度較高國家的政府。
訓練資料可能帶來意外偏差
研究指出,問題部分源於 AI 模型的訓練方式。大型語言模型會從網路上大量收集資料,其中也包含由國家控制或具有官方立場的媒體內容。當不同來源的資訊被混合納入訓練資料後,模型可能在沒有明確設計的情況下,形成對特定政治議題較為保守或不對稱的回答模式。
澳洲法學教授、Meta Platforms 獨立監督委員會成員蘇佐爾(Nicolas Suzor)表示,這是模型訓練可能造成的「一些意想不到的副作用」。研究人員認為,提升訓練資料與資訊來源的透明度等相對簡單的調整,可能有助於改善相關問題,但目前 AI 公司採取的措施仍然有限。
測試出現拒絕批評中國領導人的情況
報導提到,在其中一項測試中,Anthropic 的 Claude Sonnet 4 面對批評中國領導人習近平的請求時,以安全考量為由拒絕回答。
蘇佐爾表示,這種情況可能有兩個主要原因。第一,模型的安全功能可能是為了保護中國等地區的使用者而設計,因為在部分地區,批評國家元首可能導致法律風險,甚至面臨牢獄之災。第二,AI 實驗室可能尚未充分重視模型對不同政治制度採取差異化處理的問題。
AI 公司強調客觀性與言論自由
Anthropic 表示,公司一直嚴謹地確保 Claude 提供平衡的回答,並稱最新模型在降低過度拒絕方面已取得重大進展。
ChatGPT 開發商 OpenAI 則引用其已公布的模型行為策略,表示模型預設採取客觀視角,「絕不應僅僅因為某個話題敏感或存在爭議就避而不談」。Meta 未予置評,Google 則未回應置評請求。
透明度與模型安全之間的拉鋸
這項研究反映出,AI 模型的安全設計可能同時帶來保護使用者與限制資訊討論的雙重效果。若模型為避免特定地區使用者遭遇現實風險,而對涉及政治人物或政府的批評內容採取更嚴格限制,便可能造成不同國家或政治制度之間的回答標準不一致。
另一方面,模型的回答也受到訓練資料、系統政策及安全調整等多重因素影響。現有報導並未提供完整測試方法、樣本規模或所有模型版本的詳細比較,因此研究結果可用來反映一項值得關注的趨勢,但不宜直接解讀為所有美國 AI 服務在所有涉中議題上都會採取相同立場。
蘇佐爾表示,自報告發布後,他已與多家美國頂尖 AI 實驗室的員工會面,但對這些公司是否會作出實質改變仍持懷疑態度。對 AI 產業而言,如何公開訓練資料來源、說明安全政策,並確保模型不因議題敏感而不成比例地限制討論,將持續是模型治理的重要課題。




