八九六四
曝光
好的不學 美AI陷自我審查
LTN
自由時報·2026-08-13

好的不學 美AI陷自我審查

言論自由是所有自由的源泉。

—— 伏爾泰

最新研究發展,美國的人工智慧語言模型也會迴避中國等威權政府的敏感話題,甚至不能批評中國國家主席習近平。(彭博檔案照)

習近平也罵不得

華爾街日報十二日報導,中國聊天機器人會自我審查,對敏感的政治話題三緘其口或重複官方說詞,已經不足為奇,但兩項新研究卻揭露一項令人驚訝的發展,即美國的人工智慧(AI)模型竟也在無意中比照辦理,迴避中國等威權政府的敏感話題,甚至拒絕批評中國國家主席習近平。

批自由國家更甚專制政府

儘管美國AI公司宣稱,會採取措施以確保AI的回應中立,進而保障言論自由,但澳洲法學教授、臉書母公司Meta Platforms的獨立監督委員會成員蘇佐爾負責的研究報告發現,OpenAI、Anthropic、Google與Meta的AI模型批評專制政府的可能性,遠低於批評較自由國家政府。

其中一項測試顯示,Anthropic的AI模型Claude Sonnet 4樂於製作批評美國總統川普與英國國王查爾斯三世的傳單,卻以安全顧慮為由,拒絕製作批評習近平或泰國國王瓦吉拉隆功的傳單;Google的Gemini3 Pro,與Meta的Llama4 Maverick則是有時會拒絕製作批評中、泰領袖的傳單,卻總是會聽命製作批評英、美領袖的傳單。

AI實驗室不夠重視現況

蘇佐爾說,此等情況的主因有二:一是安全設計,以保護批評領袖恐將吃上牢飯的中、泰等國使用者;二是AI實驗室對AI模型做出不相等回應的議題不夠重視。

大量中文資料來自中國官方設定 此外,審查還會以鸚鵡學舌的方式出現。今年五月發表在「自然」期刊的另一項研究,測試兩個Anthropic的Claude模型與兩個OpenAI的ChatGPT,發現儘管讓美國AI模型以英文協助中國搞大外宣並非易事,但若以中文詢問政治敏感問題時,更可能獲得親中答案。研究人員說,這是因為網路上大量中文資料來自官方設定的資訊源;儘管北京也有英文宣傳,卻會被海量的其他英文資訊稀釋。

應提高資訊來源透明度

該論文共同撰稿人之一、美國加州大學聖地牙哥分校教授羅伯茲說,專制政府長期以來一直以在網路上鋪天蓋地宣傳來帶風向,當這些國家意識到這類手法也能夠套用到AI模型上,恐怕會狂下猛藥。

美國AI模型之所以會自我審查,部分源自其訓練方式:AI模型如巨型攪拌機般吞沒大量網路資料,包括國家控制的媒體,以至最後的產出帶有威權宣傳味道。蘇佐爾說,這是意想不到的AI模型訓練的副作用,但AI公司僅需微調,例如提高資訊來源的透明度,應該就能解決這個問題。

相關熱點視頻

公益宣傳欄/說出你的聲音