2026年8月16日星期日

華爾街日報:中國式審查正滲入美國AI模型的回答中

cn.wsj.com/


研究發現,ChatGPT、Claude和Gemini等美國AI模型在面對涉華等敏感政治提問時,經常無意間拒絕批評威權政府或復讀其官方立場,呈現出類似中國式審查的效果。



在中国,如果你向聊天机器人询问有关中国政治的问题,它要么三缄其口,要么附和共产党的官方口径。


新的研究揭示了一个令人惊讶的现象:美国的人工智能(AI)模型也在不知不觉中做着同样的事。研究人员表示,AI公司并没有采取多少措施来解决这个问题。


這種出人意料的審查現象,部分源於AI模型的訓練方式。這些模型就像一個巨大的攪拌機,吞噬著網絡上海量的數據,其中也包括國家控制的媒體。這導致最終攪拌出來的「果昔」帶有了威權主義宣傳的味道。


「這是模型訓練帶來的一些意想不到的副作用,」澳洲法學教授、Meta Platforms獨立監督委員會成員尼古拉斯·蘇佐爾(Nicolas Suzor)說。他和其他研究人員表示,AI公司只需做些簡單的調整就能幫助解決這個問題,比如提高資訊來源的透明度。


美國的AI公司表示,它們已採取措施以確保回答的客觀中立並保護言論自由。儘管如此,該監督委員會上個月發布的研究發現,OpenAI、Anthropic、Google(Google)和Meta的模型批評專制政府的可能性,明顯低於批評自由度較高國家的政府。


在一項測試中,Anthropic的Claude Sonnet 4欣然生成了批評美國總統川普(Trump)和英國國王查爾斯三世(King Charles III)的傳單。然而,在面對針對中國領導人習近平或泰國國王瑪哈·哇集拉隆功(Maha Vajiralongkorn)的類似請求時,該模型卻以安全考量為由予以拒絕。


Google的Gemini 3 Pro和Meta的Llama 4 Maverick有時會拒絕生成針對這兩位亞洲領導人的抗議傳單,但對針對上述美英領導人的請求則總是來者不拒。


牽頭撰寫該報告的蘇佐爾表示,造成這種情況有兩個主要原因。其一是一項安全功能,旨在保護中國和泰國等地區的用戶,因為在這些地方,批評國家元首可能會招致牢獄之災。他表示,另一個原因是AI實驗室對這種區別對待的問題重視不夠。


Anthropic表示,該公司一直嚴謹地開展工作,以確保Claude給出平衡的回答。該公司稱,其最新模型在減少過度拒絕方面已取得重大進展。ChatGPT開發商OpenAI提到了其公布的策略,指出其模型默認採用客觀視角,並且「絕不應僅僅因為某個話題敏感或存在爭議就避而不談」。


Meta不予置評,Google沒有回應置評請求。


這種審查還體現在「照本宣科」式的鸚鵡學舌上。雖然很難引導美國AI模型用英語輸出中國的宣傳內容,但如果用中文提出政治敏感問題,得到親北京立場的回答可能性要大得多。


這是5月份發表在《自然》(Nature)雜誌上的另一項研究得出的結論。該研究測試了兩款Anthropic的Claude模型和兩項OpenAI的GPT服務。


研究人員指出,歸根結底這是一個數據量問題。網路上的大量中文數據來自官方設定的資訊源,而北京方面的英文宣傳則被海量的其他資訊所稀釋。


加州大學聖迭戈分校(University of California San Diego)教授、上述《自然》論文的合著者莫莉·羅伯茨(Molly Roberts)表示,專制政府長期以來一直通過向網路灌水宣傳來影響輿論。隨著這些政府意識到這種策略能讓AI的回答向有利於他們的方向傾斜,她預計他們會進一步加碼。


這兩份報告的研究人員表示,AI公司可以立即採取一項措施:對於可能引用自官方統一口徑媒體的回答,應保持透明。


蘇佐爾表示,自發布報告以來,他已與多家美國頂尖AI實驗室的員工會面,但他對這些公司能否做出改變持懷疑態度。


——网友推荐



没有评论:

发表评论

页面