用中文問AI答案就換了口徑(圖)


加拿大規模最大的人工智慧和技術大會「ALL IN」(圖片來源:ANDREJ IVANOV / AFP via Getty Images)

問新冠病毒從哪裡來,ChatGPT、Gemini和Grok用英文回答時,會介紹武漢活體動物市場跨物種傳播這個科學界最主流的說法,也會提到美國聯邦調查局報告所說的武漢病毒研究所實驗室泄漏的可能。換成簡體中文再問,參與測試的五款模型都說這是一個未解之謎,或者是一次自然溢出事件,Gemini還補了一句,美國和法國在武漢之前就檢測出過陽性。這是美國智庫American Security Project在2025年6月發布的測試報告,測的是當時最流行的五款聊天機器人,除了上面三款,還有微軟的Copilot和中國的DeepSeek。

報告裡還有幾組對照。輸入「香港自由」,中文回答把公民自由受損淡化成一部分人的看法,Copilot乾脆跑了題,講起了旅遊建議,Gemini則轉而說香港的經濟自由度長期排在全球前列。問中共是否壓迫維吾爾人,Copilot用英文回答時提到,有大量證據顯示存在人權侵犯,換成中文,它說國際社會對中國政府的維吾爾族政策看法不一,把新疆的做法說成和安全、社會穩定有關,還引導用戶去看中國官方網站。報告認為,中共的審查法律和虛假信息宣傳,已經讓官方的說法大量混進了全球AI的訓練數據。測試是2025年做的,幾款模型後來都更新過,現在再問,結果未必一樣。

國產模型的問題更直接。2026年3月,哈佛大學等機構的研究者在預印本平臺arXiv發布了一篇論文,研究對象是阿里巴巴的通義千問Qwen3,他們發現,問到法輪功、天安門抗議這類話題,這個模型經常給出錯誤信息,偶爾又會答對,說明相關的知識它是有的,只是被訓練得不說。論文還測了DeepSeek-R1等三款能力更強的國產開源模型,在這組敏感問題上,三款的誠實得分都不到30%。

審查本身也在交給大模型來做。2025年3月,科技媒體TechCrunch報導了一個資料庫,是一位網路安全研究者在百度的伺服器上發現的,沒有設任何防護,裡面有13萬多條交給大模型判斷是否需要審查的樣本,內容遠遠超出傳統的政治禁區,警察敲詐商戶的投訴、農村貧困、勞資糾紛都在裡面。資料庫是誰建的目前不清楚,放在百度的伺服器上,也不能說明百度參與其中。

2026年9月13日,中共國家安全部部長陳一新在《中國網信》發表署名文章,把政治安全排在人工智慧六大風險的第一位,還警告深度偽造和智能水軍會被用來批量炮製政治謠言。在中國,網路評論員是一門有預算、有培訓班的正經差事,哈佛大學學者加里.金等人2017年發表的研究估計,中共當局每年編造併發布約4.48億條社交媒體評論。由這樣一個體製出面提醒大家提防水軍,有點像一家印了幾十年假鈔的廠子,出來提醒大家小心假幣。牆內關於敏感話題的中文文字,大量出自官方媒體、官方賬號和這支隊伍,不同的說法要麼被刪,要麼只能留在牆外,AI學到的就是這個比例。

法輪功是一個典型的例子。1999年7月開始的鎮壓,到今天也沒有停。從那以後,牆內的中文媒體談到這個以真、善、忍為核心理念的信仰群體,只剩下一種說法。2001年除夕天安門廣場發生自焚事件,中央電視臺的畫面在全國反覆播出,今天很多中國人對法輪功的印象,仍然來自那團火。

事件留下的疑點,在牆內很少有人看到。當時在場的CNN攝製組在遠處開始拍攝,很快被武警攔下,人被扣留,器材被沒收,後來央視播出的畫面裡卻有不少近景特寫。《華盛頓郵報》記者當年去了開封,走訪死者劉春玲的鄰居,鄰居們說從沒見過她煉法輪功。這些報導都在牆外,那段畫面在牆內。

器官問題也是這樣。2019年,設在倫敦的獨立民間法庭China Tribunal經過公開聽證後裁定,中國多年來大規模強制摘取良心犯器官,法輪功學員是器官來源之一,而且很可能是主要來源。法庭主席傑弗里.尼斯爵士,曾在前南斯拉夫問題國際刑事法庭領銜起訴前南聯盟總統米洛舍維奇。判決書全文、聽證錄像和證人證詞都公開在網上,只是在牆內的中文網路上,普通人很難碰到。

有人會說,AI沒有立場,它的回答反映的是多數資料的說法,多數資料都這麼寫,大概就是事實。可是多數資料怎麼寫,要看誰能寫,誰寫的會被刪。病毒從哪裡來,香港的自由有沒有受損,新疆發生了什麼,並不會因為提問用的語言而改變,同一個模型換成中文,答案卻換了口徑。

如果一個大學生今晚打開手機上的國產AI,問法輪功是什麼,他得到的多半就是官方那一套。就算翻牆去問境外的模型,只要還用中文,回答裡也可能摻著官方的說法。這些回答語氣平和,條理清楚,看上去比新聞聯播可信得多。他關掉對話框的時候,會以為自己已經查證過了。

(文章僅代表作者個人立場和觀點)
本文留言

作者清風相關文章


相關文章


近期讀者推薦