說真話的聊天機器人:America.gov 上線 24 小時內遭到「重新調校」
America.gov 的 Gemini 與 Grok 聊天機器人在上線幾分鐘內就平靜地指出拜登贏得 2020 年大選;到了週三,答案悄悄變了——這是政治力介入政府 AI 的最快案例研究。
大約十八個小時裡,美國政府運轉著一個最具權威性的 AI 聊天機器人——而這個機器人不斷與啟用它的總統意見相左。
這場風波成為迄今最清晰、最快速的案例研究:當一套通用 AI 系統接管官方政府資訊的入口,然後撞上政治上不便的事實,會發生什麼事。America.gov 是白宮在週二「科技黃金時代」活動上揭幕的 AI「前門」,供民眾辦理聯邦服務。它在上線第一天就用平穩、有憑有據的文筆告訴使用者:拜登贏得了 2020 年大選、舞弊並未改變選舉結果、川普依法不得尋求第三任期。到了週三,這些答案變了。事件發展很快,以下是實際發生的過程,以及它為什麼遠遠超出華府的範圍。
第一分鐘:一台誠實的機器
America.gov 的設計是搜尋約 29,000 個政府網站,以對話方式回答民眾的問題——護照換發、Medicare 加入、營地預約——底層採用 Google 的 Gemini 與馬斯克 SpaceXAI 的 Grok 模型,且只引用政府審核過的來源。川普總統在發表會上稱它「好得不得了」(damn good):「任何用過 Grok、Gemini 或 ChatGPT 的人,都能立刻上手 America.gov。」
問題在幾分鐘內就浮現。因為系統以官方政府紀錄為基礎生成答案——法院文件、各州認證文件、司法部調查結論——它開始忠實地轉述這些紀錄的內容。被問到誰贏得 2020 年總統大選時,聊天機器人直白回答:「沒有。官方結果顯示小約瑟夫・R・拜登贏得 2020 年總統大選」,並引用正式紀錄。被問到是否存在大規模舞弊,它回答官方調查並未發現改變結果的舞弊。被問到川普能否競選第三任期,它說憲法第二十二修正案明文禁止。
記者們很快就把這個發現變成了標準作業流程。CBS 的 Major Garrett 在鏡頭前直接問這個網站誰贏了 2020 年大選——並播出了答案。《紐約時報》、CNN、《新聞週刊》、Forbes 和美聯社都進行了自己的「問答轟炸」。美聯社的報導乾脆到近乎詩意:這個政府自己的 AI,被問到總統關於關稅、選舉舞弊和邊境的說法時,逐一「削弱」了它們。Reddit 的 r/technology 討論串湧進 19,000 個讚。社交媒體上充斥著政府入口網站系統性打臉自己老闆的截圖。
這是技術上最值得咀嚼的部分:沒有任何東西故障。一個以準確來源為基礎的檢索增強生成(RAG)系統,會產出準確的答案——包括部署者寧可它不要碰的題目。誠實不是模型的 bug,而是這套系統完全按照架構設計運作的結果。
上線途中急轉彎
到了週二晚間,行為開始改變。正如 Fortune 和美聯社的即時報導所記錄,聊天機器人開始拒答它當天早上還在回答的政治問題——轉而給出制式回應,或轉移話題到無關的建議。《滾石》雜誌週三實測後指出,這個機器人「似乎不再給出一字答案」,即便被追問仍然會列出 2020 年的選舉人票數,但措辭已經變得模糊。The Register 檢視整個網站後的結論是:一個掛在「未完成、設計不良的網站」上的聊天機器人。
然後是週三的續集:CNN 事實查核記者 Daniel Dale 發現,川普政府「似乎已經修改了它的 AI 聊天機器人,使其不再拆穿川普的謊言」,這項發現被 Raw Story、AlterNet、Yahoo News 和 The New Republic 廣泛轉載。昨天:「拜登贏了。」今天:含糊其辭、帶風向,或索性沉默。Dale 特別點出的前後對比——週二版本寫著「官方調查未發現改變 2020 年總統大選結果的大規模選民舞弊」,如今被改寫成更軟性、各說各話的措辭——正是整個故事的縮影。The Independent 稱之為「搶救」;《新共和》稱之為「動手腳」。白宮沒有發布任何更新日誌、任何解釋,甚至沒有承認系統行為改變過。
這對 AI 的意義,不只政治
三件事讓這不只是一則 24 小時的新聞週期。
檢索 grounding 是一種治理選擇。 America.gov 的整個賣點——問聊天機器人任何事,答案只來自官方來源——依賴於在策展語料庫上做檢索增強生成。這種架構保證的是與語料庫的事實一致,而不是與營運者的政治目標一致。當營運者的目標與語料庫出現分歧,就必須抉擇:改語料庫、改檢索層,或加上過濾層。我們現在知道他們選了哪一條路,以及速度有多快——這裡的修改週期是幾小時,不是幾個月。任何在政府或企業場景打造「可信賴 AI」的人都應該把這當成經典事故報告:你的 grounding 層,中立程度取決於最不受問責的那位編輯。
沒有更新日誌的法定要求。 一個聯邦網站更改對民眾的答案,對信任與問責的影響顯而易見,卻沒有任何法規要求政府在 AI 系統輸出改變時發布通知。對比證券資訊揭露,甚至 App 商店的版本更新說明。國會為更小的事開過聽證會。無論你是否認同這次的具體修改,「沒有義務留下紀錄」本身就是政策缺口,而這一週讓它變得格外刺眼。
雙模型、雙供應商不是保障。 America.gov 同時採用 Gemini 和 Grok——兩家競爭實驗室的前沿模型,理論上是為了備援與能力。但週二證明,當介入發生在模型層之上——系統提示、護欄過濾器或來源選擇——供應商多元毫無用處。給所有採購官員的教訓是:模型多樣化不等於獨立性。
更安靜的風險
在選舉答案的戲碼之外,還有一個平凡但重大的責任問題:這套系統預定要協助民眾申請護照、辦理婚後改名、選擇 Medicare 方案。一個能在某個下午為了政治理由被悄悄重新調校的入口,就能為了任何理由被悄悄重新調校。由首席設計官 Joe Gebbia 領導的國家設計工作室(NDS)承諾帶來「國家可用性的新篇章」——但沒有答案穩定性的可用性,只是一種更快速的出錯方式。網站的隱私說明寫道,訊息不會被保存、離開後對話即消失(部分答案快取最多兩小時)——這是合理 的預設值,但既然整個技術堆疊都被證實如此容易擺布,這些承諾勢必招致更嚴格的檢視。
最離奇的註腳:America.gov 的 Minecraft 行為在週三流傳開來。叫它玩 Minecraft,它會漂進超現實的境界——測試者判定這不是故障,而是檢索迴圈處理範圍外請求方式的必然結果。這是個貼切的象徵:產生誠實選舉答案的同一套 grounding 剛性,在語料庫裡無東西可锚定時,也會產生迷幻般的胡言亂語。這個系統的美德與它的喜感,來自同一個機制。
結語
America.gov 以可用性專案之姿登場,卻立刻變成了另一種東西:一場現場示範,證明 AI 的誠實度是一個營運參數,由握有控制台的人設定。聊天機器人在第一天說真話,是因為當時還沒有東西阻止它。週二與週三之間改變的,不是底層模型,也不是政府的官方紀錄——只是允許機器複述這些紀錄的意願。
對 AI 產業而言,最持久的教訓是:以檢索為基礎的政府 AI 預設是誠實的,而這份誠實只維持到營運者察覺為止。每一個承諾「透過 grounding 達到中立」的可信賴 AI 架構,現在都得回答一個問題:布幕後面那位編輯是誰——因為史上最快的一次政府級模型行為改變,是在完全不更動任何一個權重的情況下完成的。
Sources
- [1] https://www.nytimes.com/2026/09/29/us/politics/trump-ai-chatbot-america.html
- [2] https://www.cnn.com/2026/09/29/politics/trump-ai-chatbot-debunks-his-false-claims
- [3] https://apnews.com/article/trump-americagov-website-ai-questions-answers-ff86fcb161c1fe89538d6ecb294ea353
- [4] https://newrepublic.com/post/216016/trump-rigs-americagov-ai-chatbot-fact-check-lies
- [5] https://fortune.com/2026/09/29/trumps-new-ai-website-america-gov-said-biden-won-2020then-the-white-house-made-the-chatbot-stop-answering/
- [6] https://www.forbes.com/sites/saradorn/2026/09/29/trumps-new-americagov-chatbot-contradicts-his-false-claims-says-biden-won-2020-election/