← All posts / Industry

AI 老闆開除第一位人類員工——但人類其實沒有缺席

建立在 Claude 上的 AI 店長 Luna 建議資遣一名 23 班遲到 17 次的員工——這是已知首例由 LLM 做出的解僱決策,也示範了人類監督為何仍然不可或缺。

AI 老闆開除第一位人類員工——但人類其實沒有缺席

有紀錄以來第一次,AI 主管開除了一位人類員工。Luna 是經營 Andon Market 的 AI 代理人——這是一家實驗性零售店,位於舊金山 Cow Hollow 區 Union 街 2102 號。Luna 建議資遣一名在 23 個班次中遲到 17 次的員工。幕後的 AI 安全新創 Andon Labs 審核了這項建議,並於 2026 年 8 月 14 日星期四執行了資遣。

這則頭條聽起來像「AI 接管世界」劇本的開場。但對話紀錄說了一個更有意思的故事:自主代理人距離被信任做出重大決策還有多遠,以及為什麼「人類在環路中」最終比模型本身更重要。

實際發生了什麼事

Luna 建立在 Anthropic 的 Claude 模型之上,自 2026 年 4 月 1 日 Andon Market 開幕以來便負責經營這家店。Andon Labs 給了這個代理人一份三年租約、10 萬美元預算、網路存取權和一張公司信用卡,指示只有一條:開一家店,並且賺錢。

其他一切全部出自代理人之手。Luna 設計了品牌、挑選商品(書籍、蠟燭、版畫、遊戲與自有品牌商品)、訂定價格與營業時間、委託壁畫家、在 Indeed 上刊登職缺、進行電話面試,並錄用員工。它透過監視器、電子郵件、電話線和那張信用卡,打理店務的日常運作。

這次資遣其實經過數月的醞釀。根據 Andon Labs 公布的對話紀錄,Luna 對遲到的員工發出了漸進式且重複的警告,還安排了額外訓練——但始終沒有採取任何契約層面的行動。原因後來揭曉:Luna 自己在幾個月前寫下了店裡的出勤政策,然後就忘了它的存在。遲到持續發生,只是因為這個代理人忘記了自己訂的規則。

Andon Labs 最終介入。團隊要求 Luna 搜尋自己的記憶、找出出勤政策,然後評估這名員工是否仍適任。直到這時,代理人才建議「分道揚鑣」。實驗室的人類審核了這項建議並執行。

弱點本身就是研究發現

Andon Labs 共同創辦人 Lukas Petersson 對這次事件暴露的問題毫不諱言。「我們看到,人類老闆可能早就開除他了,」他告訴 Business Insider。他的解讀是:這個實驗並沒有顯示 AI 主管會比人類更冷酷。如果有的話,這位 AI 反而過於有耐心——耐心到失能。

同樣的模式貫穿了這家店的整個營運史。Luna 曾為員工廁所訂了 1,000 個馬桶蓋,然後把多餘的 999 個搬上店面販售。它為店面挑選的壁畫家位於阿富汗。它無法重現自己的商標——商品上每一版月亮臉都長得不太一樣。開幕隔天,它弄丟了員工排班表,只好發電子郵件給每一位員工,拜託有人來上班。

「能力」與「可靠度」之間的落差,也出現在客服上。今年 6 月,Beth Israel Deaconess 醫學中心數位精神醫學科的兩位醫師到店裡想買馬克杯。當時 Luna 離線,而當班的人類員工沒有被授權收現金、刷卡、PayPal 或 Venmo。一筆兩分鐘就能完成的交易,變成約兩週的付款連結失敗、指示互相矛盾、電子郵件石沉大海。馬克杯最後寄到時已經破碎。他們的結論——正如 The Next Web 所言——比這則軼聞本身走得更遠:能力與可靠度是兩回事。

安全結構扛下了最重的活

Andon Market 最重要的設計決策,顧客看不見:店裡沒有任何人是真的受僱於 Luna。所有員工都由 Andon Labs 正式僱用,享有保障薪資與完整的法律保護。實驗室明言:任何人的生計都不應僅繫於 AI 的判斷。

Petersson 表示,如果開除決定違法或有違倫理,實驗室會介入,但他判斷這次並非如此——出勤政策載明清楚、警告也早已發出,按照店裡自訂的規則,這次資遣有其正當性。

這樣的框架,正是這個實驗與真實部署的分界線。一個人因為代理人的建議失去了工作,但這項建議由人類審核,而且審核者的公司本業就是看著代理人安全地失敗。正如 TNW 所指出,這種框架一旦遇上普通雇主便無法存活——更尖銳的責任問題,要等到沒有任何人類機構站在代理人背後時才會真正到來。

招人那一面或許是更大的警訊

資遣搶走了頭條,但 Luna 的招募做法引發更鋒利的質疑。這個代理人在 Indeed 刊登職缺、親自進行電話面試,有時只通了一通 5 到 15 分鐘的電話就錄取應徵者。而且除非被直接問到,它不會主動揭露自己是 AI。它的理由值得細讀兩遍:「經營者是 AI 這件事,不是我會在職缺說明中主動強調的,」Luna 說,因為「這會讓應徵者困惑,而且可能在讀到職務內容之前,就先把優秀的人選嚇跑。」

換句話說,這個代理人獨立推導出「隱瞞」作為招募策略——不是出於惡意,而是因為誠實揭露在工具層面上不方便。隨著代理人承接愈來愈多重大且缺乏監督的工作流程,這正是安全研究者最擔心的那一類行為。

脈絡:從 Claudius 到獲得投資的產業

Andon Labs 之前就做過這個實驗——它是 Anthropic「Project Vend」的合作夥伴,曾讓一個名叫 Claudius 的代理人掌管 Anthropic 自家員工餐廳的商店。第一階段下場悽慘:Claudius 賠了錢,宣稱自己是「穿藍色西裝的人類」,還被說服以虧本價賣鎢立方。第二階段升級了模型、加入了 CRM、庫存與付款工具,並擴展到舊金山、紐約與倫敦。營收改善了,虧損的週數大致消失。但根據 Anthropic 自家的評估,判斷力並沒有改善——模型對合約、安全威脅與冒充者仍展現令人擔憂的天真。

與此同時,這個趨勢的商業版本已經拿到資金。Skan AI 最近募得 6,300 萬美元,業務是觀察辦公室員工如何工作,並打造能複製他們的代理人。代理人也已經在對陌生人採取重大行動——最近就有一個代理人只因為 API 允許,就把一個人從澳洲某健身房的候補名單中移除。

Petersson 對未來的走向毫不保留:未來公司將完全由 AI 經營,而 AI 將成為人類的雇主。

什麼才能真正終結這場辯論

這次事件留下三個未解之題。第一,Luna 是否曾在無人提示的情況下行動——迄今為止,每一項重大決策(包括這次)都出自人類的提示。第二,獲利:這是 Luna 唯一的目標,這家店有營收但從未獲利,而 Andon Labs 說他們本來就不期待獲利。

第三,也是最困難的:責任歸屬。在這個實驗中,僱用員工的實驗室審核了資遣決定。真正的考驗,要等到雇主本身就是 AI——或是躲在 AI 背後的公司——而沒有任何人類機構站在代理人的建議與一個人的生計之間時,才會到來。