單日 447 篇論文:CMU 教授說資科學界應該「燒掉重來」
arXiv 機器學習分類單日湧入 447 篇新論文創下紀錄之際,CMU 的 Zachary Lipton 直言「資科學界弄壞了這套系統」——或許唯有燒掉才能重建。一位研究者崩潰宣言背後的數字真相。
2026 年 9 月 9 日,arXiv 的機器學習分類 cs.LG——這個領域的中樞神經系統——單日湧入 447 篇新投稿,寫下歷史紀錄。沒有任何一位審查者、讀書會或招募委員會有能力追蹤這樣的流量。幾天後,這個領域最具影響力的聲音之一,把大家心裡想的話說了出來。
卡內基美隆大學(CMU)Raj Reddy 機器學習副教授、Approximately Correct Machine Intelligence(ACMI)實驗室主持人 Zachary Lipton 直言,「資科學界弄壞了這套系統」(CS academia broke the system),並補上一句隨即在圈內炸開的話:「或許讓系統重建所需要的,就是讓它燒成平地。」
這段話出現在週末期間 r/MachineLearning 上的熱門討論串,原po 明確將時間點錨定在 9 月 9 日那筆 arXiv 紀錄。這是一場醞釀多年的危機至今最尖銳的表述——而生成式 AI 把它推過了崩潰臨界點。
崩潰臨界點背後的數字
要理解一位資深研究者為何會用「縱火」來比喻,先看 cs.LG 分類的成長軌跡:
- 單日 447 篇新投稿(2026 年 9 月 9 日)——超過任何單一人類一年能讀完的量,在晚餐前抵達。
- 整個 arXiv 自 2026 年中以來,全分類合計每天平均吸收 1,000 篇以上全新投稿——這是博士生們自行統計出的數字。
- 光是 cs.LG 每天就常態性出現數百篇投稿——「跟上文獻」不再是紀律問題,而是物理上的不可能。
這波洪流並非有機成長。相當比例的投稿如今是機器生成或機器輔助的產物:LLM 草擬的摘要、自動產生的實驗章節、被同一套技術工業化的論文工廠產品——而那套技術正是這個領域自己建造的。arXiv 官方的應對軌跡也印證了這一點:從 2026 年 7 月的一次違規出局規則(對提交未經查核 LLM 輸出的作者處以一年停權),到更早之前因 AI 生成綜述泛濫而收緊 CS 審查文章的審核。
「系統」指的是什麼
Lipton 的控訴對象其實不是 arXiv。預印本伺服器只是症狀浮出水面的地方。真正的「系統」,是資科系所三十年來建立起來的學術機器:
- 論文數量是職涯的通貨。 博士班錄取、教師聘任、終身職審查、經費審核,全都倚賴以量為權重的指標——發表頁數、累積引用、履歷上的第一作者列數。
- 同儕審查由無酬、超載的志願者支撐。 那些每天讀不完 447 篇論文的研究者,被要求審查其中相當比例的論文,而會議的錄取決定直接左右職涯。
- 瓶頸一直是社會性的,不是運算性的。 這套系統過去能運作,是因為投稿量維持在人類審查者與讀者的頻寬之內。生成式 AI 一夜之間移除了這個約束——下游的激勵結構卻原封不動。
當一項技術讓任何人都能以近零的邊際成本生產「論文形狀的物件」,而所有激勵仍在獎勵生產更多這種物件,結果就是一道算術題:佇列不斷增長,直到另一端的人類崩潰。Lipton 的論點是:他們現在正在崩潰。
最有資格發言的批評者
如果說誰有立場講這些話,那就是 Lipton。他在 2019 年共同撰寫了《Troubling Trends in Machine Learning Scholarship》——一篇早期且深具影響力的警告,指出這個領域的發表激勵正在敗壞其科學,助長數學堆砌、過度宣稱,以及把基準分數進步誤當成理解。多年來,他透過 Approximately Correct 部落格與學術著作持續主張:ML 的求快文化正在產出誤導而非推進科學的論文。
這段歷史對正確解讀他的新宣言至關重要。「燒成平地」不是呼籲放棄同儕審查或停止發表——這是一位花了七年提倡改革、眼看激勵結構依然獲勝的人,所做出的判決:他現在懷疑修正無法漸進發生,只能具破壞性。Reddit 討論串把它框架成一位研究者的崩潰時刻;更精確的讀法是:一位改革者的崩潰時刻。
時機為何不是巧合
447 篇論文的那一天,落在整個 AI 研究圈為「配速」(pacing)爭論不休的一週。Dario Amodei 在 9 月 12 日發表前沿配速宣言;Elon Musk 與 Sam Altman 在幾小時內表態支持部分主張;白宮的 David Sacks 隔天斥之為「監管俘虜」。這些論述幾乎全都在問同一個問題:當能力成長跑贏社會吸收它的速度,會發生什麼事。
Lipton 的爆發是同一個論證,往下降了一個八度——從文明層級的風險,降到學術基礎設施。同儕審查、引用圖譜、閱讀清單,是社會用來吸收研究成果的機制。它們現在的飽和方式跟高速公路一模一樣:不是因為誰選擇了壅塞,而是因為流量超過容量,而收費規則仍在獎勵大家開上交流道。
同樣的平行關係延伸到各種解方。arXiv 的一次違規出局規則是測速照相——懲罰性、事後性,且對流量本身無能為力。Lipton 過去倡議的改革(更好的審查規範、誠實的宣稱、少一點虛榮基準測試)是這場小型危機裡的「對齊研究」:必要,但不是為了當下正在抵達的負載而建造的。
「燒掉」實際上可能意味著什麼
剝掉比喻,殘骸中其實看得到具體議程。如果資科學界無法審查它所發表的東西,可發表的單位就必須改變:更少的論文、更厚實的貢獻、以可驗證的成果物與程式碼取代 PDF 形狀的宣稱。如果數量無法再作為品質的代理指標,評鑑就必須轉向偽造成本高昂的東西——被重現的結果、可持續的研究計畫、教學與指導。如果 arXiv 無法疏導洪流,它的內容審核模式本身就必須成為研究問題,偵測與來源驗證工具的投入規模必須與攻擊面相稱。
對相關機構而言,這些沒有一項是舒服的位置——而這正是 Lipton 的重點:系統的利害關係人,正是從它的指標中獲益的那批人,也最不可能自願走向那場火。可信的未來不是溫和改革或乾淨崩塌,而是一場漫長難熬的重新協商——會議論文上限、審查者罷工、悄悄停止數論文的招募委員會——與此同時,佇列持續增長。
一個數字的人性尺度
值得用 447 這個數字對一個「人」的意義來作結。一位嚴謹的審查者花在一篇投稿上的時間是二到四小時。以這個速度讀完 447 篇論文,是一整年的全職工作量——而這只是一個子分類一天的產出。一位 2026 年入學的博士生,面對的是一個成長速度快過任何人類閱讀能力的文獻庫,在這裡篩選相關性不再是技能而是負擔不起的奢侈品,而「發表在 arXiv 上」這個訊號的可信度,對任何缺乏獨立驗證的東西而言,已被稀釋到趨近於零。
這就是 Lipton 說已經壞掉的系統。他的比喻留下的不安問題是:這個領域的機構——會議、系所、經費機構、arXiv 本身——能否在操作它們的人真正燃燒殆盡之前,重建自己的激勵結構。從本週討論串的跡象看來,越來越多的研究者已經不打算等答案了。