Google 使用率兩年從 72% 跌到 47%:NTNU 統整 173 篇研究,發現我們對「AI 與兒童思考」幾乎一無所知
NTNU 主導的系統性文獻回顧指出:AI 本身既不會強化也不會削弱批判性思考——但高達 80% 的證據以大學生為對象,在最需要答案的兒童群體上,研究竟然近乎空白。
2026 年 9 月 22 日,Norwegian SciTech News 刊出了一篇系統性文獻回顧的發現,足以讓所有把教育政策建立在生成式 AI 之上的人坐立難安。由挪威科技大學(NTNU)師資培育學系博士研究員 Hilde Storrøsæter 主導的團隊,分析了 173 篇關於生成式 AI 在學校與教育場域使用的國際研究,而其核心結論並不是「AI 對學習是好是壞」,而是:對於學習行為改變最快的那個群體——兒童——我們所知驚人地少。
這篇回顧與捷克多所大學的同事(Masaryk 大學的 Tomáš Bendl、Lenka Krajňáková、Emil Drápela 與 Martin Hanus)合作完成,發表於《Journal of Information Technology Education: Research》第 25 卷(2026 年),論文標題為《Dual Nature of GenAI: Catalyst or Barrier for Critical Thinking and Problem-Solving Skills? A Systematic Review》(DOI: 10.28945/5834)。文獻涵蓋範圍從 2022 年——大型語言模型橫空出世那年——到 2025 年春季。
頭條數字:Google 正在失去一整個世代
整篇文章最驚人的統計數字並不來自論文本身,而是來自挪威媒體管理局(Norwegian Media Authority)對 9 至 18 歲青少年媒體習慣的調查:挪威青少年使用 Google 搜尋的比例,從 2024 年的 72% 跌到 2026 年的 47%。 兩年之內,暴跌 25 個百分點——而這個年齡層,恰恰是最需要學會如何尋找、比較與評估資訊的群體。
同一份調查發現,39% 的挪威 11 至 12 歲兒童已經在用 AI。這些距離青春期還有兩年的小學生,把過去會輸入搜尋框的問題直接丟給聊天機器人——更重要的是,他們跳過了搜尋曾經強迫每個人練習的整套技能:組織查詢字詞、掃讀摘要、分辨廣告與結果、在互相矛盾的來源之間做出選擇。
流量數據佐證了調查結果。ung.no——挪威政府為 13 至 20 歲青年設立的官方資訊入口網站——造訪次數從 2024 年的 2,400 萬跌到 2025 年的 1,800 萬,一年之內衰退 25%。NTNU 的文章指出,這個跌幅有一部分要歸因於 Google 自家的 AI 摘要功能:問題在還沒變成一次點擊之前,就被攔截回答了。當搜尋引擎與政府青年入口網站同時失去一整個世代的提問,整個「查資料」的基礎建設正在被悄悄重新布線。
核心發現:AI 是鏡子,不是引擎
剝掉採用率數字之後,這篇回顧的科學發現其實比科技樂觀派與末日派想要的都更細緻——也更有意思。
「最重要的發現是:AI 本身並不會讓我們變得更會思考,或更不會思考,」Storrøsæter 接受 Norwegian SciTech News 採訪時表示。「人們很容易相信這些工具不是強化學習就是削弱學習。但我們發現了明顯的雙重效應——同一種技術,兩種後果都做得到。」
支撐這個「雙重效應」的數字值得細看。在探討 AI 對批判性思考影響的 139 篇研究中,67 篇只報告正面效果、33 篇只有負面、39 篇兩者皆有。在探討問題解決能力的 103 篇研究中,57 篇純屬正面、23 篇負面、23 篇混合。證據確實偏向正面——但差距不足以令人安心,而且一旦接觸到工具的實際使用方式,這個傾向就站不住腳。
機制比數字更重要。當 AI 被用來挑戰觀點、提出問題、比較不同立場、建立自己的論證時,它支持批判性思考。而當「AI 變成通往現成答案的捷徑」時,風險就翻了過來——Storrøsæter 說,此時「過度依賴、更膚淺的思考、獨立解決問題能力弱化的機率都會上升」。
換句話說,這項技術是教學法的鏡子。同一個聊天機器人,在某一間教室裡是蘇格拉底式的陪練對手,在隔壁教室卻是作業販賣機。對於任何希望靠工具本身終結這場辯論的人來說,這是個不舒服的結論。
三個知識缺口
回顧指出文獻有三個結構性盲點,而第一個正是家長與政策制定者最該在意的。
缺口一:兒童幾乎沒被研究過。 在被分析的論文中,80% 的參與者是大學生——絕大多數是成年人,其批判性思考習慣無論好壞早已成形。「我們不能直接假設適用於 22 歲大學生的結論,也同樣適用於 10 歲或 14 歲的孩子,」Storrøsæter 主張。時機才是問題所在:兒童仍在建立成年人視為理所當然的那些能力——感知、資訊處理、評估。「如果 AI 在學童還來不及發展出自己的批判性思考與問題解決能力之前,就接管了思考過程,後果對他們可能與對成年人完全不同。」
缺口二:證據大多來自自我報告。 大多數研究仰賴受試者描述自己的能力與使用情形——研究人員明確指出,這種方法不如對變化進行客觀的縱貫測量可靠。一座建立在自我報告之上的文獻體系,恰恰無法可靠偵測漸進式的認知外包——而那正是所有人都擔心的效應。
缺口三:地理分布嚴重失衡。 南亞、東南亞與東亞——主要是中國——以 28 篇研究居冠;歐洲由西班牙與英國各以 9 篇領先;整個美國只貢獻了 15 篇。非洲、南美洲與中亞,用研究者的話說,「嚴重代表不足」。任何「研究顯示 AI 進教室很安全」的宣稱,實際上都是一句關於中國、西班牙與英國大學生的宣稱。
脈絡:挪威是金絲雀,而且牠自己知道
這篇回顧落地在一個對校園 AI 罕例地深思熟慮的國家。2026 年 6 月,挪威對小學生的生成式 AI 使用實施了近乎全面禁止:6 至 13 歲原則上不得使用,14 至 16 歲只能在教師監督下使用。這項政策延續了挪威更早的手機禁令劇本——其自身研究已將校園手機禁連結到霸凌減少與成績提升。
在這個背景下,Storrøsæter 的立場明顯不是禁止主義。「我支持對年幼學童限制使用 AI。但當 AI 被使用時,必須按照教師的條件來進行,」她說。她真正擔心的是分配問題:不批判地使用 AI 不會建立任何技能,還會浪費掉大量學習機會,這「只會擴大那些批判性使用 AI、把它當工具的人,與那些只是為了更快完成作業而不加批判使用的人之間的差距」。在既有教育不平等之上再疊一層 AI 落差——而且逐年複利擴大——遠比全面性的認知崩壞更可能是真正的失敗模式。
由此得出的處方是教師優先。「師資培育有雙重任務。我們必須培育能自己使用並批判地面對 AI 的教師,同時我們的師培生也必須能教導兒童與青少年如何使用 AI。」而她提出的那個設計問題,正是每所學校終究要回答的問題:思考過程中哪些環節仍然重要到必須讓學生自己完成?我們如何設計出讓 AI 成為工具、而非思考替代品的任務?
為什麼這件事不只關挪威
世界其他地方正以相反的順序進行這場實驗。UNICEF 的 Innocenti 辦公室在 2026 年 6 月估計,多達 50% 的受訪兒童已在使用 AI,其中大部分用於作業。Pew 在 2026 年 2 月報告,略過半數的美國青少年曾用聊天機器人輔助課業。多數國家的政策制定者正在決定鼓勵、容忍還是限制課堂 AI——而其證據基礎,正如這篇回顧所記錄的:80% 是成年人、大多是自我報告、而且地理上集中於三個地區。
挪威媒體管理局的數據給了這場辯論第一個乾淨的先行指標:當 9 至 18 歲族群放棄搜尋的速度快過任何其他年齡層時,行為的轉變早已發生——無論學校做什麼決定都一樣。NTNU 這篇回顧的低調貢獻,在於確立了用來評估這個轉變所需的研究根本還沒做,並具體指出缺口在哪裡——讓接下來的 173 篇研究能對準兒童、使用客觀測量、並把抽樣範圍擴大到三個地區之外。
「教育部門已經被 AI 深刻影響與形塑,」Storrøsæter 總結道。「問題在於,我們能否塑造 AI 的使用方式,讓它支持學生的思考,而不是接管它。」在史上最快的資訊行為變革進入第二年之際,這個問題既急迫——而且就現有最佳證據而言——仍未有答案。