PISA 2025 對生成式 AI 的訊息,並不是「學校該不該准用」的二分題,而是學生怎麼使用。這項由超過 76 萬名、來自 91 個國家與經濟體的 15 歲學生參與的評量發現:若學生經常用聊天機器人代替自己閱讀、查找資料或寫作,這種使用方式與較低的科學表現同時出現。這是觀察性比較,不能證明 AI 導致了分數差距。
1
4
最受關注的數字:科學成績相差 28 分
根據報導,表示「從不或幾乎不用」AI 起草寫作作業的學生,PISA 科學平均分數為 509 分;「每天或幾乎每天」用 AI 做這件事的學生,平均為 481 分。在調整社會經濟背景後,兩者仍有 28 分差距。
2
5
學生若以 AI 進行初步研究,或摘要教師指定的閱讀文本,也呈現類似走勢。這些特定用途的平均差距約為 20 分;其中,頻繁使用 AI 摘要閱讀內容者的差距接近 30 分。
6
12
但這不表示聊天機器人必然拉低了任何一位學生的成績。高頻使用 AI 的學生,可能本來就在先前學業程度、學習動機、家庭條件、教學資源或作業型態上有所不同。較嚴謹的結論是:密集、替代學生完成任務的 AI 使用,和較弱的科學表現呈現相關。
4
AI 已經成為多數學生的作業工具
僅 14% 學生表示完全不以 AI 協助學校作業,換言之,86% 至少偶爾使用過。各教育體系的未使用比例差異很大:日本接近四成,越南則約 4%。
1
因此,校園真正要處理的已不是學生會不會接觸聊天機器人,而是如何在課堂中保住閱讀理解、推理、查證來源與原創寫作等基本功。
使用頻率與目的,比「有沒有用」更重要
PISA 所呈現的關係並非直線式的「AI 越少越好」。報導指出,約每週使用一、兩次、且是為了幫助自己學習的適度使用者,表現優於完全不用或每天使用者。
9
這個差異有實際意義。請 AI 對自己的說明給回饋、提供不同例子,或設計問題測試理解,與直接讓 AI 產出閱讀摘要、研究筆記或作業初稿,卻不自行檢視,並不是同一件事。
資料並未顯示每一種 AI 使用都會傷害學習;但它提示,若 AI 變成繞過閱讀、起草與驗證證據等認知投入的捷徑,就不利於 PISA 所測量的能力。
學校要教的,不只是操作 AI,而是評估 AI
教學介入看來是關鍵環節。報導指出,在經常使用 AI 的學生中,接受過「如何評估 AI 生成資訊」教學者,科學成績比未受相關教學的同儕高約 13 分。
4
較有建設性的課堂模式,是把 AI 當成「鷹架」而不是「拐杖」:學生必須質疑、驗證並改進 AI 的回答。教師可要求學生:
- 找出 AI 回答中沒有依據或可能錯誤的主張;
- 將 AI 回答與指定閱讀資料逐項比對;
- 說明最終答案背後的推理過程;
- 用自己的語言重寫並修訂 AI 產生的草稿;
- 記錄工具提供了什麼、自己又修改了什麼。
這類做法讓學生為「思考過程」負責,而不只是交出一份看似完整的成品。
這份結果也放在整體學習下滑的背景中
AI 的發現出現於 OECD 國家學業表現長期下滑之際。2015 年至 2025 年間,OECD 國家的平均閱讀分數下降 28 分、數學下降 22 分,科學則下降 7 分。
1
7
這些長期變化不應歸咎於生成式 AI。成績下滑在聊天機器人普及前已開始;相關報導亦指向學習投入、閱讀習慣與數位注意力等更廣泛壓力。
1
3
PISA 2025 給學校的重點
PISA 2025 支持的是審慎、依證據調整的做法,而不是宣稱所有學生使用 AI 都應一律禁止。學校可更清楚區分:哪些 AI 使用是在支援學習,哪些是在取代學習。
對於重要的閱讀、研究與寫作任務,學生仍應對底層的理解與工作負責;若允許使用 AI,流程應納入查證、說明與修訂。核心問題很簡單:聊天機器人究竟有沒有讓學生想得更深,還是讓學生避開了本來必須自己完成的思考?
4
9