人工智能與數字教育觀察
AI and Digital Education Spectator
RESEARCH

教育研究

教師與學生一起閱讀習作的欄目插畫
更多篩選 · 已選1項

51

逾百萬學生資料研究:分區訓練AI,預測成績毋須集中原始紀錄

研究運用逾109萬名學生的考試資料,結合31項學業、教學及社會經濟因素,比較不同成績預測模型。分區訓練只交換模型更新,各區保留原始資料;個人化模型的整體預測表現略高於兩個集中訓練模型。過往成績的預測力最強,環境因素的影響則因地區而異。研究使用模擬分區資料,著重預測準確程度,未測試模型能否改善學生學習。

University College London(倫敦大學學院)、土耳其國民教育部資訊科技部門等
Scientific Reports2026-09-08 · 約1分鐘

美國創新大學AI政策:清楚要求也要配合教學支援

研究分析美國50所獲評為最具創新性大學的官方網站,以文件分析及主題分析整理生成式人工智能政策。共同做法包括由教師訂定課程規則、要求申報使用情況、保障資料私隱、審慎採用人工智能偵測,以及提供素養培訓。各校在使用許可、工具選擇及管理成熟程度上仍有差異,支援則分布於教學中心、圖書館、資訊科技部門和學術誠信辦公室。

Louisiana State University
International Journal for Educational Integrity2026-08-27 · 約1分鐘

AI潤文保留意思,也可能令不同人的聲音愈來愈相似

研究透過三項研究、七組資料及逾88萬份文本,分析AI寫作助手與語言多樣性的關係,並比較人類原文及模型潤飾後的文字。AI大致保留核心內容,卻令寫作風格更相似;不同資料及模型中,寫作複雜度的差異縮小21%至50%,部分較佔優勢的作者特徵亦被放大。結果涉及文字特徵及其社會訊息,沒有直接量度學生的長期寫作能力或創造力。

南加州大學
Nature Human Behaviour2026-08-24 · 約1分鐘
相關報道

AI預測答對率,能否解釋學生怎樣學?教育心理學提出效度要求

文章檢視AI何時可被視為解釋學習的認知模型,綜合神經網絡、強化學習、認知架構及大型語言模型的研究。作者提出理論根據、量度效度、機制透明、人類學習軌跡、錯誤模式及因果干預等準則,指出單靠準確預測分數不足以解釋學生如何學習。文章屬理論與方法綜述,沒有新學生樣本,所列準則亦不表示現有模型已通過相關驗證。

Vrije Universiteit Amsterdam(荷蘭)、Erasmus University Rotterdam(荷蘭)等
Educational Psychology Review2026-07-18 · 約1分鐘
相關報道

大學化學課程是否已為AI與機器學習作準備?

研究由來自九個地區的作者合作,按2024年QS院校名單蒐集大學公開課程資料,分別整理計算類及人工智能/機器學習化學課程。已有計算課程的院校,亦較常提供人工智能課程;部分院校課程較少,可能涉及資源優次或師資不足。論文並討論課程更新、教師知識及不同持份者的角色。公開課程資料未必完整反映實際教學,也不能直接代表學生能力。

National University of Singapore、University College Dublin等
Journal of Science Education and Technology2026-05-18 · 約1分鐘

收到AI評語後,學生如何參與判斷和修改?

文章結合概念分析及近期研究,探討教師、學生與人工智能如何在回饋過程中合作,重點比較回饋的及時性、準確程度、細節、可理解程度及語氣。分析亦把師生關係和學生參與判斷、回應及修改的過程納入考慮,涉及內地師生資料。文章屬研究綜合,著重釐清不同回饋來源的特點與合作方式,沒有以實驗比較人與人工智能回饋對成績的個別效果。

香港大學教育學院
港大CITERS 2026論文集文件日期 2026-05 · 約1分鐘

南非大學AI指引分析:要求學生申報之後,院校責任怎樣寫清楚?

研究分析南非公立大學於2025年2月公開的生成式AI指引,以透明、責任、私隱、人類自主及共融五項倫理原則編碼。當時46%的大學有全校性指引,對學生披露AI使用及負責任學習的要求較詳細;院校數據治理、教職員責任和共融安排則較簡略,部分只屬建議。研究呈現特定時點的文件內容,沒有驗證各校落實情況或指引對學習的影響。

西開普大學、開普敦大學
Universal Access in the Information Society2026-04-22 · 約1分鐘

教師與AI共同備課:現有研究多停留在構思及內容生成

研究系統整理2015至2025年的28篇實證論文,分析教師與人工智能共同設計學習任務時的理論、工具功能、協作方式及目的。生成式工具較常用於教案、提示和創意構思;傳統人工智能則多涉及分析與回饋設計。工具大多擔任助手或內容生成者,較少成為持續對話及共同修訂的伙伴。選用考慮主要涉及效率、回應能力、創意及公平,相關理論仍較分散。

East China Normal University、City University of Macau等
Humanities and Social Sciences Communications2026-04-03 · 約1分鐘

希伯來語化學考試:三個AI模型仍遜於中學生

研究以120道希伯來語高中化學公開試選擇題,測試ChatGPT-4o、Claude 3.5 Sonnet及Gemini 1.5 Pro,並與逾13.9萬名考生的資料比較。三個模型的整體表現均顯著低於學生,圖像及多步推理題尤其困難。研究再由化學教育專家分析最難題目的學科錯誤。結果對應受測版本及特定語言試卷,不能直接代表更新模型的能力。

Weizmann Institute of Science
Journal of Science Education and Technology2026-03-28 · 約1分鐘

35項研究的平均結果,能否回答你的課堂問題?

研究統合2022至2024年的35項實驗,共涉及4,193名參與者,分析ChatGPT對認知及非認知學習成果的影響。整體效果量為0.670,屬中等正面效果,學科、介入時間及教學模式能解釋部分差異,學段及知識類型則未有顯著調節作用。作者同時指出樣本選擇及未充分涵蓋調節因素的限制,平均結果不代表每種工具或課堂均有相同效果。

湖南科技大學教育學院
Humanities and Social Sciences Communications2026-03-26 · 約1分鐘
相關議題報道

35項自我調節學習研究:AI在執行任務階段的支援較強

研究綜合2013至2025年35項實證研究,按事前規劃、任務執行及事後反思,分析規則式、數據驅動及生成式AI的支援效果。整體效果量為0.507,任務執行階段較事前規劃為高;生成式AI部分結果較強,但研究之間差異很大。以行為紀錄量度的效果亦大於自評,顯示教學安排及量度方式會影響結論,短期任務改善未必等同持久的自我調節能力。

華東師範大學、上海大學
British Journal of Educational Technology2026-03-12 · 約1分鐘

批判思考怎樣留在學生手上?八項AI教學設計原則

文章綜合認知心理學、教育理論及AI倫理,提出在大學課程使用語言模型的教學框架,涵蓋概念理解、推論、評價、後設認知、求知及知識誠信六類過程。八項設計原則包括保留思考難度、將AI回應視為待檢驗的想法,以及交替安排有AI與無AI活動。文中以兩個課堂情境說明應用,屬概念分析,並非已完成課堂驗證的成效研究。

Artificial Intelligence Research Institute, Spanish National Research Council(西班牙)、University of Melbourne(澳洲)
Computers and Education: Artificial Intelligence2026-03-07 · 約1分鐘

瑞典高中AI課程分析:技術知識之外,批判與行動空間足夠嗎?

研究以瑞典高中新增的AI科為例,分析政策、課程及支援文件如何界定AI素養。作者採用三維素養模型,分別檢視操作技能、文化脈絡和批判理解,發現文件較重視操作層面,雖包含部分文化理解,讓學生質疑、回應或改變AI實踐的空間則較少。結果反映課程文本的取向,沒有觀察所有教師的課堂實踐,亦不能用來判定學生的實際批判能力。

林奈大學、于默奧大學等
Technology, Pedagogy and Education2026-02-13 · 約1分鐘

英文批改提示加入錯誤類別和例子,有何分別?

研究以30篇大學生英文習作,比較一般提示、加入批改專業知識的提示,以及同時提供示例的提示,如何影響ChatGPT辨識語言錯誤。結果顯示,一般提示的表現低於Grammarly;加入專業知識後兩者相若,再加入示例則有較佳表現。進步主要見於用字、直接翻譯、句子結構及代名詞錯誤。不過,即使使用最詳細的提示,ChatGPT仍有部分辨識限制。

蘭州大學、澳門理工大學
ReCALL2025-12-29 · 約1分鐘

中文文化教學智能體的內容與語言設計

文章檢視海外中文文化教材的需要,指出一般人工智能輸出可能出現內容錯誤、拼音或翻譯不足,以及語言程度不合適等問題。作者參照TOTE模型與分級教材原則,設計中文文化教學智能體,把文化內容及學習者程度納入生成過程。研究著重問題診斷和系統設計,摘要未交代參與人數、比較組或學習測試,因此所述應用優勢尚不能等同已證實的學習成效。

作者機構未列於公開資料
《國際中文教育學報》期刊出版 2025-12 · 約1分鐘

情緒AI統合分析:鼓勵與知識支援,各有甚麼作用?

研究整理2000至2025年172篇情緒AI實證文獻,並以其中49篇的54項研究進行統合分析。結合認知與情緒支援的知識學習效果量為0.88,只有認知支援則為0.52;在觀感及情緒指標上,結合支援未必佔優。單獨提供情緒支援的證據只有兩項研究,部分情緒結果亦有發表偏差線索。不同工具及任務的差異,限制了對情緒支援本身作用的判斷。

香港大學、浙江大學等
Educational Psychology Review2025-11-15 · 約1分鐘

融合教育文獻:語言協助與輔助科技能否照顧課堂差異?

文章綜述人工智能如何支援多語課堂及有特殊教育需要的學生,重點包括即時翻譯、溝通協助和個別化學習材料。文獻呈現學生參與和表現的正面經驗,也指出教師角色及工作量可能隨工具使用而改變。工具能否公平取得、學生資料如何處理,以及應用是否符合倫理要求,均是主要關注。文章整理不同技術的用途與限制,並非針對單一教學介入進行成效比較。

Technical University of Darmstadt
AI and Ethics2025-09-12 · 約1分鐘

德國PISA短答研究:AI評分準確,也要檢查不同學生群組是否公平

研究以德國PISA 2015閱讀題的38,722份短答,比較不同自動評分方法,並檢查性別和家庭語言背景的公平性。最準確的方法結合RoBERTa文字表示與支援向量機,未見明顯性別偏差,卻對主要在家使用外語的學生給予略高於人工評分的分數。差異在個別題目更突出,與錯答辨識、學生表現、答案語言差異及試題難度有關,顯示整體準確率未能盡錄群組偏差。

DIPF | Leibniz Institute for Research and Information in Education、Goethe-Institut等
International Journal of Artificial Intelligence in Education2025-07-24 · 約1分鐘

63篇研究:AI工具改善知識表現,思考能力的結果較不一致

研究整理2014年1月至2024年4月的63篇期刊論文,分析高等教育人工智能學習工具的設計,以及認知、技能和情感成果。32篇採用公開工具,31篇自行開發系統;常見用途包括評估、個別回饋和智能導學,部分工具提供多媒體材料。整體而言,知識掌握和情感成果較多呈正面結果,但思考歷程及技能發展的成效差異較大,顯示不同學習成果不能合併看待。

National University of Singapore、University of Sydney等
International Journal of Educational Technology in Higher Education2025-07-11 · 約1分鐘

28篇真實課堂AI研究:教學理據與教師需要仍常被忽略

研究以系統文獻綜述分析28篇在真實中小學情境使用AI的論文,檢視技術、教學理據、課程背景及教師角色。文獻較集中中國和美國的小學,常見技術包括社交機械人、擴增實境及智能系統。約半數未充分交代教學理論或具體課程條件,多數着重學習結果,較少探討教師需要、感受及自主。研究呈現既有文獻的缺口,未量度所有AI課堂的實際質素。

Radboud University/NOLAI(荷蘭)、Maastricht University(荷蘭)等
British Educational Research Journal2025-06-24 · 約1分鐘
相關議題報道

從科學教育會議研究,看AI帶來哪些教學難題

研究系統整理2024年NARST科學教育會議的36篇人工智能相關論文,分析應用方式及挑戰。文獻中的工具逐漸結合多種用途、文字與圖像生成,但大多延續既有科學教育取向,未重新界定其基本方向。主要難題涉及教育目標、學習內容、個別回饋的評估、教師準備,以及偏差與公平。資料限於單一會議,所呈現的是該研究社群的發展,並非全球文獻全貌。

National Institute of Education, Singapore、University of Florida等
Journal of Science Education and Technology2025-06-21 · 約1分鐘

科學與化學教育研究,怎樣運用AI支援學習?

研究系統回顧2014至2024年人工智能在科學及化學教育中的應用,發現2021年後相關文獻增加,常見工具包括ChatGPT及對話機械人。應用涵蓋網上學習、實驗課、多模式教材、跨學科學習及個別支援。文獻同時反覆提出性別與種族偏差、錯誤生成、版權、抄襲、可靠性、技術設備及語言支援等問題。各研究的工具及衡量方式不同,未有統一成效幅度。

Trabzon University
Discover Education2025-06-16 · 約1分鐘

追蹤點擊、眼動與情緒:AI學習分析先要說清楚量度甚麼

研究以系統文獻綜述檢視自我調節學習的量度方法,整理142篇文章所用的行為、情境及生理資料,並對照認知、後設認知、情緒與動機等過程。多類資料的收集日益普遍,但分析往往未能對齊事件的時間與先後次序,情緒和動機亦較少得到充分量度。研究提出AI分析的可能用途,重點在於如何理解學習過程,並非測試聊天工具能否提高學生成績。

Radboud University/NOLAI(荷蘭)、University of Oulu(芬蘭)等
Educational Psychology Review2025-06-04 · 約1分鐘

智能輔導系統有效嗎?28項研究提供的線索

研究以系統文獻綜述整理28項智能輔導系統研究,共涉及4,597名中小學生,並分析各項準實驗的設計及介入時間。整體學習與表現結果傾向正面,但與不具智能功能的輔導系統比較時,優勢有所減弱。作者指出,較長介入、更多元樣本及教育倫理仍需研究。綜述涵蓋不同智能系統,不能直接用來評價每一款生成式AI聊天工具。

魁北克大學蒙特利爾分校(UQAM)、蒙特利爾高等商學院(HEC Montréal)
npj Science of Learning2025-05-14 · 約1分鐘
相關議題報道