人工智能與數字教育觀察
AI and Digital Education Spectator
RESEARCH

教育研究

教師與學生一起閱讀習作的欄目插畫
更多篩選 · 已選1項

16

AI潤文保留意思,也可能令不同人的聲音愈來愈相似

研究透過三項研究、七組資料及逾88萬份文本,分析AI寫作助手與語言多樣性的關係,並比較人類原文及模型潤飾後的文字。AI大致保留核心內容,卻令寫作風格更相似;不同資料及模型中,寫作複雜度的差異縮小21%至50%,部分較佔優勢的作者特徵亦被放大。結果涉及文字特徵及其社會訊息,沒有直接量度學生的長期寫作能力或創造力。

南加州大學
Nature Human Behaviour2026-08-24 · 約1分鐘
相關報道

跟隨數碼人學太極,能否同時記住中文詞語?

研究以482名新西蘭初級中文學習者為對象,探討數字人示範太極時,動作、語音及學習環境如何配合中文學習。設計結合示範速度調整、動作分解、重複練習及聲畫提示,並觀察學生即時掌握動作和記憶詞語的表現。研究指出多種提示配合有助學習,但未交代完整分組及延後測試,所得即時表現不能直接代表長期語言能力的提升。

作者機構未列於公開資料
《國際中文教育學報》期刊出版 2026-06 · 約1分鐘

教師願意嘗試AI,與自評素養有何關係?

研究向270名以色列教師發出網上問卷,量度人工智能素養、接受程度、運算思維、焦慮及數碼資源差異。各項接受程度指標均與素養評分呈正向關係,其中使用樂趣及使用意願是較強的預測因素;運算思維、焦慮及數碼差異亦有關聯。結果呈現教師態度與自評能力的關係,但資料來自同一次問卷,未能證明提高使用意願便會提升實際能力。

Israel Academic College、Bar Ilan University
Smart Learning Environments2026-01-21 · 約1分鐘

教師認同AI倫理原則,實際處理情境仍需要練習

研究收集108名以色列教師的問卷,並分析開放題回應,了解他們對人工智能倫理的看法和經驗。教師普遍認同透明、公平及問責,但自評信心只屬中等,參與正式培訓的經驗亦有限。許多教師未曾直接遇到相關兩難,其回答主要提出討論、訂立課堂規則及糾正措施等假設處理方法。文章以知識、價值及反思實踐的關係,探討教師的數字倫理能力。

Levinsky-Wingate Academic Center、Peres Academic Center
AI and Ethics2025-12-05 · 約1分鐘

中文文化教學智能體的內容與語言設計

文章檢視海外中文文化教材的需要,指出一般人工智能輸出可能出現內容錯誤、拼音或翻譯不足,以及語言程度不合適等問題。作者參照TOTE模型與分級教材原則,設計中文文化教學智能體,把文化內容及學習者程度納入生成過程。研究著重問題診斷和系統設計,摘要未交代參與人數、比較組或學習測試,因此所述應用優勢尚不能等同已證實的學習成效。

作者機構未列於公開資料
《國際中文教育學報》期刊出版 2025-12 · 約1分鐘

用刻意設計的化學提問,檢視AI推理盲點

研究針對大型語言模型的化學推理能力,設計具挑戰性的提問,要求ChatGPT等模型處理複雜化學問題,再分析答案及推論。這些提問刻意測試模型在學科內容上的能力邊界,結果揭示現有系統的推理弱點,流暢的文字解說並不一定伴隨可靠的化學判斷。論文屬模型能力分析,未安排學生學習介入,也沒有以成績比較證明相關工具的教學效果。

University of the Basque Country UPV/EHU、Udako Euskal Unibertsitatea
Education and Information Technologies2025-01-03 · 約1分鐘

17項研究統合:AI能增加學習投入,依賴問題仍須處理

研究從四個資料庫的766項紀錄中選取17項實證研究,合共涉及1,735名學生,以統合分析比較有及沒有ChatGPT支援的學習投入。整體投入呈中等平均效應;行為和情感投入屬中等,認知投入則較大。文獻中的主要用途包括個別指導、編程協助、內容生成及協作,同時出現過度依賴等情況。結果反映所納入教學安排的平均差異,各項應用仍存在不同表現。

香港中文大學、香港教育大學
Computers and Education: Artificial Intelligence2025-01 · 約1分鐘

AI編寫外語教案:指示更詳細,質素未必更高

研究逐步增加提示內容,以ChatGPT生成外語教案,並重複相同提示,檢視教案質素與差異。整體教案評分較高,但加入更多細節未必提高品質,同一提示亦可產生差異甚大的結果。部分活動沿用背誦預設對話等舊有做法,與着重溝通的教學原則不符。研究對象是AI生成教案,沒有直接觀察教師實施或量度學生的學習成效。

University of North Carolina at Charlotte
ReCALL2024-12-11 · 約1分鐘

學生如何借助GPT-4反思數學解題過程?

研究分析學生與GPT-4的數學解題對話,探討工具如何支援學生監察、調整及反思自己的思考。分析結合工具使用方式、後設認知活動,以及有意識而有效的態度與行為模型,辨識學生初步形成的不同使用模式,並描述ChatGPT的引導特點。論文亦討論生成式人工智能如何增加人與數碼環境互動的複雜性。研究著重解題過程,沒有比較組成績可供判斷整體學習增益。

Sapienza University of Rome
Digital Experiences in Mathematics Education2024-11-13 · 約1分鐘

四個AI角色共同改數學題,教師怎樣評價?

研究設計四個人工智能角色,分別從數學深度、語言、照顧差異及能力要求出發,經多輪對話共同修改六項數學任務,再由六名在職教師盲評原題與改寫版本。生成版本增加了可行解題途徑及具體指示,但文字量與題意精確度之間未必取得平衡。教師亦以多項尺度評分並解釋取捨。研究評估的是任務設計,未比較學生使用改寫題目後的學習表現。

TUD Dresden University of Technology、University of Hamburg
Digital Experiences in Mathematics Education2024-10-24 · 約1分鐘

英文修訂只問「幫我改善」,容易停留在哪些層面?

研究以單組前後測設計,收集英文文章、反思及ChatGPT對話紀錄,分析學生修訂文章時的目標、提示寫法,以及兩者是否配合。學生多集中處理表層語言問題,常用籠統提示,未能清楚交代個別修改需要。修訂後,語言表達有所改善,內容、組織及連貫方面的進步則有限。研究呈現提示方式與修訂過程的關係,但單組設計未能把成效完全歸因於工具或提示。

Yonsei University
The Asia-Pacific Education Researcher2024-10-21 · 約1分鐘

用數碼箭咀記錄比例推理,為機器學習建立資料

研究以設計研究方法,在問題導向的數學協作平台開發SPArrows數碼標註功能,讓學生和教師用視覺筆記記錄比例推理。教師及研究人員可為標註加上標籤,累積日後訓練機器學習分析推理過程的資料。論文交代系統發展中出現的設計難題,並連繫至其設計原則。這項工作屬概念驗證,並未證明系統已能可靠評分,亦未比較學生的學習成效。

Michigan State University、The Concord Consortium
Digital Experiences in Mathematics Education2024-10-16 · 約1分鐘

虛擬課室加入數碼人:Learningverse如何安排學習互動?

研究開發Learningverse,把二維及三維學習場景、數字人和大型語言模型結合,透過檢索教材提供即時對話與學習提示。數字人可按課程調整外觀、動作、目光、表情及聲音,讓學習互動配合不同主題。先導試用報告學生互動、動機及學習表現有正面變化,但摘要未交代樣本人數、比較組和測量方法,因此未能確定改善幅度及各項設計的個別作用。

香港教育大學
HKTEA Symposium 20242024-06-19 · 約1分鐘

14篇文獻綜述:學生接受AI答案之前,會否停下來判斷?

研究依系統綜述程序,從四個資料庫選取14篇文獻,探討過度依賴人工智能對話系統與學生判斷、批判思考及分析推理的關係。作者把未經質疑便接受系統建議視為過度依賴的重要表現,並指出使用者可能難以判斷答案的可信程度。文獻顯示,追求快速完成任務會促使學生採用思考捷徑;研究著重整理形成依賴的因素及認知風險,並非對所有工具使用方式作相同判斷。

CQUniversity
Smart Learning Environments2024-06-18 · 約1分鐘

72篇研究:使用AI時很投入,是否也投入了學習?

研究整理ChatGPT推出首年內的72篇實證研究,從行為、情感及認知三方面檢視學生的學習投入。文獻較集中記錄工具使用行為和學術失當;情感投入的結果有正有負,認知投入的證據則較分散及薄弱。不同研究對投入的定義和測量方式亦不一致。綜述顯示,使用工具的頻率或學生感到有趣,不能直接代表他們曾深入理解、判斷或反思學習內容。

香港教育大學、香港中文大學
Computers & Education2024-06-08 · 約1分鐘

1,006名學生使用者調查:AI陪伴帶來的支援感,如何理解?

研究調查1,006名Replika學生使用者,了解其孤獨感、感受到的社會支援、使用方式及對聊天機械人的看法。參加者的孤獨感高於一般學生群體,卻同時報告較高支援感,不少人把工具兼作朋友、對話協助及自我反思對象,對其身分也持有重疊甚至矛盾的理解。結果來自既有使用者的自述,不能據此判定聊天機械人的治療成效或推及所有學生。

Stanford University
npj Mental Health Research2024-01-22 · 約1分鐘