六千多名初中生試驗:AI錯題輔導的價值取決於練習安排
研究在美國六千多名初中生的數學練習中,隨機比較AI與一般電腦支援,以及不同掌握學習規則,一周後再評估。AI組進度較慢、題量較少,但在已作答的題目中準確度較高,錯題後下一次答對的比例亦增加。延後測驗較正面的結果集中在AI配合掌握學習流程及部分已練習內容,且部分差異只達邊緣顯著,未足以確認廣泛的數學遷移效果。

研究在美國六千多名初中生的數學練習中,隨機比較AI與一般電腦支援,以及不同掌握學習規則,一周後再評估。AI組進度較慢、題量較少,但在已作答的題目中準確度較高,錯題後下一次答對的比例亦增加。延後測驗較正面的結果集中在AI配合掌握學習流程及部分已練習內容,且部分差異只達邊緣顯著,未足以確認廣泛的數學遷移效果。
研究分析德國三所中學98名九年級學生,在數學課使用AI導師的1,616個對話回合,並收集前後測、學習需要及認知負荷資料。學生事前多希望得到概念解釋和逐步支援,實際對話卻少有明確檢查或評估自己的理解。後測表現低於前測,額外認知負荷亦與較低分數相關。對話分類仍屬AI初步編碼,研究沒有無AI對照組,不能斷定工具導致退步。
研究在2024/25學年上學期比較兩組各九名準教師,探討生成式人工智能融入數學探究學習後的表現。參加者運用工具設計個別化數學活動,課末評估主要採用學習成果自評。人工智能組的批判思考自評較高,差異達統計顯著;解難和書面溝通的組間差異則未達顯著。研究人數少,結果主要反映課末自我評價,不能直接推算客觀能力的進步幅度。
研究在近一千名高中數學學生中,比較一般GPT-4聊天介面、加入學習支援限制的AI導師及沒有AI的條件,分開評估練習和其後獨立測驗。兩種AI均提高練習表現,但移除工具後,一般聊天組低於無AI組;具學習支援設計的工具則大幅減輕負面影響。結果顯示有工具協助的練習表現與獨立解題能力可能不同,不能推論其他學科或工具會有相同效果。
這項範疇文獻綜述整理ChatGPT在數學教育中的用途,包括解釋概念、設計教案與評估、個別化學習及合作活動。文獻顯示,工具具備提供即時回饋和支援自主學習的潛力,同時涉及答案不準確、倫理疑慮及過度依賴等問題。作者分析教師覆核與教學安排在其中的作用,並討論學生與工具互動方式的改變。綜述著重用途與議題,沒有提出一致的學習成效估算。
研究分析工程學生的三次訪談,了解他們初用ChatGPT時,如何逐步形成使用方式。用途涵蓋數學與工程、一般學業及個人生活;在數學建模中,學生會用它澄清概念、比較策略、把模型轉成程式,以及改善程式。訪談亦顯示,學生對工具限制的判斷隨經驗發展,部分把它視為可以討論想法的學習伙伴。研究呈現個案經驗,沒有以對照測驗確認能力提升。
研究以馬耳他中學數學教師為對象,分析專業發展活動前後的問卷及現場筆記,了解教學信念與ChatGPT觀感之間的關係。重視探索和概念連繫的教師較看好工具,認為可用於設計練習、評估及個別回饋。教師亦指出,工具在理解數學圖像及答案準確性方面有局限。資料主要反映教師自述的信念與活動經驗,未直接量度學生的數學學習表現。
研究以一百三十四名中二學生的迪士尼路線優化專題,評估數學建模在中學的實踐。課程按閱讀、建模、估算、計算、驗證及寫作六階段設計,並分析數碼作品、問卷、訪談及課堂觀察。多數學生接受活動,在閱讀、計算和寫作表現較好,但建模及驗證仍較薄弱,反映教材及教師教學支援有待改善。
研究分析學生與GPT-4的數學解題對話,探討工具如何支援學生監察、調整及反思自己的思考。分析結合工具使用方式、後設認知活動,以及有意識而有效的態度與行為模型,辨識學生初步形成的不同使用模式,並描述ChatGPT的引導特點。論文亦討論生成式人工智能如何增加人與數碼環境互動的複雜性。研究著重解題過程,沒有比較組成績可供判斷整體學習增益。
研究設計四個人工智能角色,分別從數學深度、語言、照顧差異及能力要求出發,經多輪對話共同修改六項數學任務,再由六名在職教師盲評原題與改寫版本。生成版本增加了可行解題途徑及具體指示,但文字量與題意精確度之間未必取得平衡。教師亦以多項尺度評分並解釋取捨。研究評估的是任務設計,未比較學生使用改寫題目後的學習表現。
研究讓中學數學準教師先自行擬寫微格教學教案,再要求ChatGPT處理相同的解題及備課工作,並分析他們對生成內容的反思。參與者大致能辨認教學設計的不足,例如重複、偏重教師講授,以及忽略學生需要;但判斷數學內容時較不準確,有時把錯誤解答當成另一種解法。結果呈現教學判斷與學科判斷的差異,未直接評估教案在真實課堂中的成效。
研究以設計研究方法,在問題導向的數學協作平台開發SPArrows數碼標註功能,讓學生和教師用視覺筆記記錄比例推理。教師及研究人員可為標註加上標籤,累積日後訓練機器學習分析推理過程的資料。論文交代系統發展中出現的設計難題,並連繫至其設計原則。這項工作屬概念驗證,並未證明系統已能可靠評分,亦未比較學生的學習成效。
研究邀請11名準教師運用ChatGPT解答四道數學題,分析對話紀錄及訪談,了解其數學知識、提示技巧,以及判斷工具準確性的能力。每道題目均出現正確與錯誤答案;當工具提供錯解,部分參與者亦跟隨出錯,並有高估或低估工具能力的情況。分析亦發現提示技巧有所不足。研究限於少量參與者及特定任務,未能概括所有準教師的表現。