AI提升作業評分,因果推理訓練拓闊構思
研究將1,053名一年級經濟、管理及金融本科生分配至因果推理訓練、ChatGPT、兩者兼有或對照條件,要求他們處理真實商品營銷問題。AI提高作業評分、文字連貫性及構思數量;推理訓練未顯著提高評分,卻增加機制分析及構思多樣性,兩者並用保留了相關作用。研究集中一次作業及特定評準,沒有測量移除工具後的知識保留或長期能力。
研究將1,053名一年級經濟、管理及金融本科生分配至因果推理訓練、ChatGPT、兩者兼有或對照條件,要求他們處理真實商品營銷問題。AI提高作業評分、文字連貫性及構思數量;推理訓練未顯著提高評分,卻增加機制分析及構思多樣性,兩者並用保留了相關作用。研究集中一次作業及特定評準,沒有測量移除工具後的知識保留或長期能力。
研究在美國六千多名初中生的數學練習中,隨機比較AI與一般電腦支援,以及不同掌握學習規則,一周後再評估。AI組進度較慢、題量較少,但在已作答的題目中準確度較高,錯題後下一次答對的比例亦增加。延後測驗較正面的結果集中在AI配合掌握學習流程及部分已練習內容,且部分差異只達邊緣顯著,未足以確認廣泛的數學遷移效果。
研究以60名小四學生進行六周詩歌寫作活動,實驗組接受ChatGPT形成性回饋並修訂作品,對照組沒有AI支援。控制前測後,實驗組的詩歌寫作評分及對詩歌的態度均較佳。活動由教師引導處理回饋,並非讓學生自行使用聊天工具。研究只涉及一校兩班,沒有長期追蹤,亦未能分離額外回饋、修訂練習與AI本身各自的作用。
彭學高中學把AI安排在預習、課堂討論和課後整理的學習流程中。教師先按難點設計分層預習題,課堂運用互動程式及解題筆記,讓學生討論錯因。課後,學生須先整理自己的筆記,再撰寫提示詞請AI生成對照版本,依次觀察、思考和提問,比較兩者內容與組織,重新檢視自己的學習。
研究在354名大學生的入門經濟學課程中,比較助教自行撰寫評語與使用FeedbackWriter建議的評語,共處理1,366篇稿件。助教可採納、修改或刪除AI建議;收到AI輔助評語的學生,修訂稿質素較佳,評語亦較具體可行,但後測成績未見顯著差異。研究的修訂稿評分主要依賴語言模型,並以部分真人評分核對,作品改善未必代表知識保留。