校情與資源差距如何影響準科學教師運用AI
研究訪談10名南非生命科學準教師,探討不同社經背景學校的實習經驗如何影響其AI教學準備度。資源較充裕學校的實習者,通常有較多科技接觸及信心;資源不足學校的實習者則較關注基建限制、學生取用機會與公平問題。作者指出,忽略情境差異的AI整合可能延續教育不公,師資培訓應提供因應不同校情的支援,培養批判運用AI的能力。

研究訪談10名南非生命科學準教師,探討不同社經背景學校的實習經驗如何影響其AI教學準備度。資源較充裕學校的實習者,通常有較多科技接觸及信心;資源不足學校的實習者則較關注基建限制、學生取用機會與公平問題。作者指出,忽略情境差異的AI整合可能延續教育不公,師資培訓應提供因應不同校情的支援,培養批判運用AI的能力。
研究運用逾109萬名學生的考試資料,結合31項學業、教學及社會經濟因素,比較不同成績預測模型。分區訓練只交換模型更新,各區保留原始資料;個人化模型的整體預測表現略高於兩個集中訓練模型。過往成績的預測力最強,環境因素的影響則因地區而異。研究使用模擬分區資料,著重預測準確程度,未測試模型能否改善學生學習。
研究在美國六千多名初中生的數學練習中,隨機比較AI與一般電腦支援,以及不同掌握學習規則,一周後再評估。AI組進度較慢、題量較少,但在已作答的題目中準確度較高,錯題後下一次答對的比例亦增加。延後測驗較正面的結果集中在AI配合掌握學習流程及部分已練習內容,且部分差異只達邊緣顯著,未足以確認廣泛的數學遷移效果。
研究以預先登記及具獎勵誘因的實驗,調查美國、加拿大和英國約2,000名家長,量度他們為子女購買三個月AI訂閱的付費意願。情境中的同儕採用比例由20%增至80%時,平均付費意願增加逾60%。學習風險資訊改變了家長對長期影響的判斷,卻較少改變個人購買意願,對學校限制使用的支持則上升。研究量度家長決策,沒有測試子女學習成效。
研究透過問卷了解澳洲中小學教師在生成式人工智能普及約兩年後的準備程度及使用情況,重點分析教師的認識、信心和教學實踐。整體準備程度屬中等;即使教師表示有信心操作工具,把它融入日常教學的程度仍有明顯落差。論文亦討論專業發展與政策環境的關係。資料主要反映教師自報情況,未以課堂觀察或學生評估驗證實際教學效果。
研究以身份形成理論分析韓國藝術高中學生在人工智能輔助創作中的經驗,探討他們如何理解原創性、作者身份、自主判斷及作品擁有權。學生對工具的看法並不一致:部分視它為靈感來源或合作伙伴,欣賞製作效率;另一些則擔心人的創作能力和自身角色受到削弱。研究亦呈現學生對版權及生成內容的倫理疑慮,反映年輕創作者如何重新理解自己的創作身份。
研究分析德國三所中學98名九年級學生,在數學課使用AI導師的1,616個對話回合,並收集前後測、學習需要及認知負荷資料。學生事前多希望得到概念解釋和逐步支援,實際對話卻少有明確檢查或評估自己的理解。後測表現低於前測,額外認知負荷亦與較低分數相關。對話分類仍屬AI初步編碼,研究沒有無AI對照組,不能斷定工具導致退步。
研究訪問五個阿拉伯國家16名積極使用人工智能的私立學校校長,探討他們如何理解教師不可替代的角色。校長重視教師掌握專業判斷,親自帶領解說、提問及回饋,並把生成內容轉化為學生需要解釋和批判的材料。這些教師亦會示範使用方法、與同事修訂課業及參與校內指引制定。結果呈現特定校長的看法,並非教師能力排名,亦不能代表所有學校。
研究將371名七至九年級學生隨機分至學習價值支援、認知策略支援及標準ChatGPT三組,在物理或英語課完成六節45分鐘活動。學習價值組的價值感發展較認知策略組有利,但兩個介入組在努力、學科知識及精緻化策略方面,均未顯著優於標準ChatGPT組。較有意義的互動與興趣維持相關,屬探索性結果,未足以證明整體自我調節能力提升。
研究利用挪威EDUCATE項目的課堂錄影,篩查五所中學、20個班的75節英語及挪威語課,分析教師在日常教學中如何使用和介紹生成式AI。部分教師一面以工具支援學科活動,一面引導學生檢查答案、理解局限,並強調自己的思考仍有必要。錄影來自2023至2024年,研究描述真實課堂的教學方式,沒有以對照組驗證學習成效,也不能代表全國學校。
研究以120道希伯來語高中化學公開試選擇題,測試ChatGPT-4o、Claude 3.5 Sonnet及Gemini 1.5 Pro,並與逾13.9萬名考生的資料比較。三個模型的整體表現均顯著低於學生,圖像及多步推理題尤其困難。研究再由化學教育專家分析最難題目的學科錯誤。結果對應受測版本及特定語言試卷,不能直接代表更新模型的能力。
研究以594名中國初中生的問卷及文字回答,分析他們對有益、不傷害、公平、自主和可解釋五項AI倫理原則的看法。學生對有益及自主的認同相對較高,整體回答則偏向中立;獨立使用AI和家庭討論與較高認同相關,城鄉差異未達顯著。研究來自兩所學校,量度的是態度及理由,未能代表全國學生的倫理能力,也不能證明家庭討論造成改變。
研究於2023年10至12月訪問紐約州西部36名學校及學區領導,探討人工智能如何影響教育工作。訪談辨識四類用途:日常文書、教學任務、學校運作及決策,各類引起的好處、疑慮及接受程度均不同。領導親身使用工具的經驗,亦涉及其判斷是否全面。研究反映工具普及初期的看法,並非各用途的成效測試,樣本亦未涵蓋州內最大城市學區。
研究以瑞典高中新增的AI科為例,分析政策、課程及支援文件如何界定AI素養。作者採用三維素養模型,分別檢視操作技能、文化脈絡和批判理解,發現文件較重視操作層面,雖包含部分文化理解,讓學生質疑、回應或改變AI實踐的空間則較少。結果反映課程文本的取向,沒有觀察所有教師的課堂實踐,亦不能用來判定學生的實際批判能力。
研究分析德國及丹麥532名教師的問卷及開放式回應,了解人工智能培訓、教學質素及專業發展需要。教師參與相關培訓仍較有限,但參與次數及滿意程度,與認知挑戰、課堂管理、照顧差異及支援氣氛的自評呈顯著正向關係。質性資料顯示,教師仍處於整合人工智能的初期。研究屬橫斷面調查,這些關聯並不等於培訓已改善學生的學習表現。
研究以澳洲中學科學課三名有特殊學習需要學生為個案,結合訪談、ChatGPT對話、工作紙和課堂錄影,分析學生使用AI時的選擇及行動能力。學生能表達拓展知識、連繫生活和尋求協助的意願,卻在理解答案、維持焦點及檢查資訊上遇到困難。學習意願與實際能力未必一致,成人支援仍有作用。個案數目有限,研究沒有估計整體成效或長期獨立學習的變化。
研究在瑞典一項人工智能教師培訓中,收集452名教育工作者的即時投票、問卷及同儕反思,分析其準備程度和支援需要。回應顯示,只有31%曾使用聊天工具,但88%有意採用,正面態度與實際經驗、使用信心之間存在距離。參與者亦希望獲得持續的機構支援。資料在同一培訓情境收集,並非前後測比較,不能據此判定培訓造成了態度或能力改變。
研究透過44名澳洲中小學教師的問卷,以創新採用理論分析教師使用生成式人工智能的做法及決定。教師主要結合自行探索、同儕交流等途徑學習,工具容易取得亦方便他們試用。決定是否讓學生使用時,教師會同時考慮人工智能素養、年齡及學習準備程度。受訪教師主要把人工智能視為支援備課和學習的工具,相關選擇由教師在實際工作中逐步形成。
研究結合298名已有ChatGPT經驗的中小學教師問卷、五次訪談及對話紀錄,探討工具如何支援自主專業進修。教師主要用它尋找教學構思、安排活動和整理教案,部分亦會設定學習目標、管理時間及檢查進度。教學壓力使進修動機較被動,但工具可成為開始學習的助力。結果反映使用者的經驗及自我管理,未直接量度教學成效,也不能推及未曾使用的教師。
研究以德國PISA 2015閱讀題的38,722份短答,比較不同自動評分方法,並檢查性別和家庭語言背景的公平性。最準確的方法結合RoBERTa文字表示與支援向量機,未見明顯性別偏差,卻對主要在家使用外語的學生給予略高於人工評分的分數。差異在個別題目更突出,與錯答辨識、學生表現、答案語言差異及試題難度有關,顯示整體準確率未能盡錄群組偏差。
研究以包含開放題的問卷收集166名挪威高中生的日常經驗,了解他們如何使用ChatGPT及社交人工智能。大部分尚未形成經常使用的習慣;已有使用者則提到個人協助、情感支援、娛樂及創作靈感等用途。部分學生把工具納入個人決定,同時關注錯誤資訊、私隱及情感依賴。文章透過這些回應,分析人工智能對年輕人尋求支援和人際互動的可能影響。
研究在近一千名高中數學學生中,比較一般GPT-4聊天介面、加入學習支援限制的AI導師及沒有AI的條件,分開評估練習和其後獨立測驗。兩種AI均提高練習表現,但移除工具後,一般聊天組低於無AI組;具學習支援設計的工具則大幅減輕負面影響。結果顯示有工具協助的練習表現與獨立解題能力可能不同,不能推論其他學科或工具會有相同效果。