人工智能與數字教育觀察
AI and Digital Education Spectator

英國大學盲測:AI試卷取得分數,未代表學生掌握了內容

研究把完全由人工智能撰寫的答案放入英國一所大學心理學本科五個科目的真實評卷程序,評卷者事前並不知情。94%的人工智能答卷未被識別,平均評級較真實學生答卷高約半個等級。按科目比較,人工智能答卷優於同數量隨機抽取學生答卷的機會為83.4%。研究檢視的是無監考評估辨認作答來源的能力,並未量度學生使用工具後的學習進步。

論文原文

A real-world test of artificial intelligence infiltration of a university examinations system: A “Turing Test” case study
研究及來源資料
研究來自哪裏?
University of Reading、University of Essex
地域視角
世界各地研究 · 英國
DOI
10.1371/journal.pone.0305354
期刊/研討會
PLOS ONE
類型
盲測;AI答案混入心理學學士課程五個科目的評卷
研究/內容地區
英國
學習領域
個人、社會及人文教育
科目
心理學、評估
原文日期
2024-06-26
最近核實
2026-09-11
研究來源分類
期刊
作者
Peter Scarfe、Kelly Watcham、Alasdair Clarke、Etienne Roesch
學習階段
高等教育
研究領域
教學與評估
研究對象
人工智能系統、文獻及資料、在職教師
分類說明
研究材料為AI及學生答卷,並觀察評卷者判斷;不把答卷表現當成學生學習提升。