用刻意設計的化學提問,檢視AI推理盲點
研究針對大型語言模型的化學推理能力,設計具挑戰性的提問,要求ChatGPT等模型處理複雜化學問題,再分析答案及推論。這些提問刻意測試模型在學科內容上的能力邊界,結果揭示現有系統的推理弱點,流暢的文字解說並不一定伴隨可靠的化學判斷。論文屬模型能力分析,未安排學生學習介入,也沒有以成績比較證明相關工具的教學效果。
論文原文
Evaluating and challenging the reasoning capabilities of generative artificial intelligence for technology-assisted chemistry education研究及來源資料
研究來自哪裏?
University of the Basque Country UPV/EHU、Udako Euskal Unibertsitatea
發現資料有誤?提供更正資料