OpenAI 与博科尼大学联合实验发现,使用 ChatGPT 能显著提升学生作业的专业度和逻辑性,而因果推理训练则能激发更多独特想法;两者结合,学生兼得两种优势。该研究提示教育评估需从关注答案转向关注思考。

OpenAI 与博科尼大学联合开展的一项新实验表明,ChatGPT 和批判性思维训练对学生作业的影响是互补的。使用 ChatGPT 能显著提升作业质量和逻辑连贯性,而针对因果推理的训练则引导学生提出更多独特想法。两者兼得的学生,以上两方面都有提升。
实验邀请了博科尼大学 1000 多名大一学生,参与一个真实商业案例:为大学纪念品商店制定营销建议。学生按课堂时段被随机分入四组,分别获得 ChatGPT(GPT-4o)访问权限、因果推理训练、两者兼有,或什么都没有。因果推理是批判性思维的一种,强调建立因果关系,并解释某个方案为何可能有效或可能失败。训练内容与 AI 无关,通过游戏、示例、提问和反馈来传授相关概念。
学生提交的方案由经验丰富的评分者按五分制打分。研究人员还通过自动化文本分析,衡量答案中观点的数量和多样性、因果推理的痕迹,以及与三位专家答案的相似程度。
结果显示,使用 ChatGPT 的学生评分提高了近一分(满分五分)。他们的答案包含更多想法、逻辑更清晰,也更接近专家的建议。这意味着 AI 帮助新手写出了更专业的方案。值得注意的是,学生并没有把作业直接扔给 ChatGPT,他们仍需决定问什么、评估回答,并选择最终提交哪些内容。
因果推理训练则带来一个更受关注的结果。完成训练的学生能更清楚地解释自己的方案为何有效、在何种情况下可能失败,但在五分制评分上没有更高分数——因为评分标准只关注两个常规营销目标:提升大学商店的知名度和使用率。
但文本分析揭示了评分表未能捕捉的另一层价值:完成训练的学生,整体上产生了更广泛的点子,与同伴的答案差异也更大。这提醒我们,传统的评分标准很容易奖励结构清晰、逻辑通顺的答案,却忽视了学生是否提出了他人想不到的创意。
有人可能认为,教育的核心争论在于学生应该学会独立思考,还是学会使用 AI。这个实验说明,两者各有价值,并且可以互补。AI 帮助答案更精致、更有内容、逻辑更连贯;批判性思维训练鼓励学生探索更广泛的原创想法,质疑假设,并解释自己方案的合理性。
同时获得 ChatGPT 和批判性思维训练的学生,兼得了两种好处:他们的观点多样性接近于只接受训练的学生,评分和想法数量与只使用 ChatGPT 的学生相当,同时在逻辑连贯性和追问假设方面表现更优。整体来看,这一组合覆盖了最多的能力维度。
实验的随机设计让研究人员能够分离 ChatGPT 访问、思维训练以及两者结合的不同影响,也为快速增长的“AI 如何影响学习”研究提供了重要参考。
这个实验也指向学校面临的更大挑战。如果 AI 能帮学生产出专业且精致的答案,那么仅仅查看最终成品,将越来越难以判断学生真正掌握了什么。许多教育工作者已在思考如何调整作业和评估方式。历史也表明,技术与教育始终在共同演进。这提醒我们,评价学生时,应更多奖励原创性、逻辑推理和对多种方案的思考,而不是最常规、最精致的答案。
一句话总结:AI 让答案更好,批判性思维训练让想法更广。两者共同为学生走向未来提供支撑。
原文链接:OpenAI Blog
本文由前途科技编辑整理
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断