AI 教育
OpenAI 研究显示 ChatGPT 与批判性思维训练以不同方式提升学生作业
OpenAI 公布 Bocconi 大学随机实验结果,显示 ChatGPT 提升作业完整度和逻辑性,因果推理训练提升想法多样性。
OpenAI 发布了一项随机教育实验结果,显示 ChatGPT 使用权和批判性思维训练会以不同但互补的方式提升学生作业。公司在 2026 年 8 月 27 日公布该研究,实验由 Bocconi 大学与 OpenAI Economic Research 合作完成,参与者超过 1000 名一年级本科生。
实验要求学生完成一个真实商业案例,为 Bocconi 大学纪念品商店提出营销建议。学生按课堂时段被随机分为四组:一组获得基于 GPT-4o 的 ChatGPT 使用权,一组接受因果推理训练,一组两者都有,一组两者都没有。因果推理训练并不是 AI 使用教程,而是通过类似游戏的练习、示例、问题和反馈,教学生连接原因与结果,判断一个想法为何可能有效,以及在什么条件下可能失败。
研究人员用两种方式评估提交内容。人工评分者使用五分制量表,关注建议是否有效回应标准营销目标。另一个维度是自动文本分析,用来衡量想法数量和多样性、因果推理证据,以及与专家建议的相似度。这种双重评估很重要,因为漂亮答案和原创答案并不总是同一件事,尤其是在 AI 工具让表面质量更容易达到的课堂中。
ChatGPT 的效果在评分量表上很明显。拥有 ChatGPT 使用权的学生在五分制中平均高出接近一分。他们的作业包含更多想法,逻辑更清晰,也更接近专家建议。OpenAI 强调,学生并不是简单把作业交给模型完成,他们仍然需要决定如何提问,判断回答质量,并选择哪些内容进入最终提交。这更像是一座专业能力桥梁,帮助新手产出更接近专业分析的作品。
批判性思维训练产生了不同结果。完成训练的学生更善于解释为什么某些想法可能有效,以及什么时候可能失败,但传统评分量表没有给他们更高分。文本分析显示,这些学生提出的想法范围更广,也更不同于同伴。这暴露出教育测量问题:如果评分更奖励清晰、常规和结构化答案,而不是思想多样性,学校可能错过自己声称重视的能力。
同时获得 ChatGPT 使用权和因果推理训练的学生展现出最广泛的提升。他们的想法多样性接近只接受思维训练的组,评分和想法数量则接近只使用 ChatGPT 的组。他们的作业还表现出更强逻辑一致性和更多质疑假设的证据。因此,这项研究反驳了一种简单二分:学校并不一定要在使用 AI 和独立思考之间二选一。
实际启示是,教育中的 AI 应被视为设计问题,而不只是权限问题。如果学生可以借助 AI 生成更精致的最终答案,单看成品就更难判断他们真正理解了什么。作业可能需要更重视原创性、推理过程、方案比较和为选择辩护的能力。ChatGPT 可以帮助缩小专业能力差距,但批判性思维训练仍然重要,因为它改变学生在模型回应前后如何界定问题。