研究显示,AI使作业成绩提升18%,但考试成绩却下降20%

一项覆盖中国 2.7 万名中学生的研究显示,使用 AI 工具的学生作业成绩平均提升 18%,但在无 AI 辅助的考试中,成绩反而比不使用 AI 的同学低 20%。这说明 AI 可能在“帮助完成作业”的同时,削弱了知识的真正内化。

一句话看懂:一项覆盖中国 2.7 万名中学生的研究显示,使用 AI 工具的学生作业成绩平均提升 18%,但在无 AI 辅助的考试中,成绩反而比不使用 AI 的同学低 20%。这说明 AI 可能在“帮助完成作业”的同时,削弱了知识的真正内化。

事件核心:发生了什么

据《经济学人》8 月 18 日报道,斯德哥尔摩大学 David Stromberg 与香港大学 Victor Lei、Wu Yanhui 合作,追踪了中国 2.7 万名 12 至 18 岁中学生长达六个月。研究显示,约 80% 的学生已在日常学习中使用豆包(Doubao)和 DeepSeek 等 AI 大模型产品,其余 20% 未使用者作为对照组。

结果呈现出明显分化:使用 AI 的学生各科作业平均分提升了 18%,但在不允许使用 AI 的闭卷考试场景下,这批学生的成绩反而比对照组低 20%。该研究尚未经过其他机构的独立验证,但《经济学人》指出,此前关于 AI 对学生学习结果的实际影响一直缺乏大规模实证数据。

为什么重要

这项研究首次以大规模样本揭示了“AI 使用与学习效果之间的结构性矛盾”。过去一年,Chegg 调查显示富裕国家 80% 本科生使用 AI 学习,英国和德国的最新学生使用率分别达到 94% 和 93%。但教师普遍反映,AI 生成的作业“模板化、雷同”,虽然分数可能好看,却无法反映真实掌握程度。

这一结论对教育科技行业和 AI 应用方向具有警示意义:如果 AI 工具仅优化“完成任务”的效率,而非辅助“理解过程”,那么其在教育场景的长期价值将面临质疑。此前宾夕法尼亚大学 2024 年的一项小型研究也得出类似结论——短期内 AI 辅助练习效果更好,但在随后的闭卷测试中优势完全消失。这指向一个更普遍的担忧:AI 可能让学生用“产出能力”替代了“学习能力”。

对用户/开发者/创作者的影响

对学生与家长:当前大模型产品的“作业辅导”功能可能带来成绩假象,闭卷考试仍是检验真实水平的标尺。建议将 AI 定位为“提问与反馈工具”,而非代写答案的捷径。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

对教育类 AI 应用开发者:单纯堆砌解题、生成答案的功能正在触及天花板。未来产品需要设计“可评估的思考过程”——例如要求模型提供分步推理、错因诊断,并通过间隔性复习机制确保知识长期留存,而非一次性生成结果。

对学校与企业采购方:在部署 AI 教学工具时,不应以作业平均分作为核心评估指标,而应建立包含闭卷测试、迁移能力测试在内的多维度效果评估体系。目前公开信息显示,布鲁金斯学会此前也建议,AI 应支持而非替代思考、社交互动和创造力培养。

值得关注的后续

1. 完整论文的同行评审结论:该研究尚未获得独立验证,后续若正式发表,其实验设计与样本代表性值得细读。

2. 教育类 AI 产品是否会转变功能方向:豆包、DeepSeek 以及海外 ChatGPT 教育版是否会针对“防依赖”推出新的交互模式(如限制连续生成、强制展示推理步骤),将直接影响产品定位。

3. 监管层面的连锁反应:如果更多国家跟进此类研究,可能会推动学校对 AI 工具的使用场景进行更严格区分,例如禁止在作业环节使用生成式 AI,而仅在复习与自测环节开放。

来源:Hacker News

celebrityanime
celebrityanime
文章: 19630

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注