
一句话看懂:一项来自法国和意大利三所大学的研究显示,当人们依赖AI建议时,回答准确性从27%降至9%,但自信水平却从30%升至76%。AI并未提升判断力,反而抑制了人们“承认不知道”的本能。
事件核心:发生了什么
这项研究由米兰比可卡大学、巴黎高等师范学院和罗马大学的学者共同完成。实验故意选用了AI模型(具体为Step 3.5 Flash)常会出错的题目——例如电影《像贝克汉姆一样踢球》中球队队服的颜色——来测试人类在AI辅助下的判断变化。结果发现,获得AI建议后,参与者选择“我不知道”的比例从44%骤降至3%,准确率从27%跌至9%,而自我报告的信心却从30%飙升到76%。即使引入金钱激励,准确率也仅回升至16%,仍远低于没有AI时的27%。沃顿商学院此前用“认知投降”(cognitive surrender)一词描述类似现象,指用户在接受错误AI答案的同时反而更加自信。
为什么重要
这一发现直接冲击了AI辅助决策的“赋能”叙事。研究并非测试AI本身的准确性,而是观察AI对用户认知习惯的侵蚀:一旦AI可随时调用,人们主动判断和承认知识边界的意愿会显著下降。这不同于“合理委托”(将任务交给可靠工具),而是表现为过度信任与盲目跟随。考虑到Google AI搜索已将AI摘要直接嵌入结果页,Common Sense Media本周将其标记为“对学生不可接受的风险”。当AI产品被设计为永远回答、从不承认未知时,用户也在学习同样的行为模式。
对用户/开发者/创作者的影响
对普通用户而言,研究提示:依赖AI获取信息时,需刻意保留“质疑”环节,尤其涉及事实核查、专业判别或高风险决策时。对AI应用开发者来说,产品设计不应只追求回答率,应主动加入不确定性提示或置信度标记,避免助长用户的“认知投降”。对内容创作者和教育工作者而言,在年轻一代尚未完全发展出批判性思维前,无门槛的AI工具可能削弱其判断力,研究中特别提到儿童群体值得高度关注。当前的AI系统默认“给出答案”,但真正实用的设计可能应该是“帮人做出更好的思考”。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
值得关注的后续
第一,这项研究是否会推动AI产品增加“不确定答案时主动声明”的功能设计;第二,学校和教育平台是否会因此调整AI工具的使用指南,例如限制低龄用户的直接对话式搜索;第三,目前公开信息显示,研究者使用的模型版本较旧,需关注更新的模型(如GPT-4o、Claude 3.5等)是否在类似测试中表现出不同的影响模式。
来源:The Next Web


