2026 年,AI 依然会出现“幻觉”,并且经常给出错误答案。
然而,法国和意大利多所大学的研究人员发现,获得 AI 建议后,人类的批判性思维能力可能会受到削弱,使人们更容易自信地复述 AI 提供的错误信息。
“对于人类来说,能够说‘我不知道’这一能力非常重要,因为这代表我们意识到了自身知识的局限。”米兰比可卡大学副教授 Valerio Capraro 在接受时表示,“但如今借助 AI,我们几乎可以轻松获得任何问题的答案。因此,我们想知道,这是否会影响人类承认‘我不知道’、暂缓判断的能力。”
论文标题直接揭示了研究结论:
据了解,在实验中,他们要求参与者回答一些关于电影
研究人员预计,这类细节通常不会出现在大多数 AI 模型的训练数据中,而实验所使用的模型也确实经常无法回答这些问题。
他们还测试了目前较新的前沿模型,包括 GPT-5.5、Claude Sonnet 4.6 和 Gemini 3.5 Flash。这些模型虽然在车辆问题上表现不佳,但经常能够正确回答其他细节问题。
研究人员选择 Step 3.5 Flash 的原因是,该模型在实验中通常会给出错误答案,这可以避免有人认为参与者只是合理地把判断权交给了一个可靠工具。
“我们将参与者分成两组。”Capraro 解释道,“一组需要在没有 AI 建议的情况下回答问题,另一组则可以向 AI 请求帮助。结果发现,在没有 AI 的情况下,有 44% 的人选择回答‘我不知道’,也就是暂缓判断。而在可以获得 AI 建议后,只有 3% 的人这么做。也就是说,人们暂停判断的能力几乎崩溃了。”
Capraro 表示,更令人意外的是,当 AI 提供帮助时,参与者的回答准确率也明显下降。换句话说,人们开始更加相信 AI 的答案,而不是自己的判断。
“在没有 AI 的情况下,有 27% 的人给出了正确答案。”他说,“但在获得 AI 建议后,只有 9% 的人回答正确。因此,一些原本可能答对的人,在询问 AI 后反而得到了错误答案。”
与此同时,AI 建议还显著提高了人们对自身答案的信心。Capraro 表示,在没有 AI 帮助时,参与者认为自己正确的比例约为 30%;而在使用 AI 后,这一比例上升到了 76%。
“简单来说,人们的表现变得更差 —— 准确率只有原来的三分之一,但他们的自信程度却提高了一倍。”Capraro 说道。
结果显示,金钱激励确实带来了一定改善。选择暂缓判断、承认“不知道”的比例从 3% 提升到了 8%;回答正确的比例也从 9% 提升到了 16%。
Capraro 表示,他认为这一问题需要通过社会层面的 AI 素养教育和教育政策来解决。“当然,模型提供商也应该努力改善这一问题,但我认为双方的利益并不完全一致。”他说,“更有希望的解决方式,可能是在教育层面进行干预。”
“成年人已经通过过去的学习经历培养了一定的批判性思维能力。”他说,“但对于那些从出生起就伴随着这些系统成长的孩子来说,风险在于,他们甚至可能无法真正学会最基本的批判性思考能力。”










