← 返回日报
🌐 机器翻译 · DeepSeek · HN

AI advice made people less accurate but more confident – sudy


AI 建议让人准确率下降但自信提升——研究

原文内容:

图片来源:Canva TL;DR 研究人员发现,AI 建议将人们“暂缓判断”的比例从 44% 降至 3%,准确率从 27% 降至 9%,而自信度则从 30% 升至 76%。人们相信了错误的 AI 答案。

来自三所法国和意大利大学的研究人员发现,获得 AI 建议后,人们说“我不知道”的意愿从 44% 骤降至 3%。准确率从 27% 降至 9%。与此同时,自信度从 30% 升至 76%。

“人们的表现变得更差,准确率只有原来的三分之一,但自信度却翻了一倍,”米兰比可卡大学副教授 Valerio Capraro 表示。

这项研究由 Capraro 与巴黎高等师范学院的 Chiara Marcoccia 以及罗马大学的 Walter Quattrociocchi 共同撰写,他们特意选用了 AI 模型通常无法回答的问题:例如电影中的视觉细节,比如《我爱贝克汉姆》中球队队服的颜色。

研究人员使用了 Step 3.5 Flash 模型,该模型在这些问题上通常给出错误答案,这样做的目的是确保任何判断力的下降都不能被解释为对可靠工具的合理委托。一些原本能自己答对的参与者在咨询 AI 后反而答错了。

金钱激励有一定帮助,但效果有限。愿意承认无知的比率从 3% 升至 8%,准确率从 9% 升至 16%,两者仍远低于无 AI 时的基线水平(44% 和 27%)。

沃顿商学院的研究人员今年早些时候提出了“认知投降”这一术语,用来描述同样的现象:人们在 80% 的情况下接受错误的 AI 答案,同时报告的自信度高于没有使用 AI 的人。这项新研究提供了一个更尖锐的数据点。

问题不仅在于人们相信了错误的 AI 答案,更在于 AI 的可用性本身就抑制了人们识别自身知识盲区的认知习惯。

“对人类来说,说‘我不知道’的能力非常重要,因为它代表着对自身知识局限的认知,”Capraro 说。他尤其担心儿童,因为他们在尚未培养出批判性思维能力之前,就已经在接触这些系统。

谷歌的 AI 搜索改版用自信的 AI 生成摘要取代了链接,而 Common Sense Media 本周称这种设计对学生来说是“不可接受的风险”。模式是一致的:AI 产品被设计成回答问题,从不回答“我不知道”。而使用它们的人类也在学着这样做。

凭借在数字营销、产品管理以及品牌与身份领域的专业知识,Ana Maria Constantin 制定能够引起共鸣的策略(显示全部) 凭借在数字营销、产品管理以及品牌与身份领域的专业知识,Ana Maria Constantin 制定能够引起软件/SaaS 行业目标受众共鸣的策略。协作与团队合作对她至关重要,她乐于赋能同事,帮助他们取得卓越成果并释放全部潜力。

获取 TNW 新闻简报 每周在您的收件箱中获取最重要的科技新闻。 发布于 2026 年 7 月 19 日 - 下午 3:35 UTC 返回顶部

热门文章 1 Rob Gurzeev 谈为何 AI 已改变网络安全的最大盲点 2 Common Sense Media 称谷歌的 AI 搜索对学生构成“不可接受的风险”。谷歌无法将其关闭。 3 公司大脑与市场进入策略的未来 4 Moonshot 计划在六个月内以 300 亿美元估值在香港上市 5 中国正围绕 AI 智能体重建智能手机。中兴的 NaviX 数小时内售罄。

📖 阅读原文 →