A020 PNAS | 满足好奇心会让人不再好奇吗?新研究揭示求知欲的强化学习机制
来源:公众号 PSY-Brain_Frontier | 发布:2026-05-12 | 原文链接

认知神经科学前沿文献分享
基本信息
Title: Learning reinforces curiosity for related information
发表时间: 2026-04-24
发表期刊: PNAS
影响因子: 9.1
获取原文:
-
添加小助手: PSY-Brain-Frontier 即可获取PDF版本
-
点击页面底部“阅读原文”跳转论文网页

研究背景
在日常生活中,我们无时无刻不在摄取信息,但这种摄取并非毫无选择。我们的好奇心引导着信息搜索的方向,而这种好奇心又会随着我们刚刚学到的新知识发生动态变化。一个长期存在的科学争议是:当我们获得了一个满意的答案后,好奇心究竟是会减弱,还是会增强?
传统的“最优唤醒理论”(optimal arousal theory)将好奇心视为一种类似于饥饿的内驱力。该理论认为,满足好奇心会降低后续的求知欲,因为人们倾向于维持一个稳定的唤醒水平;如果得到了极其满意的答案,好奇心就会“解渴”并随之下降。然而,基于“强化学习”(reinforcement learning)的框架则提出了截然相反的假设:获取有价值的信息本身就是一种奖励,令人满意的答案不仅不会扑灭好奇心,反而会强化它,引导我们继续在相关领域深挖。
为了在两种理论之间做出裁决,哥伦比亚大学与伦敦大学学院(UCL)的研究团队设计了一项涵盖5831名参与者的大规模行为学研究。这项发表在 PNAS 上的工作,突破了以往孤立研究单次好奇心事件的局限,试图揭示我们在连续学习过程中,上一秒的知识获取如何重塑下一秒的信息寻求决策。
研究核心总结
研究者采用了一种经典的“等待任务”(waiting task)。在每次试验中,参与者会看到一个冷知识问题,如果他们不知道答案,就需要决定是否愿意等待几秒钟来获取答案。这里的“等待意愿”被作为衡量信息寻求行为的核心指标。随后,参与者需要对得到的答案给出满意度评分。
一、令人惊喜的答案会强化后续的信息寻求行为
研究者首先将每次学习体验拆解为两个正交的变量:一个是“参与度”(engagement,即满意度与预期好奇心之和),另一个是“预测误差”(prediction error,即满意度减去预期好奇心)。结果表明,参与者的信息寻求决策高度依赖于前一次学习的反馈。
当参与者在上一个问题中获得了出乎意料的满意答案(产生正向的预测误差),或者整体参与度很高时,他们在面对下一个问题时,选择等待答案的概率会显著增加。相反,如果上一个答案令人失望,他们后续的求知欲就会受到抑制。这一发现直接反驳了“最优唤醒理论”中关于满足好奇心会降低求知欲的预测,转而支持了强化学习的观点:信息本身具有奖赏价值,能够强化后续的探索行为。

Fig 1. 研究采用的“等待任务”范式。参与者需要决定是否愿意付出时间成本(等待3到16秒不等)来获取不同领域问题的答案,并在阅读后评估满意度。一周后还会进行记忆回溯测试。

Fig 2. 预测误差与参与度如何总结单次学习体验。数据表明,预期好奇心不仅能稳健预测参与者的等待决策,还能预测他们对答案的最终满意度。
二、好奇心的“滚雪球”效应受语义相似度严格限制
如果满意的答案能强化好奇心,这种强化是泛化的,还是特定于某个领域的?研究者通过两个实验回答了这个问题。在实验1中,问题被分为动物、艺术、食物和地理四个离散类别;在实验2中,研究者引入了自然语言处理模型(Sentence-BERT),计算连续问题之间的语义相似度。
结果显示,强化学习效应具有高度的领域特异性。前一次学习产生的预测误差和参与度,只有在下一个问题与前一个问题“语义相似”或“同属一类”时,才会显著增加等待意愿。如果下一个问题跨度太大、毫不相关,前期的满意答案不仅无法提升好奇心,甚至在某些情况下(如实验2的低变异性区块中)还会导致对新领域信息的排斥。这意味着,我们的大脑在利用强化学习策略时,不仅在评估信息的价值,还在精细地计算“我究竟该对哪个具体领域保持好奇”。

Fig 3. 前序学习对后续等待决策的强化作用。无论是离散类别(A、B)还是连续的语义空间(C、D),预测误差和参与度对后续好奇心的提升作用,都强烈依赖于前后问题之间的语义相似度。
三、记忆巩固依赖于具体内容,而非前序的好奇心溢出
既然前一次的学习体验能强化下一次的好奇心,那么这种溢出的求知欲能否促进对新知识的记忆?研究者在一周后对参与者进行了记忆测试。
有趣的是,记忆表现与好奇心的动态溢出脱节了。虽然当前问题及其答案所引发的参与度能够稳健地预测一周后的记忆准确率,但前一个问题产生的预测误差或参与度,并不能跨越试验去提升下一个问题的记忆效果。这表明,记忆的巩固依然紧紧锚定在具体的信息内容和当下的编码状态上,而不会简单地被前序任务带来的“求知欲惯性”所惠及。

Fig 4. 一周后的记忆表现取决于当前问答的内容与参与度。实验1的数据表明,尽管预测误差对记忆的影响因问题类型而异,但高参与度始终与更好的答案记忆显著相关。
研究意义
这项研究从根本上挑战了将好奇心视为一种“容易被满足的内驱力”的传统观点,为理解人类复杂的信息寻求行为提供了全新的强化学习视角。
在理论层面上,它证明了好奇心并非盲目或随机的,而是一种可以通过经验不断更新和优化的信息寻求策略(information-seeking policy)。我们不仅为了做出更好的工具性决策而搜集信息,我们还在通过每一次的满意与失望,学习“到底什么东西值得我们好奇”。这解释了为什么在日常生活中,我们经常会在维基百科或短视频平台中陷入特定主题的“兔子洞”——因为每一个相关的、令人满意的答案,都在增加该领域信息的预期价值。
在应用启发上,这项工作为教育和科学传播提供了直接的指导。如果想要激发学生或公众对某个陌生领域的长期兴趣,仅仅抛出一个孤立的有趣事实是不够的。更有效的策略是提供一系列语义相关、且能持续带来正向“预测误差”的知识序列,利用强化学习的机制,让好奇心在相关领域内自然地“滚起雪球”。
分享人:饭鸽儿
审核:PsyBrain 脑心前沿编辑部
💡 关于我们
👋 你好,这里是「PsyBrain 脑心前沿」
🧠 专注追踪全球认知神经科学的最尖端突破
🔍 视野直击 Nature, Science, Cell 正刊 及核心子刊与顶级大刊
📄 每日速递「深度解读」与「前沿快讯」
科研是一场探索未知的长跑,但你无需独行。欢迎加入 PsyBrain 学术社群,和一群懂你的同行,共同丈量脑与心智的无垠前沿。
👇点击卡片进群,欢迎你的到来👇
一键关注,点亮星标 ⭐ 前沿不走丢!


一键分享,让更多人了解前沿
预览时标签不可点
作者提示: 内容由AI生成
阅读原文
不喜欢
微信扫一扫
关注该公众号
知道了
微信扫一扫
使用小程序
取消 允许
取消 允许
取消 允许
× 分析

微信扫一扫可打开此内容,
使用完整服务

