🧠 PsyBrain 脑心前沿关注公众号
字号
主题
PsyBrain 脑心前沿 / 情绪·社会·人格:顶刊文献解读专题 / A · 文献解读 / A065 · 最新重磅Science正刊“合作脑”被锁定!科学家发现小

A065 最新重磅Science正刊 | “合作脑”被锁定!科学家发现小鼠与AI竟遵循相同的合作法则

来源:公众号 PSY-Brain_Frontier | 发布:2025-09-30 | 原文链接

图1

点击蓝字 关注我们 知晓前沿

认知神经科学前沿文献分享

图2

基本信息

Title:Neural basis of cooperative behavior in biological and artificial intelligence systems

发表时间:2025.9.25

Journal:Science

影响因子:45.8

获取原文:

  1. 后台回复“文献”即可获取PDF版本
  2. 点击页面底部“阅读原文”即可跳转论文原网页

图3

图4

引言:从鼠脑到AI,合作的秘密竟是共通的?

合作,是谱写生命社会性乐章的核心旋律。从协同狩猎的狼群,到手术台上配合默契的外科团队,再到即兴演奏的爵士乐队,两个或多个独立的个体如何实时同步行动、达成共同目标,是自然界最迷人、也最深刻的谜题之一。这一过程不仅是人类社会繁荣的基石,更是高级智能的终极体现。

然而,这种“心有灵犀”的默契背后,究竟隐藏着怎样的神经算法和行为密码?

近日,一篇发表在顶刊 Science 上的重磅研究,由加州大学洛杉矶分校(UCLA)的Mengping Jiang、Linfan Gu及Weizhe Hong等人领衔,以前所未有的视角,同时深入生物大脑与人工智能这两个看似迥异的世界,试图寻找合作智能的“通用蓝图”。他们不仅揭示了小鼠在合作中精妙的行为策略,还精确定位了大脑中负责运筹帷幄的“社交指挥官”——前扣带皮层(Anterior Cingulate Cortex, ACC)。更令人惊叹的是,人工智能体在面对同样的挑战时,竟独立“进化”出了与小鼠大脑高度相似的解决方案,仿佛在不同生命形式间奏响了一曲合作的“跨界交响乐”。

图5

省流总结

对于时间宝贵的读者,以下是本研究的核心精髓:

  1. 大脑的“合作中枢”:研究首次证实,小鼠大脑的前扣带皮层(ACC)是合作行为的“指挥中心”。该区域的神经活动不仅与合作成功与否密切相关,更是因果性地驱动着合作行为的产生。
  2. 合作的“行为舞步”:成功的合作并非偶然。小鼠学会了一套精妙的“社交舞步”来达成时间上的同步,包括主动“靠近”(Approach)伙伴以获取信息、在关键时刻“等待”(Waiting)伙伴,以及在行动前进行“互动”(Interaction)。
  3. 真·合作三要素:研究通过一系列严谨的控制实验证明,真正的合作必须建立在三大支柱之上:可获取的伙伴信息、共同利益的驱动,以及双方主动协调的意愿。三者缺一,合作的大厦便会轰然倒塌。
  4. 智能的“殊途同归”:最令人瞩目的发现是,在相似任务中从零开始训练的人工智能体,竟独立演化出了与小鼠极其相似的“等待”策略和内部神经表征。这强烈暗示,高效合作的背后可能存在一套跨越生物与机器界限的普适性计算原则 。

图6

图7

研究背景与动机

合作行为,尤其是互惠型合作(Mutualism-based cooperation),对个体的认知能力提出了极高的要求。它要求参与者不能只顾自己,而是必须持续地、实时地监测伙伴的状态,预测其下一步行动,并灵活调整自身策略以保持步调一致。这种复杂的社会协调能力,其背后的神经机制在很大程度上仍是未解之谜。

以往的研究将目光投向了大脑的前扣带皮层(ACC)。这个脑区被认为是社会认知的高级中枢,参与追踪他人行为、处理自身与他人的奖赏、引导社交决策等多种功能,使其成为解码合作行为的“头号嫌疑人”。然而,ACC中的神经元究竟是如何编码并驱动这一复杂过程的,我们仍知之甚少。

与此同时,人工智能,特别是强化学习的飞速发展,为我们提供了一个前所未有的研究工具。研究者不再满足于仅仅观察生物系统,而是希望构建一个“数字孪生”——一个计算沙盒。在这个沙盒里,他们可以像上帝一样,精准地“敲除”或“修改”AI网络中的任何一个计算单元,并观察其对合作行为的直接影响。这种在生物系统中难以实现的精确操控,为我们检验关于神经机制的假说提供了强大火力,也让我们得以探寻一个更深层次的问题:合作的法则,是生物演化的偶然,还是智能系统解决特定问题的必然?

图8

核心问题

为了系统性地拆解合作这一复杂行为,该研究设计了一套环环相扣的研究问题,构建了一个从行为到神经表征,再到因果验证,最终跨越到人工智能的完整逻辑链:

  1. 行为学问题:小鼠能否展现出真正依赖于实时、主动协调的互惠型合作?还是说,它们的成功仅仅是基于更简单的策略,如独立的节律、单纯的模仿或对简单线索的跟随?
  2. 神经表征问题:大脑(特别是ACC)是如何在神经层面“描绘”合作过程的?它能否区分成功与失败?它是否编码了那些促成合作的关键行为策略?以及,最关键的“伙伴”信息是如何被表征的?
  3. 因果关系问题:ACC的神经活动仅仅是合作行为的“被动记录者”,还是驱动合作成功的“主动指挥官”?其活动是否在因果上对协调行为至关重要?
  4. 普适性问题:在小鼠大脑中观察到的行为策略和神经表征原则,是哺乳动物演化的特有产物,还是在面对同样合作挑战时,一个从零开始的人工智能系统也会独立地发现并采用相似的计算解决方案?

图9

实验设计

为了回答上述问题,研究团队设计了一套精巧的双系统研究范式。

💡生物系统:训练小鼠成为“合作专家”

研究的核心是一个特别设计的操作性合作任务。两只小鼠被放置在一个由透明穿孔隔板隔开的装置中,它们必须在规定时间窗内同时用鼻子戳向各自一侧的端口,才能共同获得水奖励。这个时间窗口从宽松的3秒逐步缩短至严苛的0.75秒,从而不断增加对它们精准协调能力的要求。

图10

本研究方法论的基石,在于其一系列设计巧妙的控制实验(见下表),它们如同一把把精准的手术刀,层层剖析合作行为的本质。

图11

这些控制实验的价值在于,它们系统性地预见并用实验证伪了所有主要的替代理论。例如,有人可能质疑小鼠只是各自学会了按固定节律行动,但与随机打乱的数据对比后发现,真实表现远超巧合;又或者质疑一只小鼠只是在模仿另一只,但单边合作实验证明,没有共同目标,“跟随者”并不会形成合作。

图12

💡神经科学工具箱:读写大脑活动

图13

💡人工智能系统:构建“数字合作者”

图14

图15

核心发现

通过这套双管齐下的研究框架,一系列深刻的发现浮出水面,共同描绘出了一幅关于合作机制的全景图。

1. 小鼠展现出主动且目标导向的协调行为

实验数据显示,经过训练的“高水平”合作鼠对不仅成功率远超随机水平,其协调的精准度也随着训练而提升,表现为成功合作时双方戳鼻子的时间间隔显著缩短。更重要的是,前述的一系列控制实验无可辩驳地证明,这种行为是真正的合作,它高度依赖于获取伙伴信息的能力和共同奖励的激励结构。

图16

2. ACC是大脑的“合作记分牌”与“策略编码器”

钙成像结果显示,ACC的神经元群体能够为成功的合作(“Correct” trials)和失败的尝试(“Miss” trials)形成截然不同的神经活动模式。这种神经层面的区分能力(解码器性能)与小鼠在行为上的合作熟练度呈显著正相关,即大脑对“成功”的表征越清晰,动物的合作表现就越好。

图17

不仅如此,ACC还编码了导致成功的具体行为策略——“靠近”、“等待”和“互动”。当小鼠执行这些特定的社交动作时,ACC内不同的神经元亚群会被激活。

图18

3. 合作决策的神经基础:伙伴信息是核心

研究进一步发现,ACC编码了更高级的合作决策,即是该“继续等待”(Hold)还是“共同出击”(Proceed)。这些决策相关的神经活动发生在实际行动之前,表明ACC参与的是决策过程,而不仅仅是动作执行。

这里,研究揭示了一个极为深刻的机制:ACC似乎在构建一个关于“他者”的动态模型。虽然ACC同时表征了自身和伙伴的位置,但只有对伙伴位置的神经表征强度,才与合作的成功率正相关。这一伙伴表征在做出合作决策的关键时刻(戳鼻前)被显著增强,而在获得奖励后则减弱。最终,一个更强的伙伴神经表征,与小鼠更倾向于使用“等待”这一高级合作策略直接相关。这一系列证据链共同指向一个结论:在合作中,ACC的核心功能或许不是简单地控制“我”该做什么,而是建立一个关于“你”在哪、在做什么的内部模型,并以此来指导“我”的行动。

图19

4. 因果性验证:沉默ACC,合作乐章戛然而止

化学遗传学实验显示,当大范围抑制ACC的活动后,小鼠的成功合作次数显著下降,并且它们执行“靠近”、“等待”和“互动”等关键策略的能力也受损。

而光遗传学实验则提供了时间上更精确的证据:仅在合作戳鼻前的1秒钟内抑制ACC,就会严重破坏合作成功率;而在戳鼻后进行抑制则毫无影响。这精准地锁定了ACC在合作决策瞬间的不可或缺的作用。

图20

5. 人工智能的趋同演化:AI独立发现了相同的合作法则

最令人振奋的发现来自于人工智能的平行实验。从随机策略开始学习的AI智能体,自发地演化出了“等待”行为来与伙伴同步,这与在小鼠中观察到的核心策略如出一辙。深入分析AI的循环神经网络内部,研究者发现,与小鼠的ACC相似,AI的内部表征也随着合作训练的进行,越来越侧重于编码伙伴的信息。

图21

实验的顶点是,当研究者精准地“敲除”AI网络中那些负责编码“等待”和“出击”决策的单元时,AI的合作行为出现了可预测的、特定的缺陷,这为在生物大脑中观察到的功能模块化提供了干净利落的计算原理性证明。

图22

图23

编辑部观点

这项发表于 Science 的研究,其意义远不止于揭示了小鼠合作的秘密。它为我们理解复杂的社会行为提供了一个强有力的概念框架,展示了如何将一个宏观的社会现象分解为可测量的行为策略、认知决策及其底层的神经表征。

图24

Abstract

Cooperation, the process through which individuals work together to achieve common goals, is fundamental to human and animal societies and increasingly critical in artificial intelligence. Here, we investigated cooperation in mice and artificial intelligence systems, examining how they learn to actively coordinate their actions to obtain shared rewards. We identified key social behavioral strategies and decision-making processes in mice that facilitate successful cooperation. These processes are represented in the anterior cingulate cortex (ACC) and ACC activity causally contributes to cooperative behavior. We extended our findings to artificial intelligence systems by training artificial agents in a similar cooperation task. The agents developed behavioral strategies and neural representations reminiscent of those observed in the biological brain, revealing parallels between cooperative behavior in biological and artificial systems.

图25

Author information

共同第一作者#1: Mengping Jiang

Department of Neurobiology, David Geffen School of Medicine, University of California, Los Angeles, Los Angeles, CA, USA.

美国加州大学洛杉矶分校David Geffen医学院神经生物系。

Department of Biological Chemistry, David Geffen School of Medicine, University of California, Los Angeles, Los Angeles, CA, USA.

美国加州大学洛杉矶分校David Geffen医学院生物化学系

共同第一作者#2:Linfan Gu

Department of Neurobiology, David Geffen School of Medicine, University of California, Los Angeles, Los Angeles, CA, USA.

美国加州大学洛杉矶分校David Geffen医学院神经生物系。

Department of Biological Chemistry, David Geffen School of Medicine, University of California, Los Angeles, Los Angeles, CA, USA.

美国加州大学洛杉矶分校David Geffen医学院生物化学系

Department of Bioengineering, Henry Samueli School of Engineering, University of California, Los Angeles, Los Angeles, CA, USA.

美国加州大学洛杉矶分校Henry Samueli工程学院生物工程系

通讯作者1: Weizhe Hong

作者单位同上

通讯作者2: Jonathan C. Kao

作者单位同上

图26

推荐相关阅读

Nature | 最新重磅Nature正刊 决策过程的动力学机制与神经模式转变 ⭐️[ 解读链接 ]

*Nature Human Behaviour | 一场多感官的“双重博弈”:揭示大脑如何加速决策的秘密 ⭐️[ 解读链接 ]***

Nature Communications | 普林斯顿团队: 组合式认知地图模型解析灵活性与效率之争**⭐️[ 解读链接 ]****

Nature Human Behaviour | 你不是天生就爱跟风:社会特征学习理论揭示人类“随大流”背后的秘密*⭐️[ 解读链接 ]*

**Neuropsychopharmacology |* Nature子刊综述:大脑预测误差的核心回路 *⭐️[ 解读链接 ]**

**Nature neuroscience |* 明尼苏达大学揭示多巴胺如何塑造决策信心 *⭐️[ 解读链接 ]**

**Nature Communications |* 大脑如何“反悔”?解密决策、信心与“改变主意”背后的神经机制 *⭐️[ 解读链接 ]**

图27

本文解读基于:Neural basis of cooperative behavior in biological and artificial intelligence systems,Doi: 10.1126/science.adw8151。核心图表、方法细节、统计结果与讨论见原文及其拓展数据。点击左下角 “阅读原文” 可跳转到论文源网站界面。

分享人:饭哥

审核:PsyBrain 脑心前沿编辑部

图28

PsyBrain 脑心前沿

带你了解心理学、脑科学的前沿知识与技术流程

预览时标签不可点

阅读原文

不喜欢

微信扫一扫
关注该公众号

知道了

微信扫一扫
使用小程序

取消 允许

取消 允许

取消 允许

× 分析

跳转二维码

图29

微信扫一扫可打开此内容,
使用完整服务

返回板块首页