联结学习过程中上丘的奖励预期信号

root 提交于 周日, 09/13/2026 - 20:47
预测未来奖励使中性的感觉线索获得动机意义,并引导以最大化奖励获取为目标的定向行动。当结果与预期不一致时,奖励预测会被更新,从而产生预测误差。中脑多巴胺神经元提供了奖励预测误差信号的经典神经相关指标,该信号可广播至多个脑区。这些习得的奖励预测最终会影响神经过程,使动物能够选择、准备并执行指向预期奖励的行动。在感觉和运动回路中均观察到了奖励预期信号;这些信号能够调节感觉加工、动作选择及行动活力。这引出了一个问题:整合性感觉运动回路如何在表征驱动寻求奖励行动的感觉和运动变量的同时,表征有关奖励预期的信息。上丘(superior colliculus,SC)是中脑的一个感觉运动区域,传统上与定向和动作选择相关,并受到奖励情境的强烈影响。预期奖励能够调节视觉活动和运动前活动,习得的物体价值能够塑造感觉反应,而近期获得的奖励则会改变小鼠上丘中的视觉加工。上丘还向中脑多巴胺神经元提供输入,并能够传递或获得影响多巴胺能活动的条件性感觉反应。然而,上丘投射也能够在不支持强化的情况下驱动定向运动,这提示线索相关活动可能反映的是显著性或运动准备,而非奖励预测本身。在本研究中,我们采用一种联结学习任务,其中听觉线索预示不同的奖励概率,并在学习过程中对上丘中间层群体活动进行纵向监测,以探究上丘是否会获得与奖励概率相关的信号、这些信号是否能够与预期性舔舐行为相区分,以及结果反应是否呈现奖励预测误差的典型特征。我们发现,在学习过程中,线索诱发的上丘活动逐渐区分出不同的奖励概率,并且与线索相关的奖励概率能够在预期性舔舐行为之外进一步解释神经活动。因此,上丘中间层携带一种习得性的奖励预期信号,该信号与运动准备复用,但不能还原为运动准备。相比之下,结果反应在群体水平上并未呈现一致的奖励预测误差信号特征。综上,这些发现表明,上丘是联结学习过程中将预期奖励与预期行动相整合的一个脑区。

mtripodi{at}mrclmb.ac.uk

摘要

信息/历史

指标

预览 PDF

摘要

对未来奖励的预测能够使中性的感觉线索获得动机意义,并引导个体执行以最大化奖励获取为目标的定向行动。当结果与预期不一致并由此产生预测误差时,这些奖励预测会得到更新。中脑多巴胺神经元提供了奖励预测误差信号的经典神经相关物,并将该信号广播至多个脑区。这些习得的奖励预测最终会影响使动物能够选择、准备并执行指向预期奖励的行动的神经过程。在感觉和运动回路中均观察到了奖励期待信号;这些信号能够调节感觉加工、行动选择及行动活力。这引出了一个问题:在驱动寻求奖励行动的感觉变量和运动变量之外,整合性感觉运动回路如何表征奖励期待信息。

上丘(superior colliculus,SC)是中脑中的一个感觉运动区域,传统上被认为与定向和行动选择相关,同时也受到奖励情境的强烈影响。预期奖励能够调节视觉和运动前活动,习得的物体价值能够塑造感觉反应,而近期获得的奖励会改变小鼠上丘中的视觉加工。上丘还向中脑多巴胺神经元提供输入,并能够传递或获得影响多巴胺能活动的条件性感觉反应。然而,上丘投射也能够驱动定向运动,却不支持强化,这提示与线索相关的活动可能反映的是显著性或运动准备,而非奖励预测本身。在本研究中,我们采用一种联结学习任务,在该任务中,听觉线索预示不同的奖励概率;同时,在学习过程中对上丘中间层的群体活动进行纵向监测。我们考察了以下问题:上丘是否会获得与奖励概率相关的信号;这些信号是否能够与预期性舔舐行为相区分;以及结果反应是否表现出奖励预测误差的典型特征。我们发现,在学习过程中,线索诱发的上丘活动逐渐区分出不同的奖励概率,并且与线索相关的奖励概率能够在预期性舔舐行为之外进一步解释神经活动。因此,上丘中间层携带一种习得性的奖励期待信号,该信号与运动准备复用,但不能还原为运动准备。相比之下,结果反应未表现出一致的群体水平奖励预测误差信号特征。综上,这些发现表明,上丘是联结学习过程中将预测奖励与预期性行动相整合的脑区。

利益冲突声明

基金资助信息声明

欧洲研究委员会, https://ror.org/0472cxd90 ,STG 677029 ,EP/X034666/1(UKRI ERC Consolidator Replacement Grant)

欧洲研究委员会, https://ror.org/0472cxd90 ,ERANET-NEURON MC_PC_16036

医学研究委员会, https://ror.org/03x94j517 ,MC_UP_1201/2

版权

本预印本的。

本预印本依据 CC-BY-NC-ND 4.0 国际许可协议提供。

返回顶部

上一篇

下一篇

发布于 2026 年 9 月 13 日。

下载 PDF

电子邮件

感谢您有兴趣传播 bioRxiv 上的内容。

您的电子邮件地址 *

您的姓名 *

发送至 *

请输入多个地址,每行一个,或使用逗号分隔。

您即将通过电子邮件发送以下内容:

《联结学习过程中上丘的奖励期待信号》

邮件主题

(您的姓名)已从 bioRxiv 网站转发一个页面给您

邮件正文

(您的姓名)认为您可能会对 bioRxiv 网站上的这一页面感兴趣。

您的个人留言

验证码

此问题用于确认您是人类访客,并防止自动垃圾邮件提交。

分享

《联结学习过程中上丘的奖励期待信号》

Sevinc Mutlu, Anindita Das, Marco Tripodi

bioRxiv 2026.09.11.750870; doi: https://doi.org/10.64898/2026.09.11.750870

分享本文:

复制

引用工具

《联结学习过程中上丘的奖励期待信号》

Sevinc Mutlu, Anindita Das, Marco Tripodi

bioRxiv 2026.09.11.750870; doi: https://doi.org/10.64898/2026.09.11.750870


📄 原文链接:https://www.biorxiv.org/content/10.64898/2026.09.11.750870v1?rss=1

🏷️ 联结学习 奖励预期 上丘 奖励预测误差 神经群体活动