- 3 次围观
学习通常被理解为一种由预测误差驱动的过程,即当结果与预期不一致时所发生的过程。然而,结果与预期完全一致时,这类结果在心理和计算层面上是否具有意义,仍不清楚。在本研究中,我们检验了零预测误差是否会塑造人类强化学习中的情感、信念更新以及神经反馈加工。参与者在不确定性水平不同的环境中反复预测奖励,其中一部分试次的结果被操纵为与其预测完全一致。零预测误差产生了最高的瞬时幸福感,且计算模型表明,行为最能由这样一种模型来解释:零预测误差会诱发一种独特的潜在信念状态,并由此引导后续更新,尤其是在较高不确定性条件下,以及在不确定性不耐受程度更高的个体中。进一步地,基于结果锁定的脑电图分析显示,零预测误差引发了独特的类P3反应,其中残余神经活动可预测零预测误差之后减弱的更新,但可预测标准预测误差之后增强的更新。这些发现表明,完美预测并非中性的,而是具有信息意义的事件,会主动塑造情感、行为和神经反馈加工。
在持有人为作者/资助方,其已授予 bioRxiv 永久展示该预印本的许可。 本文根据 CC-BY 4.0 国际许可协议 公开提供。
返回顶部 上一篇 下一篇
发布于 2026 年 7 月 14 日。 下载 PDF 补充材料 数据/代码 电子邮件
感谢您有兴趣传播 bioRxiv 的内容。 您的电子邮箱 * 您的姓名 * 发送至 * 请输入多个地址,每行一个,或用逗号分隔。
您将要通过电子邮件发送以下内容 《强化学习中零预测误差的独特价值》
邮件主题 (您的姓名)已从 bioRxiv 转发了一个页面给您
邮件正文 (您的姓名)认为您可能希望查看 bioRxiv 网站上的这个页面。
您的个人留言
验证码 此问题用于测试您是否为人类访问者,并防止自动化垃圾信息提交。
分享
强化学习中零预测误差的独特价值
Beth Lloyd, Atsushi Kikumoto, Franz Wurm, Marc-Lluis Vives
bioRxiv 2026.07.13.738284; doi: https://doi.org/10.64898/2026.07.13.738284
分享本文: 复制
引文工具
强化学习中零预测误差的独特价值
Beth Lloyd, Atsushi Kikumoto, Franz Wurm, Marc-Lluis Vives
bioRxiv 2026.07.13.738284; doi: https://doi.org/10.64898/2026.07.13.738284
📄 原文链接:https://www.biorxiv.org/content/10.64898/2026.07.13.738284v1?rss=1
🏷️ 强化学习 预测误差 零预测误差 信念更新 脑电图 P3成分
来源出处