第 17 章

神经可塑性的承诺

扫描仪的磁环嗡嗡作响,像远处有一台巨大的冰箱在持续运转。四十七岁的对冲基金交易员马丁闭着眼睛,按照耳机里的指令把注意力集中在呼吸上——吸气时腹部隆起的感觉,呼气时胸腔微微下沉的重量。他的思绪漂走了三次。第一次飘到今天早晨收到的那封邮件,关于一笔正在亏损的头寸;第二次飘到耳机里那个女声的英音口音;第三次他意识到自己在想“我是不是又在走神了”,然后按照指令温和地把注意力拉回呼吸。这是第八周的第三次扫描。八周前他第一次躺进这台机器时,同样的三十分钟漫长得像三个小时。现在他至少能在注意力漂移后更快地把自己拽回来——不是每次都能拽住,但频率在提高。

实验结束后,研究人员给他看了两张并排的脑成像图。一张是八周前的静息态功能连接扫描,另一张是今天的。两张图上都有彩色的光斑标记着前额叶皮层与杏仁核之间的功能连接强度。第二张图上的光斑更密集、颜色更暖。“这意味着这两个区域之间的神经通路在物理层面发生了改变,”研究人员说。措辞很谨慎。他们没有说马丁变得更理性了,没有说他的投资决策会改善。他们只陈述可以观察到的现象:经过八周每天三十分钟的正念呼吸练习,大脑中负责执行控制的区域与负责情绪反应的区域之间的连接增强了。

这是2011年发表在《精神病学研究:神经影像》上的一项研究的一部分。萨拉·拉扎尔团队在哈佛医学院招募了十六名从未接触过冥想的健康成年人,让他们接受八周的正念减压训练,同时扫描他们的大脑。对照组是十七名等待名单上的志愿者。结果清晰得令人兴奋:实验组左侧海马体灰质密度增加,后扣带回皮层增厚,前额叶与杏仁核之间的功能连接增强——所有这些变化都指向一个方向:成年人的大脑可以被训练改变。

这个发现引发了一个诱人的推论。如果“标价时刻”的机制根植于特定神经回路的时间差——边缘系统总是比前额叶快上大约两百毫秒——如果问题在于情绪反应跑得太快而理性评估来不及赶到现场,那么增强这两个系统之间的物理连接,是否可能缩短这个时间差?我们能不能训练自己的大脑,让它在面对即时诱惑时更快地“看见”远期代价?这个问题将我们带入过去二十年神经科学领域最令人期待、也最需要审慎对待的方向:神经可塑性。

成年大脑曾被看作一套固化电路。神经元在发育期后逐渐减少,损伤不可逆,学习只是调整现有连接的权重——大脑像一台出厂后就无法更换硬件的计算机。这个图景在二十世纪最后十年开始瓦解。伦敦出租车司机的海马体后部比普通人大——不是先天差异,而是与从业年限正相关。小提琴手左手在大脑皮层中的代表区面积大于非音乐家——与开始训练的年龄和练习时长密切相关。双语者前额叶某些区域的灰质密度高于单语者。大脑会因应重复的经验在物理层面重塑自身。这不是比喻。这是髓鞘厚度的变化、树突棘的增生、突触连接强度的持久改变。

当这个认识被应用到决策研究领域时,它点燃了一种特殊的希望。如果我们能通过训练增强前额叶对杏仁核的调控能力,如果两百毫秒的时间差可以被压缩,那么“标价时刻”的生理性限制就不是铁板一块。大脑的架构可以被修改,代价信号的屏蔽阈值可以被降低。

这种希望并非空穴来风。除了拉扎尔团队的发现,其他研究也指向类似方向。2013年,《社会认知与情感神经科学》上的一份报告显示,经过三个月密集冥想训练的参与者,在面对压力刺激时杏仁核激活程度显著降低,且这种降低与前额叶-杏仁核连接强度增加相关。

认知行为治疗的研究提供了另一条证据链:强迫症患者接受治疗后,基底节回路——与习惯形成密切相关的神经环路——活动模式发生可测量的改变。这不是简单的“学会了控制自己”。脑成像显示的是物理层面的改变:某些回路活动减弱了,另一些回路的连接增强了。这些发现指向同一个方向:神经可塑性确实提供了一条可能的路径。我们不是被困在自己的神经架构里。

但改变是可能的,不等于改变是容易的。让我们仔细看看那些研究中的细节。拉扎尔团队的实验确实发现了显著的大脑结构变化。

但参与者每天进行约三十分钟的正念练习,持续八周,参加每周一次的小组课程,有经验丰富的导师指导,有结构化的练习计划。这不是独自在家随意冥想。

更重要的是,当研究人员追踪这些变化对日常行为的影响时,效应量并不像脑成像结果那样令人振奋。参与者在自我报告问卷中确实报告了压力感降低、注意力改善——但这些改善的效应量处于中等水平。统计上显著,但在日常生活中意味着什么?意味着一个人可能会在某些时刻多停顿一两秒再做出反应,而不是完全避免冲动决策。

2016年,一个研究团队对正念冥想影响决策质量的文献进行了系统综述和元分析。他们筛选出三十一项符合标准的研究,总样本量超过两千人。结论是:正念训练确实可以改善某些类型的决策表现。在需要延迟满足的任务中,冥想者表现出略高的耐心;在需要抵制框架效应的测试中,冥想者受无关信息干扰的程度略低。但这些改善的效应量大多在0.2到0.4之间——属于小到中等。这意味着训练组和对照组的得分分布有相当程度的重叠。一个随机选取的训练者,有大约55%到60%的概率比一个随机选取的非训练者表现更好——远非决定性优势。在现实生活中,你可能根本注意不到这种差异,除非在大量数据中统计才能显现出来。

这不是否定正念训练的价值。小效应量在公共卫生层面仍然有意义——如果一种低成本干预能让整个人口在某些指标上改善0.2个标准差,那可能挽救成千上万的生命。但这里讨论的是个体层面的决策改善。一个个体想要通过冥想训练显著提升自己的决策质量,需要的不是八周的课程——而是远远更大剂量、更长时间的训练投入。

这就引出了一个关键类比:学习一门乐器。当一个人开始学钢琴时,最初几周会发生什么?手指笨拙地寻找琴键,左右手无法协调,节奏混乱。

大脑正在尝试建立新的神经通路来协调这些陌生的动作序列。这个过程是物理性的——神经元在延伸树突、建立新的突触连接、强化某些回路同时弱化另一些回路。

经过八周每天三十分钟的练习,这个人能弹什么?能弹一些简单的练习曲,也许能完整地弹出一首《致爱丽丝》的开头。手指比以前灵活了,读谱速度提高了,但距离“会弹钢琴”还有很长的路要走。

达到能够流畅演奏的水平需要数年时间,每天数小时的练习,不断挑战更难的曲目。你不能绕过枯燥的音阶练习直接抵达莫扎特——就像你不能绕过重复的正念呼吸练习直接抵达情绪调控能力的提升。

神经可塑性的规则就是如此。大脑不会因为你知道改变是可能的就自动改变。它只对重复、持续、高强度的经验输入做出结构性的回应。如果你决定学钢琴,你不会期望八周后就能开独奏会。你知道这是一项需要经年累月投入的技能,你会调整预期。你不会因为三个月后仍然弹不好肖邦就断定自己没有音乐天赋然后放弃。

但谈到通过冥想训练改善决策能力时,人们往往带着不同的预期。也许是因为“正念”这个词听起来太简单了——不就是专注呼吸吗?也许是因为科普报道往往只强调脑成像结果而忽略效应量细节。也许是因为我们太渴望一个快速的解决方案了——如果八周的训练就能让前额叶-杏仁核连接增强,那是不是意味着我们很快就能克服冲动决策了?

这种预期本身就是一种“标价时刻”的变体:我们看到了即时可得的好处——大脑结构变化的漂亮图片——却屏蔽了实现真正行为改变所需的长期代价:数年如一日的高强度训练。

2017年,《心理科学》上发表的一项研究为这个现实提供了精确的量化证据。一百五十三名参与者被随机分配到正念训练组和积极控制组。正念训练组接受标准的八周正念减压课程;控制组接受同样时长的健康知识讲座和放松训练。训练前后,所有人完成了一系列决策任务——延迟满足、风险决策、框架效应测试——部分人还接受了功能性磁共振成像扫描。脑成像结果复制了此前的发现:正念训练组的前额叶-杏仁核功能连接确实增强了。但在行为层面呢?正念训练组在延迟满足任务中的表现确实优于控制组——效应量0.31;风险决策中表现出略低的损失厌恶——效应量0.26;框架效应测试中受无关措辞影响的程度略低——效应量0.22。

这意味着如果你是一个参与这项研究的个体,完成八周训练后回到日常生活中,你可能会在某些决策时刻多犹豫几秒钟——仅此而已。你不会变成一个完全不同的决策者,你不会免疫于冲动,你不会在每一次“标价时刻”都成功看见远期的代价。论文作者在讨论部分坦率地写道:“尽管脑成像证据表明正念训练诱导了与情绪调控相关的神经可塑性变化,但这些变化转化为日常决策行为改善的程度仍然有限。”“有限”——科学文献中最诚实的措辞之一。

但这并不意味着我们应该放弃神经可塑性这条路。恰恰相反:承认改变的真实难度,是真正开始改变的前提。

让我们回到马丁。八周训练结束后他回到工作岗位,市场继续波动。他的边缘系统继续在两百毫秒内对即时信号做出反应。他偶尔能多停顿一秒——这是八周训练的成果。

但更多时候,他仍然按照旧有的模式行动。他后来告诉研究人员一件事:冥想练习最有用的时刻不是在交易时——而是在交易后。当他做了一笔糟糕的交易后,不会像以前那样陷入自我谴责的循环。他能更快地接受损失,更快地把注意力转向下一件事。

这是一个微妙但重要的变化。冥想训练没有可靠地阻止他的边缘系统在决策瞬间抢先行动——但它改变了他对决策后果的反应方式。他的前额叶-杏仁核连接增强了,但这种增强首先体现在“事后处理”阶段而非“事前预防”阶段。

这揭示了一个关于神经可塑性的更深层事实:改变是有顺序的。大脑最先改变的是那些在训练中被最频繁激活的回路。正念冥想练习的核心是什么?是在注意力漂移后温和地把它拉回来;是发现自己陷入思绪后不评判地回到呼吸;是反复练习觉察-接纳-返回的循环。

这个循环最频繁发生的情境不是在压力高峰时刻——而是在平静的练习中。所以大脑最先学会的不是在恐慌时保持冷静,而是在恐慌之后更快地恢复平静。

要在恐慌时保持冷静,需要完全不同类型的训练:需要反复暴露在模拟的压力情境中同时练习保持觉察;需要让大脑在边缘系统激活的状态下反复练习前额叶调控——这样神经可塑性才会发生在最需要的回路上。这就是为什么消防员要反复进行模拟火场训练;为什么认知行为治疗要求患者在治疗室外完成暴露练习:他们必须在真实的触发情境中练习新的反应模式。

回到核心问题:神经可塑性能否帮助我们突破“标价时刻”的生理性限制?答案是:可能可以,但前提是我们愿意接受训练的强度和方式远超目前的想象。如果一个人想要通过训练显著缩短前额叶调控与边缘系统反应之间的时间差,他需要的不是每天三十分钟的正念冥想——他可能需要每天数小时的专项训练,持续数年;需要在模拟的决策压力情境中反复练习觉察-暂停-评估的动作序列;需要让这套新的反应模式被重复足够多次,直到它在神经层面与旧有的冲动反应同样快速、同样自动化。这相当于从零开始学习一门乐器并达到职业演奏家的水平。

有多少人能做到?这不是反问句,是真实的实证问题。2019年,《自然·人类行为》杂志发表了一篇关于认知偏差修正训练的大型综述。认知偏差修正训练是一类旨在通过重复练习来改变自动化认知偏向的计算机化训练程序——例如反复练习将注意力从威胁刺激转向中性刺激以降低焦虑偏向,或者反复练习回避酒精相关图像以减少渴求感。综述团队筛选了超过一百项随机对照试验,总样本量超过八千人。结论是:在实验室条件下,认知偏差修正训练确实可以改变目标认知偏向——效应量中等偏小但统计显著。但在现实生活中,这些改变转化为临床改善或行为改善的程度非常有限。

许多试验在长期随访中未能显示出训练组与对照组之间的显著差异。综述作者写道:“目前的证据表明,认知偏差修正训练作为一种独立干预手段的效果有限。”

这并不意味着这类训练毫无价值。一些特定条件下——例如在临床环境中与治疗师指导结合使用,或者针对高度动机化的特定人群——确实观察到了有意义的改善。但这些改善的条件非常苛刻:高强度训练、专业指导、持续反馈、以及参与者的高度投入。再一次——这更像是学习一门乐器,而不是下载一个应用程序。

把这些证据放在一起,希望的一面是真实的:成年大脑不是固化电路;神经连接可以在物理层面被训练改变;前额叶与杏仁核之间的通路可以被增强;冥想者的大脑结构与普通人确实存在可测量的差异——而且这些差异与练习年限呈正相关;认知行为治疗能够改变强迫症患者的基底节回路活动模式。但限制的一面同样真实——而且往往被科普叙事有意无意地淡化。脑成像中看到的“显著变化”与日常行为中观察到的改善之间存在巨大鸿沟。前额叶-杏仁核连接增强了8%,不代表你在压力情境下做出冲动决策的概率降低了8%。神经层面的改变转化为行为层面的改善是一个复杂、非线性、受无数其他因素调节的过程。

效应量很小。那些统计显著的改善在个体日常生活中可能几乎察觉不到。而且这些改善往往需要极高剂量的训练才能获得——远远超出大多数人愿意或能够投入的程度。复现性存疑:许多早期研究样本量小、方法学质量参差不齐;

当更大规模、更严格控制的试验出现时,效应量往往缩水甚至消失。这不是说所有正念研究都不可信——而是说我们目前对“多大剂量的什么训练能可靠地产生多大程度的行为改善”这个问题的了解仍然非常有限。长期效果不确定:大多数研究的随访期只有几个月,极少数研究追踪了超过一年;我们几乎不知道持续训练五年、十年后会发生什么——这恰恰是最关键的问题,因为神经可塑性改变需要长期巩固才能稳定下来。

最关键的局限性或许是最简单的:训练需要时间和精力投入——大量的时间和精力投入。而时间和精力恰恰是现代人最稀缺的资源。讽刺的是,“标价时刻”机制恰恰会让人低估未来投入的代价而高估即时承诺的价值。“我要开始每天冥想一小时来改善我的决策能力”——这句话本身就可能是一个“标价时刻”:你说出它的瞬间感觉良好(即时奖赏),但你没有真正看见未来三百六十五天每天抽出一小时意味着什么(延迟代价)。

这就是神经可塑性承诺中最深刻的悖论:能够坚持高强度训练的人可能本来就不那么需要它;而最需要它的人可能最难以坚持。那些有足够自控力每天练习数小时冥想的人——他们的前额叶-杏仁核调控能力可能本来就比平均水平强。那些最容易被冲动决策毁掉的人——他们恰恰最难以坚持长周期的枯燥训练。这不是宿命论,这是结构性的困难。

2015年,《临床心理学评论》上的一篇论文系统分析了正念干预的退出率。在纳入分析的四十项研究中,平均退出率为百分之二十九。在某些研究中,退出率超过百分之四十。退出者往往具有一些共同特征:基线压力水平更高、冲动性更强、社会经济地位更低——恰恰是最可能从训练中获益的人群。

论文作者写道:“正念干预似乎面临一个悖论:那些最需要情绪调控训练的人可能最难以坚持完成训练。”这与我们在第16章讨论的自我驯化困境如出一辙——只是在更大的时间尺度上展开。在第16章中,困境在于边缘系统的反应比前额叶快两百毫秒,知识来不及赶到现场。在本章中,困境在于改变这种时间差需要的训练强度太大、周期太长,而能够坚持这种训练的人往往是那些时间差本来就较小的人。这不是任何人的错,这是神经架构的现实。

现在我们可以回答那个问题了:当个体内部的自我调控面临结构性限制时,我们应该把希望寄托在哪里?神经可塑性提供了一条路——但这条路比大多数科普叙事暗示的更漫长、更崎岖。它不是一条捷径。它更像是选择了一条登山路线而非乘坐缆车:最终确实可能抵达山顶,但需要数月乃至数年的持续攀登,而且途中随时可能放弃。这条路的真实性不应该被低估——知道改变是可能的这件事本身就有价值。但它也不应该被浪漫化——把神经可塑性描绘成一种可以轻松获取的灵丹妙药是对科学的误读和对读者的误导。

2018年,《自然》杂志发表了一篇评论文章,标题直白得令人耳目一新:《正念研究需要更加诚实》。文章指出正念领域的许多研究存在发表偏差——阳性结果更容易发表;效应量经常被夸大;商业化的正念产品往往引用脑成像研究作为科学背书,却刻意忽略行为改善效应的微弱和不稳定。文章写道:“向公众传递的信息应该是:正念训练可能对某些人某些情况下有帮助,但我们还不确切知道对谁有效、需要多大剂量、效果能持续多久。”这种诚实不是否定神经可塑性研究的价值——恰恰相反,它是对科学精神的尊重和对公众智识的信任。

这意味着什么?意味着如果你正在考虑通过冥想训练来改善自己的决策质量,你应该带着清醒的预期进入:这不是一个短期项目;这不是一个你可以“完成”然后获得永久收益的东西;这是一项需要持续投入的技能训练——就像弹钢琴、学外语、或者保持体能一样。意味着八周的正念课程可以是一个好的开始——但它只是一个开始。它相当于钢琴入门课的前八周:你学会了基本的指法,能弹几首简单的曲子,但距离能够在音乐会上演奏还有数年之遥。

意味着脑成像中看到的那些漂亮的变化不应该被解读为“大脑已经被修复了”——它们只是基础设施层面的微小改建。把这些改建转化为真实世界中可靠的决策改善,需要远远更多的训练和经验积累。

也意味着——这一点至关重要——我们不应该把所有的希望都寄托在个体自我改造上。如果改变大脑需要如此巨大的投入,如果大多数人无法或不愿坚持如此高强度的训练,那么仅仅告诉人们“你可以通过冥想来改善决策”是不够的——甚至可能是不负责任的。这就像告诉人们“你可以通过每天跑步来保持健康”的同时拆除所有公园和人行道。

我们需要另一条路。如果个体内部的自我调控存在结构性限制,如果突破这些限制需要的个体投入远超大多数人的承受能力,那么我们是否可以把目光转向外部?是否可以设计不依赖于个体理性水平的决策环境?是否可以通过制度安排来补偿人类认知架构中那些进化形成的盲区?这些问题将把我们引向更远的地方。

但在转向外部之前,有一个事实不容忽视:那些利用“标价时刻”机制的人——算法设计者、营销专家、政治顾问——不会等待我们完成冥想训练。他们在不断优化他们的工具。他们正在让即时奖赏信号变得更快、更强、更难以抗拒。而大多数人仍然在重复那些无效的自我激励口号:我要更自律,我要更理性,我要控制自己。这些口号本身没有任何问题——除了它们不太管用之外。

2019年,一项追踪长期冥想者大脑结构变化的研究得出了一个耐人寻味的发现。研究人员比较了三组参与者:从未冥想的对照组、练习一到五年的中级冥想者、以及练习超过十年的资深冥想者。结果并不令人意外:资深冥想者的前额叶-杏仁核连接最强,中级冥想者次之,对照组最弱。剂量-效应关系清晰可见。

但真正有趣的细节藏在数据里:即使在资深冥想者组中,个体差异也极其巨大。有些练习超过十年的人,其前额叶-杏仁核连接强度只相当于中级冥想者的平均水平;而有些只练习了三到五年的人却达到了接近顶级水平。研究人员无法解释这种差异。可能是遗传因素;可能是练习质量不同而不仅仅是时长不同;可能是生活压力和其他环境变量的影响。

这个发现提醒我们:即使在最理想的情况下——长期、高强度、持续投入——神经可塑性带来的改变也是不确定的、个体差异巨大的、无法精确预测的。它不是一条保证通向目的地的路。它只是一条可能的路——对某些人有效,对另一些人效果有限;在某些方面改善明显,在另一些方面收效甚微。这种不确定性本身就应该塑造我们对“自我改造”这项事业的预期。

2017年,《心理科学》发表了英国心理学家蒂姆·达格利什团队的一项研究,标题很平实:《认知偏差修正训练对健康成人饮食行为的影响:一项随机对照试验》。一百二十名参与者被随机分配到积极训练组和假训练组;积极训练组接受旨在减少对高热量食物注意偏向的计算机化训练;假训练组接受外观相同但不会改变注意偏向的训练;训练为期四周,每周三次,每次约二十分钟。结果如何?训练结束时,积极训练组对高热量食物的注意偏向确实降低了——效应量中等偏小但统计显著。脑成像也显示了一些相关脑区活动模式的微小变化。

但饮食行为呢?四周训练结束后参与者的实际食物选择发生了什么变化?论文的结果部分有一张表格,表格中的数字显示:积极训练组和假训练组在食物选择上的差异不显著(p = 0.47)。四周的训练改变了注意偏向的数字指标——但没有改变人们在真实生活中选择吃什么的行为。讨论部分的第一句话是这样写的:“本研究的发现呈现了一幅复杂的图景:认知偏差修正训练成功改变了目标认知过程(注意偏向),但这种改变未能转化为目标行为(饮食选择)的可测量改善。”

一幅复杂的图景。这就是神经可塑性的承诺的全部真相:改变是可能的;改变是真实的;但改变也是艰难的、有限的、从神经层面到行为层面之间存在巨大鸿沟的。

马丁在完成八周训练后的第三年仍然每天早晨冥想二十分钟——不是因为他确信这能让他成为更好的交易员,而是因为他发现这能让他在做了一笔糟糕交易的那个晚上睡着觉。这个收益是真实的、可感知的、值得那每天二十分钟的投入的。但它不是他最初躺进扫描仪时被告知的那些收益——不是前额叶-杏仁核连接增强带来的决策质量飞跃;不是在压力高峰时刻保持冷静的超能力;不是对“标价时刻”机制的免疫。它只是一个微小的改善——在事后恢复得更快一点;对自己稍微宽容一点;在下一次决策时多出不到一秒的犹豫空间。

这个改善值不值得每天二十分钟的投入?马丁认为值得。但这个改善是不是突破“标价时刻”生理性限制的答案?不是。它是答案的一部分——很小的一部分。它提醒我们大脑可以被改变,但这种改变的真实速度是以年为单位的缓慢渐变而非以周为单位的快速升级。

而当我们诚实地面对这种缓慢时,一个更棘手的问题自然浮现:如果突破自我的代价如此高昂、过程如此漫长、结果如此不确定,那么补偿性的出路是否不在内部而在外部?是否不在于变得更强大而在于设计更好的环境?这个问题不会在本章得到回答,但它必须被提出。