第 13 章

证词之后

“她说的是‘最像’。”

柯克·布拉兹沃斯在获释后接受采访时,反复强调这个词。不是“就是他”,不是“我认出来了”,而是“这个最像”。他在监狱里待了八年十一个月零十九天,而把他送进去的那句话里,最关键的那个词,在警探的记录上被改写成了“指认了嫌疑人”。上一章结束时,我说个人层面的审慎为我们打开了一扇门。

在你跨过那道门槛之前,我想先带你回到辨认室——回到目击者还没有走进法庭之前,回到警察还没有开口问出第一个误导性问题之前。因为问题不是从讯问开始的,不是从交叉质询开始的,甚至不是从记忆消退开始的。问题从那个房间的物理布局就开始了。从六张照片同时摊在桌上的那一刻就开始了。

1984年7月,马里兰州巴尔的摩县。一名年轻女性在公寓楼地下洗衣房遭到强奸。受害者是白人,她向警方描述袭击者是一个黑人男性,身高大约一米七五,偏瘦,短发。案发后第三天,警探给她看了六张照片。

六张年轻黑人男性的面部照片,同时摊在桌上。她一张一张看过去,在其中一张上停留了较长时间。那是柯克·布拉兹沃斯的照片。她问警探:“你觉得是他吗?”

警探没有回答。他按照程序说:你自己判断。她又看了一遍。最后指着布拉兹沃斯的照片说:“这个最像。”

注意她的措辞。最像。不是“就是他”。最像。警探记录上写的却是“受害者指认了嫌疑人”。布拉兹沃斯被捕,起诉,受审。受害者在法庭上指着他说:“我永远不会忘记那张脸。”陪审团相信了她。他被判三项终身监禁加两个二十年徒刑。1993年,DNA检测证明他无罪。真凶是一个叫金伯利·谢伊·拉夫的人,他在案发后不久就因为另一桩强奸案入狱,但警方从未把他的照片放进任何辨认队列。布拉兹沃斯获释那天,记者问他有什么感受。他说:“我不是愤怒。我只是在想,她当时说的是‘最像’。她说的是‘最像’。”

这个案子后来成了美国司法改革的标志性案例。但我想让你注意的不是冤案本身——冤案我们已经谈得够多了。我想让你注意的是那个辨认程序。

六张照片同时摆在面前。受害者在比较。她在做选择题。这不是她个人的错。这是人类认知系统在面对同时呈现的多个选项时的自动反应。心理学家给它起了一个名字:相对判断。

你走进一家鞋店,墙上挂着二十双鞋。你不会一双一双地问自己“这双是不是我想要的”。你会扫一眼,比较,然后挑出最像你想要的那双鞋的那一双。这个策略在日常生活中极其高效。你不需要记住目标鞋款的每一个精确特征——颜色、款式、鞋跟高度、皮质纹理——你只需要在选项之间做比较,挑出最匹配的那个就行了。

但辨认罪犯不是挑鞋。当你同时看到六张照片时,你的大脑会自动启动相对判断策略。你不再问“这些人里有没有我见过的那个人”,你开始问“这些人里谁最像我见过的那个人”。这两个问题听起来差不多,但认知过程完全不同。第一个问题是识别——你把每一张照片和你记忆中的那张脸逐一比对。

第二个问题是选择——你在六张照片之间做比较,挑出最符合你记忆特征的那一个。关键区别在于:即使真正的罪犯根本不在队列里,你也可能挑出一个人来。因为总有一个“最像”的。

这不是假设。这是被反复验证过的实验结果。加里·威尔斯是爱荷华州立大学的社会心理学家。从二十世纪七十年代末开始,他花了将近二十年时间研究目击者辨认程序的认知机制。他的实验室做过一个经典实验:让被试观看一段模拟犯罪的录像,然后给他们看一组照片,要求指认“罪犯”。关键操作是——在其中一半的辨认队列里,真正的罪犯根本不在里面。

结果令人不安。当真正的罪犯不在队列中时,如果采用传统的“同时呈现”方式——六张照片一起摆在桌上——有超过一半的被试会指认一个无辜者。他们不是在撒谎。他们是真的相信那个人就是他们看到的罪犯。他们只是不知道自己在做相对判断。

威尔斯用了一个更直观的实验来说明这个问题。被试看一组面孔,然后做辨认测试。测试中有两种条件:目标面孔在队列里,或者不在。

采用同时呈现方式时,当目标不在队列中,误认率高达百分之五十四。这意味着超过一半的人会在六个无辜者中挑出一个来指认。

然后威尔斯做了一个简单的程序调整。他不把六张照片同时摆出来了。他一张一张地给被试看。先看第一张,问:这个人是不是你看到的罪犯?必须回答是或不是,然后才能看下一张。被试不知道后面还有几张照片,也不知道队列里一共有多少人。

这个程序叫顺序列队辨认。结果呢?当真正的罪犯不在队列中时,误认率从百分之五十四降到了百分之三十二。程序没有任何其他改变。同样的照片,同样的被试,同样的指导语。唯一的区别是把同时呈现改成了逐张呈现。误认率下降了二十多个百分点。

为什么?因为顺序列队迫使证人做绝对判断。当你只能看到一张照片时,你没法在照片之间做比较。你只能把这张照片和你记忆中的那张脸做比对。你要回答的问题是:这个人是不是他?而不是:这个人是不是比刚才那张更像他?威尔斯把这个发现称为“辨认程序中的认知革命”。他说得不算夸张。

过去几十年里,无数目击者在辨认室里的判断过程,都被一种他们自己意识不到的认知策略扭曲了。他们不是存心要冤枉无辜者。他们只是在做他们的大脑最擅长的事——在选项之间做比较。

但这还不是全部。威尔斯后来的研究揭示了另一个同样致命的因素:反馈效应。

想象你是辨认室里的证人。你看着六张照片,犹豫不决。你指了其中一张,说:“这个……我觉得可能是他。”警察点点头,说:“好的,就是他。”或者更微妙——警察笑了一下,或者说了一句“我们也是这么想的”,甚至只是肩膀放松了一点。

这个反馈对你意味着什么?它意味着你选对了。接下来会发生什么?你的记忆会重写自己。我们在前面几章已经讲过洛夫特斯的误导信息实验——事后信息可以植入虚假的记忆细节。辨认程序中的反馈是误导信息的一种特殊形式:它不是改变了你对犯罪本身的记忆,而是改变了你对辨认过程的记忆。威尔斯和同事在1998年做了一个实验。

被试观看录像后做辨认测试,然后被随机分配到两种条件:一种收到确认反馈——“很好,你指认了正确的嫌疑人”——另一种没有收到反馈。稍后,研究人员询问被试关于辨认过程的一系列问题:你在辨认时有多确定?你花了多长时间做出决定?你看得有多清楚?

结果惊人地一致:收到确认反馈的被试回忆起的辨认过程完全不同了。他们说自己当时“非常确定”,说自己“一眼就认出来了”,说自己“看得很清楚”——即使他们在辨认时其实犹豫了很久,即使当时的观察条件很差。

他们不是故意撒谎。他们的记忆真的被反馈信息重塑了。这个发现有一个令人脊背发凉的含义:一旦警察给出了确认反馈——即使是无意的、非语言的——证人就走出了那扇门,带着一个被加固过的、信心满满的错误记忆走进了法庭。陪审团看到的是一个斩钉截铁的目击者:“我永远不会忘记那张脸。”但他们看不到的是,这个斩钉截铁的信心是在辨认室里的那几秒钟内被制造出来的,而不是来自犯罪现场的那几秒钟观察。

这就把我们带到了本章的核心论断:目击者的记忆并不在辨认那一刻才被污染——辨认程序本身就是一次强有力的记忆重建事件。你在前面几章已经知道,记忆不是录像带,每次回忆都是一次重建。但辨认程序不是一般的回忆。它是一个高压力的、带有重要后果的、被权威人物注视着的回忆场景。在这种场景下,大脑的重建机制全速运转——它会填补空白,会整合暗示,会在事后重新解释自己当时的选择。

更麻烦的是,辨认通常不止一次。一个典型的美国刑事案件中,目击者可能经历多达三到四次辨认:案发后在现场的街头指认,几天后在警察局的照片辨认,几个月后在拘留所的实际列队辨认,最后是法庭上的当庭指认。每一次辨认都是一次回忆事件,每一次回忆都是一次重建。到法庭指认的时候,证人指认的早已不是犯罪现场看到的那个人了——他们指认的是自己在照片辨认中选出的那张脸,那张脸已经被多次回忆加固成了一个“原始记忆”的样子。这个过程有一个专门的术语:无意识迁移。

证人把在后续辨认中反复看到的面孔迁移到了对犯罪现场的记忆中,而且完全意识不到这个迁移发生了。

1995年,心理学家戴维·罗斯和同事做了一个实验来验证这个效应。被试观看一段模拟犯罪的录像,其中有一个“罪犯”的面孔。几天后,他们看一组照片做辨认测试——但真正的罪犯不在其中。

那些错误指认了一个无辜者的被试被召回实验室。研究人员给他们看两组面孔:一组是他们在照片辨认中看到过的无辜者面孔,一组是他们从未见过的面孔。他们被问到:哪一组里有你当初在录像里看到的罪犯?相当一部分被试指着那个他们在照片辨认中选出的无辜者说:“就是他。”他们真的相信那张脸就是他们在犯罪现场看到的。他们的原始记忆已经被后续的辨认经历覆盖了。

你现在应该开始理解为什么我说个人层面的审慎只是开了一扇门。门后面是一个更复杂的问题:当记忆在每一次辨认程序中被系统性地重建时,我们还能不能区分一个基于原始感知的记忆和一个被程序本身制造出来的记忆?

威尔斯的研究提供了一个部分答案:我们可以通过改良程序来减少系统性的错误。顺序列队辨认就是一个经过严格实验验证的改良方案。它不仅降低了无辜者被误认的概率,而且没有显著降低正确辨认率——换句话说,当真正的罪犯在队列里时,顺序列队和同时列队的正确辨认率差不多;但当真正的罪犯不在队列里时,顺序列队的误认率大幅下降。这是一个罕见的双赢局面:保护无辜者而不牺牲打击犯罪的效率。

基于这些证据,威尔斯和他的同事们从二十世纪九十年代末开始推动全美警察机构的辨认程序改革。他们发布了一套最佳实践指南:采用顺序列队;使用双盲程序——主持辨认的警官不知道谁是嫌疑人;在辨认前明确告知证人“嫌疑人可能不在队列中”;记录证人在辨认时的信心水平——在收到任何反馈之前。

一些州和城市采纳了这些建议。新泽西州在2001年率先在全州范围内推行了这些改革。威斯康星州、北卡罗来纳州和其他几个州也陆续跟进。国际警察首长协会在2010年发布了基于这些研究的示范政策。

但问题是——这够吗?即使采用了最科学的顺序列队辨认程序,即使使用了双盲操作和信心记录,我们仍然面临一个根本性的局限:我们无法知道证人的原始记忆是什么样子的。顺序列队可以减少相对判断的压力,但它不能消除一个事实——证人走到辨认室门口时带来的那个记忆本身可能已经被污染了。案发后的媒体报道、与亲友的讨论、警察的非正式交谈、甚至是案发当晚的梦境——所有这些都可能在证人看到任何照片之前就已经重塑了他们的记忆痕迹。

更重要的是,顺序列队不能解决一个更隐蔽的问题:当真正的罪犯根本不在队列中时——无论是因为警方抓错了人还是因为真凶从未被列为嫌疑人——任何辨认程序都只能产生两种结果:要么证人正确地说“不在这里”,这在统计上是少数情况;要么证人错误地指认一个无辜者。威尔斯自己的数据也显示了这个局限。在最好的条件下——顺序列队、双盲操作、事前警告——当真正的罪犯不在队列中时,仍然有大约百分之三十二的被试会错误指认一个无辜者。

百分之三十二不是一个可以忽略的数字。它意味着每三个无辜嫌疑人中就有一个可能被一个诚实的、自信的目击者错误指认。这就是程序改良的边界。程序可以降低系统性的错误率,但它不能把错误率降为零——因为错误的根源不在程序本身,而在记忆的本性里。记忆是重建,不是提取。每一次回忆都在改写原件。辨认程序只是这个重建过程中的一个环节,尽管是一个特别强力的环节。艾伦·纽费尔德是纽约市的一位辩护律师,代理过大量涉及目击证词的案件。“你可以改良队列,”他说,“但你改良不了记忆。”

纽费尔德不是心理学家,但他抓住了问题的关键。程序改革解决的是如何从证人那里提取信息的问题,但它解决不了信息本身已经被扭曲的问题。这里有一个更深层的认识论困境:我们永远无法直接比较证人的记忆和“原始真相”,因为我们能接触到的只有证人的记忆本身。

没有独立的、客观的记录可以让我们验证记忆是否准确——如果有,我们就不需要目击证人了。这就意味着,在任何依赖目击证词的案件中,我们都面临着一个无法完全消除的不确定性:证人自信满满地指认的那个人,究竟是基于犯罪现场的原始感知,还是基于一个在多次重建中被层层加固的错误记忆?我们无法知道答案,因为即使证人也无法区分这两者。

我们在前面几章讨论过的“元记缺口”——主观信心与客观准确性之间的固有落差——在这里达到了它的司法顶点。法庭需要确定性,但记忆科学告诉我们,确定性本身就是问题的一部分而不是解决方案的一部分。美国的司法系统对这个问题的回应是分裂的。

一方面,越来越多的州开始采纳基于科学证据的程序改革——顺序列队、双盲操作、信心记录。这是一个进步,它表明法律系统开始认真对待记忆科学的发现。另一方面,法庭仍然高度依赖目击证词,陪审团仍然倾向于相信自信的目击者,法官仍然很少允许专家证人出庭解释记忆科学的研究成果——理由是这些研究是“常识”,陪审员自己就能判断目击者是否可靠。

但这恰恰是常识出错的地方。常识告诉我们,自信意味着准确,细节意味着真实,情绪强度意味着不可磨灭。记忆科学告诉我们,这三条常识每一条都是错的。

这就是为什么本章不能止步于程序改良的乐观叙事。程序改良是必要的,但它不够充分。它解决了辨认过程中最恶劣的系统性错误——相对判断、确认反馈、无意识迁移——但它不能解决记忆重建本身带来的根本不确定性。

这就迫使我们面对一个更根本的问题:当记忆无法提供确凿真相时,我们依赖什么?这个问题没有简单的答案,但它指向了一个方向:我们需要重新思考“真相”在司法语境中的含义。

如果目击证词不能提供确定的真相——即使是在最优程序下——那么我们就需要降低对目击证词的权重,增加对物证的依赖,并且在无法排除合理怀疑时勇于承认“我们不知道”。这不是放弃追求真相,而是承认人类认知的局限性,并在这种局限性的约束下重新设计我们的求真机制。布拉兹沃斯案有一个不那么为人所知的后续细节。在他被无罪释放几年后,有人问他:你恨那个指认你的受害者吗?他沉默了一会儿,然后说:“不恨。”

“因为她不是在撒谎,”他说,“她是真的相信我强奸了她。”

这句话比任何心理学教科书都更精确地概括了本章的核心困境:最危险的错误记忆不是那些有意编造的谎言,而是那些被认知系统本身制造出来、然后被程序加固、最后被信心包裹成不可动摇的确信的虚假记忆。面对这种错误,愤怒是不够的,谴责是不公的,而单纯的程序改良——尽管必要——也是不够彻底的解决方案。

我们需要的是一个认识论层面的转向:承认记忆的重建本质不仅是一个实验室里的科学事实,也是一个必须在制度设计中被认真对待的根本约束条件。这个转向不会在本章完成,也不会在任何一章完成。它是一个仍在进行中的过程,每一步都面临着来自常识直觉、制度惯性和政治压力的抵抗。

但至少我们现在知道问题在哪里了——不在证人的诚实与否,不在警察的善意与否,甚至不在程序的科学与否,而在一个更深的地方:在我们每次闭上眼睛回忆时,大脑自动启动的那套重建机制里。

那套机制不是缺陷,它是演化赋予我们的适应智慧——它让我们能够灵活地整合新信息、调整旧知识、在不确定的世界里做出足够好的判断而不是追求完美的精确性。但在法庭上,“足够好”是不够好的。当布拉兹沃斯说“她说的是‘最像’”时,他不只是在陈述一个事实。他是在指出一个被整个司法系统长期忽视的认知裂缝。

“最像”和“就是他”之间的距离看起来只有一个形容词那么窄,但那个距离里装得下八年十一个月零十九天的自由,装得下一个人的全部人生被错误地折叠进另一个人犯下的罪行里,装得下无数个类似案件中至今未被纠正的错判。

这个距离就是元记缺口的司法刻度——不是百分比,不是效应量,不是实验室里的统计显著性,而是以年为单位计算的人类代价。而缩小这个缺口的第一步,不是改良程序,不是培训警察,不是教育陪审员——虽然这些都很重要——第一步是承认:我们最确信的记忆可能恰恰是最不可靠的那一段。这个承认不是在法庭上说的,不是在政策文件里写的。

它是在每个人面对自己记忆的那一刻做出的选择——在“我记得”和“所以一定发生过”之间留出那个停顿。那个停顿不仅是个人层面的审慎。它也是一个社会在面对目击证词时应该保持的认识论谦逊的微观模型。

但谦逊本身不能断案。停顿之后还是要做决定。而决定就必然涉及另一个问题:如果记忆不能提供确凿真相,我们该用什么来替代它?这不是一个修辞性的提问。它是每一个依赖目击证词的司法系统每天都在用判决书回答的问题——只是那些回答大多建立在一个错误的前提之上:记忆是可靠的录像带。它不是。它从来都不是。而承认这一点之后该如何行动——那不再只是记忆科学的问题了。那是法律、伦理和每一个公民必须共同面对的选择。