虚假相关
在两件毫无关联的事件之间,我们常因为它们偶然的同时发生而强行认定其存在因果或必然联系。虚假相关很容易沦为偏见与迷信的温床,干扰我们的理性逻辑。
寓言故事
小禾的外婆走后,留给她三样东西:一只老银镯子、一罐晒干的野菊,和一本牛皮封面的小簿子。 簿子是外婆用来记天气的。外婆的手指关节不好,每当天要变,手指先疼。她在簿子上画了三年——晴天画一个空心圈,雨天涂满,翻风的日子就画三道斜线。小禾翻完簿子的时候,已经能背出那些符号的排列:圈、圈、三道斜线、满圆、满圆——外婆的膝盖是一台比铜壶滴漏还准的气象仪。
小禾接过簿子的时候也接过了一件事:她要继续记下去。
她记得很认真。哪一天下了雨,哪一天起了风,哪一天村口那棵老皂角树开始落叶。写到第四十七天的时候,她发现了一个规律。
北坡那个烧炭人——一个总穿灰布短衫、赶一头黑驴的中年男人——每半个月来一次,在集市上卖两筐炭,卖完就走。小禾从来不注意他卖炭,但她注意到另一件事:每次烧炭人赶着驴从村口经过之后,不出两天,必下雨。
她往前翻簿子。第四天:烧炭人过,第二天下雨。第十九天:烧炭人来,当夜落雨。第三十三天:又是这样。第四十七天,他在集市上多停了一个时辰,第二天下午,雨来了——不大,刚好把她晒在院子里的被单淋湿。
小禾在第四十七天的记录下面,画了一条横线。横线下面用外婆留下来的小字写了四个字——「烧炭人雨」。
从那以后,她开始用红笔圈烧炭人来访的日子。每次圈上,她就等着。雨来了,她就在红圈旁边加一个水滴符号——外婆没教过她这个符号,她自己发明的。水滴越画越多,和红圈并排排在一起,像一行只有她自己能破译的密码。
村里人渐渐知道了。卖豆腐的阿婶每回看见烧炭人进村,就到隔壁院子喊一声:「小禾簿子上说快下雨了,收衣裳——」喊了几回之后,连村口茶馆里的老茶客也开始在烧炭人过路的时候抬头看天。烧炭人自己不知道。他照旧每个月来,卖完炭就走,走的时候驴蹄子在碎石路面上敲出一串闷闷的响。
没有人问过小禾一句话:烧炭人不来的时候,天也下雨吗?
这话没人问。就连小禾自己也没问过自己。她的簿子上只有红圈和水滴,没有「烧炭人来、天晴」——那些日子她当然也经历过,但她没有画任何符号。它们只是普通的晴天,不值一提。
入秋以后,烧炭人连续两个月没有出现。天照常下雨——一场在霜降前,一场在小雪后。小禾在簿子上记了这两场雨,用的是普通的满圆——没有红圈可以配在旁边,她也就没有画水滴。她盯着那两页看了很久,像是簿子上的符号忽然缺了一段她原本以为很结实的桥。
第三个月,烧炭人又来了。
那天天气很好。小禾站在村口,看着他牵着驴从山路上走下来。阳光把驴背上的炭筐晒得微微发亮。她手里握着簿子和红笔,等着。
第二天,没下雨。
第三天,天气晴得发懒,连一片云都没有。她在第三天的格子里停了一会儿——红圈旁边,空着一个水滴的位置。她把笔搁下了。下一页,再下一页——她没有再画红圈,不是因为规律被打破了,而是因为她不知道那些空着的水滴该怎么处理。它们不像符号,更像一个问题。
冬天来的时候,小禾还在记天气,用的还是外婆留下的那本簿子。圈、满圆、三道斜线——她的字比外婆的更小、更密,也更规矩。只是簿子的边角处,有几页几乎被橡皮擦破了——那是她第四十七天画下的那条横线,和横线下面那四个小字:「烧炭人雨」。
烧炭人还是每半个月来一次。小禾不再抬头看他了。但她知道他从村口走过去——因为那串驴蹄子的声音,闷闷地,从石板路上碾过去,和一场不会来的雨没有任何关系。
大脑在随机中看见秩序,然后深信不疑。
核心定义
虚假相关是指我们在两件客观上并无关联的事情之间,错误地感知到了一种系统性的共变关系——「A 一出现,B 就跟着出现」——并且对这个虚幻的关联深信不疑。它的核心机制不是「看到了不存在的事」,而是只记录了两个事件同时发生的次数,却漏掉了它们分别单独发生的次数:我们的大脑在潜意识中建了一本只记「命中」的账本,而「未命中」那一栏始终是空的。
这一概念最早由心理学家洛伦·查普曼和琼·查普曼(Loren Chapman & Jean Chapman)于 1967 年在一项经典实验中系统揭示。他们让临床心理师观看一系列病人的画作和对应的症状描述——实际上,画作特征与症状之间完全随机配对。但心理师们仍然报告了明确的「关联」:比如「画大眼睛的病人有偏执倾向」。查普曼夫妇由此提出了虚假相关的核心洞见:当两个特征各自在统计上罕见或突出时,它们同时出现的少数几次就会在记忆中形成强烈的联结,而大脑会自动忽略它们各自单飞的那些时刻。
随后,社会心理学家戴维·汉密尔顿和罗伯特·吉福德(David Hamilton & Robert Gifford)在 1976 年将虚假相关推进到社会认知领域。他们在实验中让被试阅读一系列关于两个群体(A 群体人数更多,B 群体人数更少)的行为描述——两类群体中,正面和负面行为的比例完全相同。然而被试一致报告说,人数更少的 B 群体有更多负面行为。这一发现揭示了一个令人不安的机制:当稀有群体和稀有行为同时出现时,这种「双重显著」的组合在记忆中刻得最深——而这就是刻板印象形成的一条隐秘的认知路径。
虚假相关之所以危险,不是因为它让个别判断出错,而是因为它完成了一条从随机中骗走意义的生产线:少数几次巧合被编码为「规律」,规律被贴上「经验」的标签,经验被用于指导未来决策——而整条生产线唯一的原料,是一本只记了半边的账本。
「虚假相关」的英文 Illusory Correlation 由查普曼夫妇于 1967 年正式命名。在他们那项被后人反复引用的实验中,受试者们不仅「看出」了不存在的关联,而且对自己的判断极其自信——虚假相关的坚固程度,有时甚至超过了对真实相关的判断。此后,克劳斯·菲德勒(Klaus Fiedler)在 1991 年进一步指出,虚假相关本质上是一种「信息丢失」——我们在记忆存储阶段就已经把「A 没和 B 一起发生」的那些信息删除了,而事后无法从已经被裁剪过的记忆中找回它们。
常见表现形式
配对显著性效应
当两件事各自在经验中比较罕见或引人注目时,它们同时出现的少数几次会被不成比例地放大——比如少数群体中的罕见行为、特殊日子里发生的意外事件。
选择性记录
我们下意识地只为「A 和 B 一起出现」的时刻建立记忆索引,而 A 单独出现、B 单独出现、两者都不出现的那些时刻,在记录时就已被过滤掉了。
民俗经验的伪装
许多代代相传的「老话」和「经验」——「月圆之夜急诊多」「考试下雨分数高」——其源头往往是少数几次巧合被反复讲述,而那些反例被集体性地遗忘。
统计盲区的产物
在缺乏完整的共现频率表时,大脑会自动用印象中最容易提取的那几次「共现」来替代整张表——而最容易提取的,永远是那些最突出、最戏剧化的组合。
真实案例
那双每次考试都穿的袜子
你有一双灰色的棉袜。大三那年期中考试,你穿着它考了第一名。你觉得这事有点意思——下次考试又穿上了,又考得不错。从那以后,这双袜子就成了你的「考试袜」。你从来不洗它——怕把运气洗掉。你当然知道分数和袜子之间没有任何因果通道,但在考试前从抽屉里摸出那双袜子的时候,你还是感到了一种说不清的安心。至于那些没穿它同样考出高分的考试——你把它们归为「那次题目简单」。至于那些穿了它却考砸的场次——「那次状态不好,袜子也救不了。」
「不是迷信——就是图个心里踏实。」那条从 K 线图里看出来的规律
你在研究某只股票的历史走势,发现在过去八个月里,有四次——每次成交量放大之后的第三个交易日,股价都上涨。你觉得这条规律很漂亮。你用红笔在 K 线图上把四个点连了起来,给这个「规律」起了一个只有自己懂的名字,开始按它下单。但你从来没有去系统性地统计过:在成交量放大的全部交易日中,第三个交易日上涨的比例是多少?那些成交量放大之后股价下跌的日子——它们也在图里,只是你没有画线。你的规律建立在四次「命中」上,而「未命中」的次数——可能是十四次,可能是四十次——根本就没有进入你的计数范围。
「我不看那些乱七八糟的指标——这条线我跟踪了半年,几乎没失手过。」那个被反复转述的「发现」
你在社交媒体上读到一条热门帖子,作者声称「我注意到,凡是名字里带『轩』字的男孩子,性格普遍偏内向敏感」。下面跟了二十几条评论——有附和说自己认识的「轩轩」也是这样,有现身说法的,有补充「对,还有『子涵』」。你觉得似乎有道理,转发时加了一句「好像是真的」。但没有人——包括作者和你——去数过:你一生中遇到过多少名字不带「轩」的男孩,他们的性格分布是怎样的?名字带「轩」的男孩中,活泼外向的比例是多少?那二十几条评论之外,还有多少读者看了一眼就划过去、因为自己认识的「轩」完全不是这样?你看到的不是数据,而是被算法和转发不断放大的少数几次「命中」。
「看了那么多评论,应该不是空穴来风吧。」正误对照
你的朋友兴奋地告诉你,他发现了一条投资信号——某科技公司 CEO 每次在社交媒体上提到「未来」这个词之后,接下来一周该公司的股价就会上涨。「我查了最近四个月,每次都是。你看看——」他把截图发过来了,四次,红圈标得整整齐齐。
运作机制
进化根源
在人类长达数百万年的演化史中,发现环境中的规律——「那种红色浆果吃过之后会腹痛」「河对岸那片草丛里有蛇出没」——是生存的底线技能。在一个信号不确定、信息不完整的世界里,大脑演化出了一套极度敏感的共变检测系统:它宁可把两次随机的相邻事件标记为「可能有关系」,也不愿因为等待更多数据而错过一个真实的危险信号。从统计学的角度看,这是一种不对称的决策策略——「假阳性」(误以为有关联)的成本通常远低于「假阴性」(错过了真实关联)的成本。你多吃一次红色浆果不会死,但漏掉一次蛇与草丛的共现可能致命。这套策略在祖先环境中是理性的,但它的代价是:大脑出厂时就内置了一个偏高的「关联认定阈值」——我们在本来没有规律的地方,也倾向于看见规律。
认知编码
查普曼夫妇与汉密尔顿的经典实验共同揭示了一个核心认知过程:大脑在编码信息时,对「显著事件」和「普通事件」的存储优先级完全不同。如果事件 A 本身在经验中出现频率很低(比如少数群体、罕见天气、特殊行为),那么 A 和 B 同时出现的时刻——哪怕只是偶然的几次——会在记忆中被赋予极高的存储权重。而 A 和 B 没有同时出现的那些时刻——「A 发生了但 B 没发生」「B 发生了但 A 没发生」「两者都没发生」——因为各自不具备显著性,在记忆编码阶段就被降级处理了。结果是,我们事后从记忆中提取出来的「证据」本身就是经过不对称裁剪的:显著组合被高清保存,其他所有情况被模糊压缩或直接丢弃。这本不平等的记忆账本,构成了虚假相关最底层的认知基础。
社会放大
虚假相关一旦在个体层面形成,就进入了社会传播的倍增器。一个人发现了一个「规律」,告诉第二个人;第二个人只记住了结论,没记住验证过程;第三个人在一次相关事件中亲身体验了一次「命中」,认定规律为真——于是把它转述给更多人。在这个过程中,每一次转述都会进一步放大命中的戏剧性,压缩或省略未命中的沉默。几代之后,「规律」变成了「老话」「常识」「民间智慧」——而最初那少数几次巧合并不能提供的基础频率,早已被故事的血肉层层包裹。这就是为什么许多文化中流传数百年的「经验法则」,在统计学面前不堪一击:它们不是从全面数据中归纳出来的,而是从少数几次被反复讲述的巧合中长出来的。
信号识别
口头总是
你口头或心里出现「每次……都……」「一到……就……」这类全称表达时,停下来问一句:这个「每次」一共是多少次?你能不能确切说出次数?如果不能——你大概率不是在报告数据,而是在报告一个印象。而印象的基础,往往只是少数几次被牢牢记住的共现。
典型话语:「每次我穿这件外套出门都会下雨——五次里有四次都是。」——五次这个分母本身,可能就已经漏掉了另外十次穿了没下雨的日子。
选择记忆
当你试图回想支持这条「规律」的证据时,脑子里快速跳出几个鲜活的画面——每一个都是 A 和 B 一同出现的场景。但当你试图回想 A 出现了而 B 没出现的例子时,脑子里一片空白——不是因为那些情况没发生过,而是因为你从没给它们分配过记忆空间。
典型感受:我能清清楚楚想起那几次对得上的——但让我想想有没有不对上的……嗯,好像还真没什么印象。
寻找例外
每当有人提出反例,你第一反应不是「这个规律可能不准」,而是为反例找一个特殊理由:「那次情况不一样」「那是个例外」「那次有其他因素干扰」。每一个反例都被单独「解释掉」,没有一个是作为「规律失效的证据」被累积起来。你为规律雇了一支辩护团队,但为反例只留了一扇旋转门——进来一个,送走一个。
典型话语:「那几次没对上,可能是因为那段时间正好在换届——情况特殊。」
未经对照
你判断「A 出现之后 B 更可能发生」的时候,从来没有去做过这样一件事:把 A 出现的全部次数列出来,把 B 出现的全部次数列出来,然后看两者重叠的比例,是否显著高于随机预期。你的判断依赖的不是对照,而是印象。而印象——如前所述——天生偏袒少数几次醒目的共现。
典型感受:这道理我明白——但我就是觉得它真的有关联。
感官说服
当你把这个规律讲给别人听时,对方觉得「好像有道理」——不是因为查过数据,而是因为那几个例子你讲得很生动,听着像那么回事。如果同一个规律用冷静的数字表格来呈现——「A 和 B 同时出现 4 次,A 单独出现 31 次,B 单独出现 28 次」——故事的魔力就瞬间消散了。虚假相关靠叙事生存,而不是靠统计。
典型感受:你把这个规律讲出来的时候自己觉得特有底气——但你没敢把它画成一张四格表给人看。
应对策略
转换口径
当你第一次感觉到「A 和 B 似乎总是连在一起」时,不要追着那些支持性的例子跑。而是立即问自己一个相反方向的问题:「A 发生了多少次而 B 没发生?B 发生了多少次而 A 没发生?」这个问题的价值在于,它在规律刚开始成形之前就撕开了一个缺口——让你意识到你所谓的「证据」,目前全部来自那张四格表中的一个格子。其他三个格子里可能写满了零——不是真的零,而是你还没有开始记录。
自问:「我脑子里记住的这几个例子,到底是全部发生过的次数,还是只是一部分——另一部分是不是因为我从来没留意过,所以压根不知道有多少?」
绘制四格
虚假相关最怕的不是复杂的统计分析,而是一张最简单的四格表:A 发生且 B 发生 / A 发生且 B 没发生 / A 没发生且 B 发生 / A 没发生且 B 没发生。下次你觉得自己发现了一条规律,立刻打开手机备忘录或笔记本,画这四行,开始往里面填数字。你会发现,填第一个格子很容易——那几个鲜明的共现画面早就等在那里了。但填另外三个格子的时候,你可能会卡住——不是数学太难,而是你缺少数据。这个卡住的瞬间,就是虚假相关失去免疫力的时刻。
自问:「如果我现在就把这四个格子画出来——第一个格子我马上能填上,另外三个,我能填吗?」
记录反例
给自己立一条规则:任何一个你准备当作「经验」长期使用的规律,必须配有反例记录。不是脑子里想一想「有没有反例」,而是实实在在地在手机或本子上开一栏:「这条规律在哪些情况中失效了。」如果三个月过去了,这一栏还是空的——问题不在规律完美,而在于你的记录方式根本就没给反例留位置。这条规则的威力不在于让你放弃所有直觉——有些直觉确实是可靠的——而在于把「检验」从脑子里搬到纸上,让选择性记忆失去藏身之处。
自问:「我是不是只记录了规律生效的次数,而从没有为它失效留下任何痕迹——不是规律没失效过,而是我没记过?」
你不需要否认自己看到的。你只需要看到那些没看到的。
—— —思辨录 · 虚假相关