你估的那个「八成没问题」,事后回头看,真有八成准吗?


过度自信

我们对自己判断的准确性通常有着过度饱满的把握,这种自信程度往往大幅超越了实际的正确概率。过度自信常让我们在决策中低估未知变量,做出激进决定。

#八成没问题#我怎么可能错#事后才知道
01

寓言故事

老葛守了二十年桥——沿河上下七座石拱桥。最老的造于道光年间,石栏上的莲花已磨得只剩轮廓;最新的也有八十年了。七座桥他都能叫出名:双孔桥、歪脖子桥、碾房桥、大枫树下那座。哪块石头松了、哪条缝活着、哪座桥墩三年没动——这些在他脑子里,手指一摸就知道了。

每年谷雨前后,老葛沿着河走一整天——从第七桥到第一桥,在每座桥上蹲下来,把桥墩、桥栏、拱券的接缝用手指摸一遍。摸完回到小屋,喝掉半杯浓茶,铺开纸,写下七座桥的名字,用毛笔标上序号。一号最需要修,七号最不急。

他写这份报告从不划掉重写。二十年,二十份。落笔前他在脑子里把七座桥过一遍——裂缝有没有变宽、墩基有没有新水痕——然后一口气写到底。他为自己这份准头感到踏实。「手比眼睛老实,」他常对来视察的干部说,「摸过就知道。」

两年前秋天,县里分来一个见习员叫小舟。二十出头,不多话,每天跟在老葛后面提工具箱,在他摸桥缝时蹲在旁边看。老葛摸完会随口说一两句——「这块石头明年要换」「这缝去年两指宽,今年还是两指」。小舟点点头。她有个蓝布面本子,每晚坐到小屋石阶上,借着窗口灯光往上写几行字。老葛从没问过她写什么。

这年汛期来得早。谷雨才过五天,上游连下了三夜暴雨。河水一夜之间涨过了碾房桥的拱券,裹着泥沙和断枝往下游冲。老葛站在河边看了整整一个上午。

水退了。老葛排第一的双孔桥安然无恙——水从两孔之间分过去,稳稳当当。塌的是歪脖子桥——排他名单最末,第七号。半边石栏连着桥面被整块掀走,断在河滩浅水里,像一只侧躺的石兽,脊背上覆着黄泥。

老葛在河边站了很久。他蹲下来摸断裂的茬口——断面颜色比桥面浅得多,几乎发白。这条裂缝已在石头里养了许多年,被他手指反复摸过的位置,离真正的断裂面差了半块石头的厚度。

那天晚上,老葛把墙上去年的报告揭下来。他把小舟的蓝皮本子推到桌角——工具箱和搪瓷杯之间。铺开新纸,重新给七座桥排序。写到第三座时停了一下——笔尖在纸上悬了两秒,又继续写下去。

小舟的蓝皮本子摊在桌角。风从窗缝吹进来,掀开的第一页停在春天一个日期下面——那条永远两指宽的缝,旁边画了一个小小的、工工整整的「×」。

感觉准不等于真的准,把握感往往超前于准确度。

02

核心定义

过度自信效应是指我们对自己判断准确度的主观评估系统性地高于客观实际——简单说,就是「以为自己有多准」和「实际有多准」之间,存在一条稳定且顽固的差距。它不是一个偶尔的误判,而是一种可重复、可量化的认知偏差:当人们说「我九成把握」时,实际准确率常常不足七成;当人们说「我百分之百确定」时,犯错的比例仍然高得让人意外。

这个概念由心理学家利希滕斯坦(Sarah Lichtenstein)和菲施霍夫在 1977 年通过一系列校准实验首次系统验证。他们让被试回答常识性问题,并要求对自己的每一个答案给出一个「正确概率」的评估。结果出现了一种稳定的模式:被试的置信度几乎总是高于实际正确率,而且当置信度最高(「绝对确定」)时,偏差反而最大——那些被标记为「百分之百确定」的答案里,大约有四分之一是错的。

过度自信之所以危险,不是因为人们会犯错——每个人都会犯错——而是因为它让犯错的人同时失去了「发现错误」的机会。一个正确地知道自己不确定的人,会去查、去问、去留余地;一个错误地以为自己很确定的人,会在错误的判断上继续搭建后续决策,一层一层,直到偏差被放大到肉眼可见。它不是判断的失误,而是判断系统本身的校准失灵。

来源

过度自信效应的研究是「启发式与偏差」研究计划的一部分——卡尼曼(Daniel Kahneman)和特沃斯基(Amos Tversky)在 1970 年代早期提出了认知启发式的基本框架,利希滕斯坦和菲施霍夫在此基础上首次用校准实验精确测量了自信度与实际表现之间的系统性偏差。这一发现后来成为行为经济学和决策科学中最稳健的效应之一,在不同文化、年龄层和专业领域中反复被验证。

常见表现形式

过度精确

我们给出的数值估计区间太窄——比如对某个股票的年末价格预测,我们觉得「九成把握在 50 到 60 块之间」,但实际价格常常跑出这个区间。我们低估了世界的不确定性。

过度定位

在和别人比较时,我们系统性地把自己放在高于平均的位置——比如百分之八十的司机觉得自己的驾驶技术「高于平均水平」。数学上这不可能,但主观感受上这很真实。

过度确信

对判断本身的信心过高——「肯定是他干的」「这件事一定是这条路」。这种确定性并非来自证据的强度,而是来自大脑给这个判断打了过高的置信度分数。

03

真实案例

职场

一个永远完不成的时间表

团队会议上,项目经理把完成日期推到一个让所有人都觉得「有点紧但应该可以」的位置。三个月前他也是这么说的。六年前他刚接手第一个项目时也是这么说的——那个项目超期了整整四个月。但此刻,他站在白板前,用马克笔在日期下面画了两道加重线,说:「这次我仔细算过,没有问题。」

「这次不一样——上回是意外,这回我把所有风险都考虑进去了。」

投资

跑赢市场是每一个人的错觉

你打开股票账户,看了一眼今年的收益率——比大盘高。你关掉页面,心里一阵踏实。但你从来没有算过:你的收益里有多少是选股的功劳,有多少只是大盘普涨的潮水把所有的船都托起来;你的亏损记录里,你卖在最低点的那些股票,为什么从来不在你的「投资总结」里出现;你去年最得意的那笔操作,如果反向操作,现在的收益相差多少。

「我对这家公司的了解比市场深——他们没看到我看到的。」

日常生活

考前那个「差不多了」的错觉

考试前一天的晚上,你合上书,觉得「应该没问题」。你甚至能说出哪些章节考的概率大、哪个题型十有八九会出。第二天拿到试卷,翻到第三道大题的时候,你愣了一下——那个你只在目录里扫了一眼的章节,占了整整二十分。你回想起昨晚的「应该没问题」,但此刻的笔尖已经落在了答题纸上,没有回头路了。分数出来后,你比预估低了三个等级。

「我以为复习到了——这东西我明明见过。」
04

正误对照

场景

期末大考结束后,你走出考场,和室友聊起刚才的试卷。室友问你考得怎么样,你心里默估了一下——觉得大概能拿八十五到九十分。室友也一样。

过度自信主导
「你刚才那套卷子考得怎么样?估计能拿多少?」 乙:「我估计八十五往上吧——大题我都复习到了,选择也就两三道拿不准。应该差不多。」
乙的「应该差不多」是一个未经校准的直觉——他没有区分「复习过」和「掌握了」、「见过」和「能独立做对」。他把所有复习时主动或被动接触过的内容都默认计入了得分,但实际考试中「见过」和「做对」之间有一道很宽的鸿沟。他还忽略了每次考后「我以为考得不错结果差很多」的历史经验——那些经验没有进入他的校准系统。
理性回应
「你刚才那套卷子考得怎么样?估计能拿多少?」 乙:「说实话我不太好说。大题确实都复习到了,但我翻了一下手机——上个学期期中我也觉得能考八十五,最后才六十八。我现在说八十,先在心里给它打个折,可能七十左右比较稳。」
乙的回应多做了一步关键的认知操作:他调用了一个外部校准参照点——自己的历史预测偏差。他没有放弃直觉判断(「八十」),但他用过去的实际数据对这个直觉打了折扣。他没有变成完美的自我评估者,他只是把一次性的感觉比对了一个可追溯的记录。这一步就是校准系统开始工作的样子。
05

运作机制

01

社会信号

在进化环境中,展示自信曾经是一项高效的策略。一个在不确定情境下表现得笃定的人,更可能获得群体的信任、领导权和配偶选择权——即使他的笃定并没有更高的准确率作基础。进化心理学认为,过度自信可能是一种「信号策略」:发出信心信号的成本很低(只是感觉良好而已),收益却可能很高(获得资源和社会地位),而保持精确自我评估反而要付出认知成本。因此自然选择可能偏向了一种过度自信的基因型——不是因为它让判断更准,而是因为它让生存机会更大。


02

内部通胀

当我们完成一个判断时,大脑会自动生成一个「确信度」信号——一种主观的、即时的心理感受。但这个信号的生成机制存在系统性偏斜:它更依赖信息处理的流畅度(「想得快就是对的」),而不是信息的真实质量。认知研究表明,如果一条信息在脑中快速、连贯地浮现,我们就会对它产生更高的确信感——哪怕这条信息本身是错误的、不完整的,或者来源于一次偶然的联想而非可靠的推理。大脑的「内部评分卡」给的分数,几乎总是比外部标准的高。这不是作弊,而是评分系统的设计缺陷。


03

选择记忆

过度自信有一个强大的自我维护机制:我们天然地更善于记住自己说对的事,而遗忘或重新解释自己说错的事。如果一个人对十件事做了预测,其中六件落空、四件命中,当他事后回忆时,那四件命中的会显得格外清晰和突出——「你看,我当时就说了」;而那六件落空的会变成「当时情况变了」「我没把话说死」「其实也不算全错」。这个选择性记忆的过程不需要任何主观欺骗——它自动运行,像一个只拍摄胜利画面、自动跳过败局的内部纪录片。每一次成功的记忆回放,都在为下一轮过度自信追加筹码。

06

信号识别

01

超常自信

判断的语气很笃定,但被追问一句「你的依据是什么」时,回答变成笼统的经验描述(「我做了二十年了」「我见的多了」),而非具体的、可核对的证据。自信的响度远远盖过了证据的密度。

典型话语:「不用算了——我心里有数。」

02

单点预测

给出的预测总是一个精确的点,而不是一个范围。比如「三个月完成」「成本一百二十万」——没有上下界,没有「视情况而定」的缓冲。这种精确感本身就是信号:在高度不确定的领域里,精确的预测往往比模糊的预测更不可靠。

典型话语:「我敢打包票——就是这个数,错不了。」

03

没有存档

当你问「你之前有没有类似的预测?结果怎么样?」,对方要么不记得、要么重新解释、「要么那次情况特殊」。没有可追溯的记录,每一次新的判断都像一个全新的、与过去无关的独立事件。

典型感受:你忽然意识到,你对自己的预测从来没有做过「事后对账」。

04

外在归因

预测落空时,第一反应不是「我的判断模型需要调整」,而是「出现了意外因素」「信息不够全」「别人执行出了问题」。失误总是被归因为外部的、临时的、仅此一次的因素——这些因素不会威胁到下一次判断的自信。

典型话语:「谁能想到出这种事——这谁也算不到。」

05

秒速确信

对于一个复杂问题,从接触到给出确信判断之间的时间极短——问题还没听完,答案已经在嘴边排好了队。这种「秒速确信」在简单问题上可能是专家直觉,但在复杂问题上往往是过度自信的信号。

典型感受:你听到问题的那一瞬间,心里已经有一个毋庸置疑的声音说「就是它」。

07

应对策略

01

带误差条

强迫自己用区间而不是单点来表达预测和判断。不是「三个月完成」,而是「三到五个月」;不是「成本一百二十万」,而是「一百万到一百六十万」。区间越窄,越需要警惕——强行要求在每次预测时给出一个最宽区间(「如果出错,可能错到什么程度」),相当于给直觉预设了一条减速带。

自问:「如果这件事最终证明我错了,最可能错在哪个方向上——快了还是慢了?多了还是少了?」

02

建对照表

找一个本子或一个电子表格,专门记录重要的判断和预测。左边写预测内容和当时的置信度(「我八成把握」),右边留空,等结果出来后再填真实结果。三个月后回头看——这是整个练习中最关键的一步。大多数人第一次做这件事时,会发现自己的「八成把握」和实际准确率之间有一条让人不太舒服的缝隙。这种不舒服,就是校准系统开始工作的信号。

自问:「上个月我最笃定的那个判断,现在回头看,结果对了几成?」

03

设触发器

制定一条个人规则:当你的确信度超过某个阈值(比如「九成把握」),强制自己做一件事——找一个懂行但立场不同的人,请他只用一句话说出「你可能错在哪里」。你不需要同意他,也不需要改变判断,只需要完整地听完那一句话。这个规则的要点不在于你真的会改主意,而在于你在最高自信的时刻,允许外部信息进入——哪怕只进入一秒钟。

自问:「如果有一个和我水平差不多、但结论完全相反的人坐在我对面,他会用哪一条理由反驳我?」

那本从不翻开的账本里,记的不是错误——是一张张没能用上的校准单。

—— —思辨录 · 过度自信

09

参考文献