心理学与误判 · 10/20
可得性Availability Heuristic
人会把例子想起得有多容易,误当成事情发生得有多频繁。
一场醒目的灾难,会让另一种更熟悉的危险退到脑后。2001年9月11日,恐怖分子劫持客机,撞向纽约世贸中心和华盛顿附近的五角大楼。此后,一些美国旅客放弃乘机,改为开车。心理学家格尔德·吉仁泽后来分析交通数据,提出恐惧航空风险促使部分旅客改为驾车的解释,但该分析没有直接测量旅客的记忆。飞机撞楼的画面不断重播,普通车祸却很少得到同样的关注。一种可能的解释是:选择交通工具时,更容易浮现的灾难画面让旅客把航空风险估得更高。
为什么成立
想起得快,会让人觉得发生得多
问英语使用者:以字母 K 开头的单词多,还是第三个字母为 K 的单词多?不少人选前者,因为按首字母找词更顺手;实际上,后者更多。人把“检索顺不顺”当成了“数量多不多”的线索。可得性的关键,是用回忆的难易替代对频率或概率的判断。
记忆既受频率影响,也受曝光影响
经常遇到的事会留下更多记忆,因此凭回忆估计频率能节省时间。但刚发生的事、画面强烈的事、反复听到的事,也更容易被想起。同一场事故看了十次报道,脑中留下的熟悉感增加,事故本身仍只有一次。记忆记录了你接触信息的方式,未必忠实反映事情发生的分布。
想起多少和想得多费劲,都能左右判断
人既会依据想起的例子,也会把搜索记忆时的费力感当作证据。要求一个人列出很多例子,反而能让他觉得这类事很少:列到后面越来越困难,他便把困难解释成“本来就没多少”。判断因此会随提问方式改变,即使现实中的频率没有变化。
把回忆换成记录,才能找回分母
估计工作失误有多常见,就查同一时期的失误次数和全部处理次数。投诉记录还要覆盖平静解决、无人公开抱怨的事件。只有把容易记住和容易遗漏的事放回同一张表,鲜明程度才不会替它们决定权重。
出处
可得性来自认知心理学。阿莫斯·特沃斯基与丹尼尔·卡尼曼在1973年发表论文,系统提出这一启发式。经典证据包括英语单词的字母位置判断:参与者把更容易检索的词类估得更多。1991年,诺伯特·施瓦茨等人的实验进一步展示了回忆难易对自我判断的影响。
换个领域看
技术工作
故障抢走预算
留下深刻印象的故障,会挤走更常发生的小错误。技术负责人记得三次让团队熬夜的服务中断,便认定它是最常见的问题,准备把改进预算全投给服务器。翻查同一个月的记录,却发现还有二十次输入错误,每次都让客户返工。先按发生次数排,再按损失排,两张表会给出不同的优先顺序。
投资
赢家占满记忆
几个容易讲述的暴涨故事,会让投资者高估下一次暴涨的概率。一位投资者刷到三篇股票翻倍的复盘,聚餐时又听朋友讲了一遍,便觉得翻倍机会遍地都是。动手买入前,他查了同一时期、同类股票的完整涨跌分布。重复听见的赢家终于各算一次,没上过热搜的普通回报也进入了判断。
个人生活
列得多反而少
回忆更费劲,能让人把自己的行为估得更少。1991年,施瓦茨等人让参与者回忆自己敢于表达立场、坚持自身主张的经历,一组列六件,另一组列十二件。列十二件的人觉得任务更难,随后反而把自己评得较不敢坚持主张。虽然列出的事更多,他们却把“想不出来了”的感觉当成了判断自己的证据。
遇事时问自己
- 我觉得它常见,是因为查到了发生次数,还是因为几个例子一下就浮现出来?
- 这些例子来自几次独立事件,有没有同一件事被反复报道?
- 在同一人群和同一时期里,全部机会有多少,实际发生了多少次?
- 哪些平静、普通、无人讲述的事件没有进入我的记忆?
- 如果最近那件醒目的事没发生,我会怎样估计这件事的概率?
边界与误用
当经验来自稳定环境、接触机会相近且反馈及时,容易想起确实能帮助估计频率,例如店员判断每天哪些商品最常被问到。环境改变、报道偏向或经历过少时,这条捷径就会失准。最常见的误用,是见到醒目事件便认定它被高估,甚至直接忽略它。一次罕见事故也能揭示新的故障原因;发生概率低但后果致命,也足以支持防护。纠正可得性,要把发生概率和后果大小各自摆出来,而不是按新闻热度决定相信或反对。
练一练
部门主管最近听了两次新人交付延期的详细复盘,觉得这一届新人比上一届更常延期。上一届也做过复盘,但他已经记不清。两届新人承担的任务数量不同,按时交付的任务很少在会上讨论。
要判断这一届新人是否更常延期,哪一步最有用?
统一筛选规则让会议记录更容易比较。但两届任务总量不同,只数被讨论的延期仍缺少分母。
延期次数要除以全部任务数,才得到延期比例。任务难度和统计时期相近,比较才有意义。
严重延期损失大,值得关注。但损失金额回答的是影响多大,题目问的是发生多频繁。
主管了解团队,回忆案例看起来能快速补齐信息。但近期复盘更容易想起,案例数会受记忆偏向影响。
近期讲得详细的延期更容易浮现,主管便把记得清楚当成发生得多。这是可得性影响频率判断的方式。查完整记录、比较延期占比,才能检验这个印象。
一项饮食习惯调查把参与者随机分成两组。一组回忆最近一个月自己做饭的三次经历,另一组回忆十次。十次组列到后面明显吃力。厨房记录显示,两组实际做饭的天数占比相近;参与者回答时没有查看记录。
随后让大家评价自己是否经常做饭,最可能出现哪种结果?
三个例子看起来证据较少。但数量由题目规定,轻松想起三次反而会让人觉得自己常做饭。
列出的经历更多,看起来支持更高频率。但十次组回忆吃力,这种困难感会把判断拉向相反方向。
实际比例接近,确实说明两组习惯相似。但回答者没有查记录,评价会受刚才回忆是否顺手影响。
十次组容易把“想起来很费劲”解释成“平时做得不多”。回忆任务更难,会压低他们对自身频率的评价。
可得性既涉及想起多少,也涉及想起来有多费劲。十次组把搜索记忆的困难当成做饭较少的线索。实际习惯相近,回忆任务却让自我评价出现差异。
一座桥的裂缝视频在网上反复传播。检测人员随后确认,一根关键构件已经断裂,当前承载能力低于日常车辆荷载,建议立即封桥。有人反对:“大家只是被视频吓到了,这座桥过去二十年都没出过事故。”
哪种判断最站得住?
长期安全记录让人安心,也提供了历史背景。但构件已经断裂,桥的当前状态发生了变化。
传播增加容易让人觉得危险正在逼近。但重复转发增加的是曝光次数,事故概率要由桥的状态来判断。
检测直接比较了当前承载能力和车辆荷载。封桥有具体的工程依据,也能避免断裂造成的严重后果。
等情绪平静再判断,听起来更冷静。但承载不足已经得到检测确认,等待不会修复断裂的构件。
这里用错模型的是把公众恐惧当成反驳检测结果的理由。可得性解释的是回忆如何影响频率判断;新的结构故障则提供了直接的风险证据。判断应落在当前承载能力、车辆荷载和事故后果上。