思考,快与慢
第 3 章 · 22 分钟

锚定与可得性:两条被反复检验的机制

效应量、复现记录,以及哪些结论要打折。

概念地图
锚定
先出现的数值把随后的估计拉向自己。
深色为本章概念,浅色为其他章
陪练模式
不想只是读?让它带你走一遍。
导师把这一章拆成小步,每一步先问你,再讲;你用自己的话答,它先认下对的部分再纠偏。用你自己的 AI,对话只存在这台设备上。
对话只存在本机
定位01

延伸阅读

特沃斯基与卡尼曼 · 1974 年 · 锚定与调整
提出人从一个初始值出发向目标调整,且调整不足。他们反对的是把数值估计当作独立于呈现顺序的过程;代价是「调整不足」的机制解释始终没有定论,后来出现了至少两种互不相容的解释路径。
奠基
可得性启发式 · 同期
以事例回想的容易程度估计频率。这条与锚定并列,但证据结构不同:它更依赖对「容易程度」的间接操纵,因而更难做干净的实验。
奠基
开放科学合作组织 · 2015 年 · 心理学大规模复现
对上百项已发表心理学效应做独立重复,整体复现率远低于原始文献给人的印象。它反对的是把单篇显著结果直接当作稳定事实的阅读方式;这一步把「效应存在吗」与「效应有多大」分成了两个问题。
修正
卡尼曼 · 2011 年 · 论锚定与可得性的几章
书中把两条启发式与一批启动实验并列陈述。作者本人在 2017 年公开表示,书中依赖启动研究的那部分证据强度不如他当时所信。本章按这一点分级处理证据。
本课对象
机制02

锚定

先给出一个数字,随后的数值估计就会朝它靠,哪怕那个数字明显与问题无关。这条叫作锚定效应。它在本书的所有机制里证据最硬:效应稳定、在多种任务与人群中重复出现,且在大规模复现中存活。要注意的是它的解释有两条互不相容的路线——调整不足与选择性提取,本课不在两者间站队。

机制一个先出现的数值通过成为估计的起点把随后的判断拉向自己。
可迁移性测试
换到商务谈判:先报价的一方设定了随后所有还价的活动区间。不同构的地方在于谈判里锚是有信息的(它透露对方的底线),而实验里的锚是随机的,两者的正当性完全不同。
机制03

可得性

问一类事件有多常见,人回答的是「我能多快想起一个例子」。这就是可得性。它是第 1 章替换机制的一个实例:目标属性是频率,替身属性是提取的流畅度。媒体报道的分布因此会直接改变人对风险的排序——这不是判断者不理性,而是替身属性确实被改变了。

机制提取事例的流畅度通过替代频率信息改变对一类事件的常见程度估计。
可迁移性测试
换到搜索引擎:结果第一页的密度决定了你对一个话题热度的印象,而第一页由排序算法决定,不由话题本身的规模决定。不同构的地方在于搜索结果的条数是可以直接查的,而记忆里事例的真实频率查不到。
推导04

从单篇显著到「这条结论该打几折」

本章要推出的是读这本书时最需要的一步:把「效应存在」与「效应有多大」分开,并给出打折的依据。

已发表文献偏向报告显著结果
这是选的,也是有大量证据支持的:不显著的结果更难发表。
在小样本下,通过显著门槛的估计值必然偏大
这是选的,但它其实接近算术:只有大估计值才能在噪声中显著。
复现研究的样本量与预注册程度高于原始研究
这是选的,也是二〇一〇年代之后复现项目的实际做法。
推导 · 0 / 4
推导实例05

同一句结论,两种证据等级

「锚定效应存在」与「在办公室里放钱的图片会让人更自私」都出自这本书。两句该给同样的信任度吗?
先分别问:样本量多大、有没有独立复现、效应量在复现中是否保持。
裂缝06

本章框架的裂缝

争议地形07
本书主张
锚定与可得性是稳定的判断机制,它们在大量实验中重复出现,并能预测判断偏离的方向。
另一种看法
复现危机之后的一线主张:心理学文献中相当一部分效应的实际大小远小于已发表值,部分效应无法独立复现;因此以文献综述为基础的通俗读物系统性高估了效应。
分歧扎在
分歧扎在「已发表证据能否直接当作总体证据」这一条上,而不在具体机制上。两边都同意锚定稳健,争的是那些证据结构较弱的效应该被如何对待。
什么证据能裁决
能裁决它的是逐条比对:把书中引用的实验按是否进入过大规模复现项目分组,比较原始效应量与复现效应量的比值。若两组比值接近一,说明高估不成立;若无复现组的原始效应量系统性更大,说明证据分级是必要的。
目前的证据把天平压向「必须分级」:复现项目覆盖到的效应,其复现效应量整体明显小于原始值,而锚定一类在其中相对稳健。还差的是对未被复现覆盖的效应的处理办法——不能因为没被检验就默认成立,也不能默认不成立。
可证伪化08

把「锚定」写成可预注册的检验

要检验的是「锚定」:一个先出现的数值通过成为估计的起点把随后的判断拉向自己。

数据源:新收集的估计数据,锚值由随机数生成器当场产生并记录
锚必须与目标量无关,否则测的是合理更新而不是锚定。
样本范围:事前算好的样本量全部纳入,不按作答时长或「是否认真」剔除
事后剔除是最常见的自由度入口。
时间窗口:单次实验,锚与估计之间不插入其他任务
插入任务会引入记忆衰减这个额外变量。
判据阈值:高锚组与低锚组估计值之差,效应量达到事前登记的下限
登记效应量下限而非只登记显著性——只看显著会让大样本把任何微小差异变成「支持」。
失败条件:两组差值方向相反,或效应量低于登记下限
第二种同样按推翻处理:机制存在但小到没有实践含义,与不存在在应用上等价。
推导 · 0 / 3
接口09
挂在哪个槽位
挂在哪个槽位你已有的那条结论多半是「有研究表明……」——一条把「已发表」等同于「已确立」的判断。本章要动的正是它。
本章对你已有的结构做的是 (a) 约束「有研究表明」这条结论,还是 (b) 新开一个关于证据分级的槽位?
慢变量登记两个慢变量:你引用研究时查过复现记录的比例,以及你手上有多少条结论来自单篇小样本研究。三天后先看第二个。
小结10
本章小结
01锚定是本书证据最硬的机制,在大规模复现中存活。
02可得性是替换机制的一个实例:频率被换成提取的流畅度。
03「已发表效应被高估」是发表门槛的算术后果,不需要任何人作弊。
04同一本书里的两句话可以相差一个数量级的可信度,文本本身不携带这个信息。
05锚定的成因有两条互不相容的解释,检验只能裁决效应,不能裁决成因。
提取练习 · 合上书,先自己答一遍。
?「样本越小,通过显著门槛所需的观测效应量越大」是 (a) 恒等式 还是 (b) 经验命题?
?谈判中向对方报价靠拢,属于 (a) 锚定偏差 还是 (b) 对含信息的锚的合理更新?
受迫二选一11

B 标签辨识

「已发表效应量的期望高于真实效应量」这一步是什么?
二选一
受迫二选一12

C 裂缝定位

哪个情境下本章框架会给出自信而错误的答案?
二选一
读到这里,把它记为已读。