1948年的福勒实验是怎么进行的?
1948年,加利福尼亚大学心理学家伯特伦·R·福勒(Bertram R. Forer)让他的39名学生做了一份名为「Diagnostic Interest Blank」的测验。他告诉学生,每人将收到一份简短的个性描述,是根据他们本人的测验结果单独编写的。一周后,福勒把描述发给每位学生,请他们为「与自己相符的程度」打分。
事实是,39名学生收到的都是同一份完全一样的描述,由福勒从报摊上买来的一本占星书中拼凑而成。这份描述共13句,其中包括「你有强烈的被他人喜爱和钦佩的需求」「你有自我批评的倾向」「你有许多尚未发挥、还未转化为优势的能力」「你有时外向、随和、好相处,有时又内向、谨慎、保守」。
全班打出的平均准确度是4.30分,量表从0分(很差)到5分(极佳)。直到收齐所有评分表,福勒才揭晓所有人拿到的是同一份描述。他把这一现象称为「自我验证的谬误」(fallacy of personal validation),并在1949年的论文中将其描述为一次课堂上的轻信实证。
为什么笼统的描述会让人觉得说中了自己?
核心机制在于,实验中的描述既模糊,正面比例又高,还被说成是专家根据接收者本人的测验结果得出的。这三个因素叠加,让读者自己为文字赋予意义,把一句几乎对谁都成立的话变成了对自己而言独一份的话。
重复研究表明,产生福勒效应有两个关键因素。第一是描述的内容,特别是正面与负面评价的比例。第二是接收者对反馈者诚实程度的信任。当描述模糊时,读者能在其中找到属于自己的意义,文字因此对他们变得「个性化」。
最有效的句子往往带有「有时」或「有时候」这样的词,例如「你有时非常自信,有时又一点都不自信」。这种说法几乎对任何人都成立,所以每个人都能读出自己的意思。保持这种模糊措辞,是重复研究中观察到福勒效应的前提条件。
一些证据还显示,具有权威型人格或神经质人格的人,或者被认可需求高于常人的人,更容易表现出巴纳姆效应。如果给出评价的人被视为地位很高的专家,人们也更容易接受关于自己的负面评价。
提高准确度评分的四个条件
后续研究归纳出让接收者打出更高准确度评分的四个条件:
- 接收者相信这份分析是为自己量身定制的,因而为文字赋予个人化的意义。
- 接收者相信评估者的权威。
- 分析主要列举正面的性格特征。
- 描述模糊,宽泛到足以对许多人都成立。
巴纳姆效应和福勒效应是同一个吗?
是的,这是同一现象的两种叫法,但名称的来源不同,这一点值得区分。最早研究这一现象的福勒在1949年称之为「自我验证的谬误」。
直到1956年,心理学家保罗·E·米尔(Paul E. Meehl)在随笔《Wanted: A Good Cookbook》中才提出「巴纳姆效应」这一术语。他把一些「虚假成功」心理测验中使用的模糊性格描述,与马戏团老板P·T·巴纳姆那种面向大众的娱乐话术联系起来。因此,同一现象可以叫巴纳姆效应、福勒效应,较少见的叫法是巴纳姆-福勒效应。
这一效应与冷读术及各种灵性把戏有何不同?
福勒效应是冷读术(cold reading)的核心组成部分,也就是心理魔术师、算命师、通灵者用来制造「他们很了解对方」感觉的一套技法。冷读者无需事先掌握任何信息,他们观察肢体语言、年龄、衣着、发型、性别、宗教、族裔、教育程度、说话方式、居住地,然后给出概率很高的猜测。
随后他们会强调并强化猜中的部分,同时迅速略过猜错的部分。由于读心过程中大部分时间都花在「猜中」上,而意识到「猜错」的时间被压缩,参与者就会觉得读心者比普通陌生人了解自己得多。
一种具体技法是「散弹枪式」(shotgunning):读心者抛出一连串非常笼统的信息,观察反应,再根据反应缩小范围并调整措辞。例如「我看到你家里一位父亲角色的人有心脏问题」。许多疾病都有胸痛症状,而心脏病是全球头号死因。「父亲」一词可以指父亲、祖父、叔叔、表兄,或任何曾对听者扮演过父亲角色的男性。
另一种技法是「彩虹式诡计」(rainbow ruse),即一句话同时说出某种性格特征及其反面,例如「大部分时间你很积极快乐,但也有过非常悲伤的时候」。这类句子覆盖了所有可能性,还让人觉得读心者推理精准,尽管它本身模糊且自相矛盾。性格特征本就无法量化,而几乎每个人都经历过某种情绪的兩面。
温读与热读
需要区分三个层次。冷读依靠对方的反应。温读(warm reading)是有意使用巴纳姆效应的句子。热读(hot reading)则是使用事先已知的关于对方的信息。当冷读与暗中收集的信息结合时,读心者能给人留下极强的印象,让人觉得他们知道或能接触到关于参与者的许多信息。
迈克尔·舍默(Michael Shermer)举过正在服丧者佩戴首饰的例子。处于这种境况的人,大多都戴着或随身带着一件与逝者有关的首饰。但如果在通灵场合被直接问到是否有这样一件物品,参与者可能会震惊,认为读心者是从逝者那里直接获知了这一信息。
全场观众的场景能解释多少?
来自Center for Inquiry和Independent Investigations Group的詹姆斯·安德唐(James Underdown)认为,在满场观众的场合,冷读并没有什么了不起,他用简单的数学来解释。一档典型的电视节目观众约200人,分成三个区域。保守估计每人认识约150人。
也就是说,当主持人问「谁是玛格丽特?」时,他们指望该地区约1万人的数据库里有一个玛格丽特。如果没人应答,他们就把问题扩大到全场观众,数据库超过3万人。在这么大的样本里,出现几十个叫玛格丽特的人毫不奇怪。
心理魔术师马克·爱德华(Mark Edward)讲述了自己作为灵性表演者的亲身经历。他向300人的全场观众抛出一句「一个扮小丑的人站在墓地里」。一位女士站起来,坚称他是在直接对她说话。她记得爱德华具体说过,她认识一个打扮成小丑的男人,在她家乡的墓地上献花。费了一番劝说,她才明白他并没有单独对她说,只是把这句话抛给了全场观众。因为故事听起来太私人、情境太离奇,她觉得那是冲着自己来的。
对照表:模糊句子及其对几乎人人都成立的原因
| 典型描述句 | 为什么对多数人都成立 |
|---|---|
| 「你有强烈的被他人喜爱和钦佩的需求。」 | 被认可的需求在人类中几乎普遍存在。 |
| 「你有自我批评的倾向。」 | 几乎每个人都至少自责过一次。 |
| 「你有时外向,有时又内向、谨慎。」 | 这对立的兩面覆盖所有可能,不可能出错。 |
| 「你有许多尚未发挥的能力。」 | 每个人都有未充分开发的技能或潜力。 |
| 「你有时怀疑自己的决定是否正确。」 | 对决定的怀疑是普遍体验。 |
| 「你为自己是独立思考的人而自豪。」 | 高度评价自己的独立性是常见的自我形象。 |
谁更容易受这一效应影响?
并非人人反应相同。研究表明,具有权威型人格或神经质人格的人,或者被认可需求高于常人的人,更容易表现出巴纳姆效应。一些研究还把这一效应与临床阈值以下的精神分裂型特质(schizotypy)联系起来。
需要说明的是,这些只是提高对效应敏感度的因素,并非心理上的定论。福勒效应本身是人类共有的认知特征,不是病态的标志。表现程度因人而异,而认识其机制是减弱其影响的最好方法。
如何在十分钟内自测这一效应?
最简单的验证方法是用两个人重现福勒实验本身。第一步,取一段笼统的性格描述,可以是福勒13句描述中的一段,也可以是你自己按「有时」「有时候」「你有未发挥的潜力」这类风格写的一段。第二步,把这段描述给A,告诉他这是为他单独做的分析,请他打0到5分。第三步,把同一段描述给B,也说是B的专属分析,请他打分。第四步,比较两个分数。如果两人都打了高分,你就重现了福勒效应。
另一种方法是对自己检验。读一段笼统的描述,然后自问:「这句话对我成立吗,它对我认识的大多数人成立吗?」如果第二个问题的答案是肯定的,那么觉得说中了自己,并不能证明这份描述是为自己量身定制的。这正是福勒实验的核心要点。
读一份性格描述时的四个自问
- 这份描述是说它基于我的个人数据,还是只是有人这么告诉我?
- 其中的句子是否含有「有时」「有时候」,或覆盖所有可能性的对立两面?
- 正面句子的比例是否高得不寻常?
- 如果把这份描述给一个朋友,他是否也会觉得对自己成立?
关键点:自我验证不等于验证
加利福尼亚州立大学富勒顿分校心理学教授迈克尔·伯恩鲍姆(Michael Birnbaum)评论说,福勒效应被魔术师和通灵者用于冷读,也被一些自称有心理分析专长、宣称能在几分钟内诊断嘉宾心理问题的电视人物使用。他说,真正的心理学家对这种做法深感震惊,但他们在公众面前发出的反对声音还不够强烈。
伯恩鲍姆用一句话概括巴纳姆式证明的教训:「自我验证不等于验证。」他建议读者不要被通灵者、伪治疗师或假信仰治疗师用这套手法欺骗,而应保持怀疑并要求证据。
丹尼斯·达顿(Denis Dutton)在1988年写道,遗憾的是,学术界心理学对冷读技法关注不够,因为成功的冷读实践普遍存在,正是当今社会大多数超自然能力信念的基础。他呼吁分析冷读高手所使用的技法和方法本身,而不是只把研究集中在学生身上。
福勒效应与占星、性格测验有什么关系?
巴纳姆效应可以部分解释某些被视为神秘的做法和信念为何被广泛接受,例如占星、算命、读气场,以及某些类型的性格测验。这并不意味着所有性格测验都毫无价值,而是提醒我们:一份让读者觉得「说中了自己」的描述,未必是为这个人单独编写的。
英文维基百科在「准确性与效度」(Accuracy and validity)部分有专门讨论迈尔斯-布里格斯类型指标(Myers-Briggs Type Indicator)的段落,说明这在研究界仍是争论中的话题。需要把握的是,主观的准确感与客观的准确性证据之间的区别。福勒效应恰恰存在于这两者之间的空隙里。
相关现象
巴纳姆效应是「接受现象」的一个具体例子,即人类倾向于接受几乎任何虚假的性格反馈。一个相关且更普遍的现象是主观验证(subjective validation)。常被一并提及的概念还有确认偏误、apophenia谬误(在随机数据中看出规律),以及波丽安娜原则,即人们更频繁地使用或接受正面反馈词汇而非负面词汇。
实践结论
1948年的福勒实验并不证明人类天真轻信,而是指出一个非常具体的认知特征:当一份模糊的描述被呈现为专为我们而写、出自看似有权威的人、且主要说的是好话时,我们倾向于觉得它准。这种「准」的感觉不是证据。十分钟自测法,把同一份描述给两个人并比较分数,是亲眼看到这一机制运作的最简单方式。
