你的星盘真的懂你吗?
很多人读一份紫微斗数命盘或一张星图,会觉得被说中了:正说自己爱操心,正说自己倔,正说自己在感情里总栽跟头的那种模式。这种感觉非常真实,而心理学提出的问题不是「你有没有觉得准」,而是:如果让一位占星师在事先不知道谁是谁的情况下,把星盘与真人配对,他们能比掷骰子做得更好吗?
这正是双盲实验(double-blind)被设计出来回答的问题。在这类实验里,负责配对的人不知道哪张星盘属于谁,被测试的人也不知道哪份描述是自己的。如果星盘真的含有性格信息,配对正确的比例就必须以可测量的方式超出随机水平。已发表的实验总体上没有显示出这一点。
1985 年 Carlson 发表在 Nature 上的实验:设计经占星界本人审阅
这一脉络里最著名的研究是 Shawn Carlson 的,1985 年发表在 Nature 杂志上,题为「A Double Blind Test of Astrology」。这项实验之所以被反复提及,不只在结果,还在它的准备方式:实验设计事先交给占星界代表过目并达成一致后才进行,以免事后有人说这个测试是被刻意搭建成对占星一方不利的。
实验中,占星师被要求把星盘与参与者的 CPI(California Psychological Inventory,加州心理量表)性格档案配对。结果:配对正确的比例并不高于随机水平。换句话说,在事先不知道谁是谁的情况下,读星盘并不能提供帮助区分此人与彼人的信息,比乱猜好不了多少。
Carlson 1985 同样重要的一部分是检查被测试的一方:当每份命盘解读与其他解读混在一起时,每位参与者能否认出属于自己的那一份?结果同样没有超过随机水平。这一点值得注意,因为它把两个常被混为一谈的问题分开了:占星师猜得准不准,以及当事人自己认不认得出自己。
被测试者能认出自己的星盘吗?
这个问题在二十多年后由 Alyssa Jayne Wyman 和 Stuart Vyse 独立复核,2008 年发表在 The Journal of General Psychology 上,题为「Science Versus the Stars」。研究团队使用了 NEO-FFI 测验(大五人格模型 Big Five 的一个简版)和计算机生成的星图。结果清晰地分成两部分:参与者认出自己真实 NEO-FFI 档案的水平高于随机,但认不出自己真实的占星解读。
这是一组方法上非常简洁的对照。同一群人,同一类自我识别任务,可当描述由心理测验数据生成时,人们认得出自己;当描述由占星星盘生成时,人们认不出自己。如果星盘真的含有性格信息,这一差异很难解释。
需要说清数据的范围:Carlson 1985 与 Wyman 和 Vyse 2008 都在西方进行,参与者是讲英语的人,用的是西方占星体系和西方人格测验。结果不会自动适用于越南人,也不自动适用于东方的术数体系。
大数据怎么说?
Peter Hartmann 及同事 2006 年在 Personality and Individual Differences 上发表了一项大规模研究,题目关于出生日期与性格、智力个体差异之间的关系。研究使用了两个大型数据集,其中一个约有 15000 人,检验占星学关于性格与智力随出生日期的预测是否出现。结果:没有任何占星预测超过随机水平。
更早一些,Dave Clarke 及同事 1996 年在 The Journal of Psychology 上发表了一项研究,把星座作为外向性与情绪性的决定因素来检验。这里值得注意的是,该团队不只检验太阳星座,而是排出包含月亮与上升星座在内的完整命盘,也就是预先回应了那句常见的说法:「只看太阳星座不够,得看整张星图。」结果依然没有发现占星学所预测的那种关系。
| 研究 | 样本量/数据范围 | 设计 | 主要结果 |
|---|---|---|---|
| Carlson 1985, Nature | 星盘与 CPI 档案配对,双盲;参与者自我识别 | 配对不高于随机;自我识别不高于随机 | |
| Wyman & Vyse 2008, J. General Psychology | 将 NEO-FFI 与计算机星图对照 | 认出真实 NEO-FFI 高于随机;认不出真实占星解读 | |
| Hartmann 及同事 2006, Personality and Individual Differences | 两个大型数据集,其中一个约 15000 人 | 检验占星学关于性格与智力随出生日期的预测 | 没有任何预测超过随机 |
| Clarke 及同事 1996, The Journal of Psychology | 排出含太阳、月亮、上升的完整命盘;检验外向性与情绪性 | 未发现占星学所预测的关系 |
这幅图景不是几个零散结果。Geoffrey Dean 和 Ivan W. Kelly 综述了从 1950 年代起的占星师测试,记录到结果一致地偏向阴性。方法上值得注意的是:这样的综述不只是把单项研究汇总,而是显示出一种跨越数十年、多个研究团队、多种不同设计的持续趋势。
为什么很多人仍觉得星盘「很准」?
在民间和日常经验里,人们常互相讲起星盘「说得太准了」「正说中我的性格」。这对经历者来说是真的,但它不是星盘含有性格信息的证据。被描述得准的感觉可以来自多种不同的心理机制,而这些机制并不需要星盘真的准才能运作。
有一种真实存在的效应确实由信念产生,比如相信自己属于外向型的人,从此更主动地参与社交场合,久而久之行为改变,结果也随之改变。这类效应是真实的,但它不是星盘测准了性格;它是信念改变行为,行为改变结果。区分这两件事非常重要,因为混为一谈会朝两个方向得出错误结论:要么否认一种真实存在的心理效应,要么把一种星盘并不具备的能力安到它头上。
在占星从业者与研究者一方,对上述实验有另一种读法。Gerhard A. Mayer 在 2020 年发表于 Journal of Scientific Exploration 的「Astrology and Science: A Precarious Relationship. Part 2」一文中,归类了多种可能导致测试失败的方法问题。他指出,在配对实验中,占星师必须把一种抽象结构转译成关于生活的具体描述,而这项转译工作要求创造性,容易被误解,也容易受水平不佳的写作者影响。他还举了一个在印度进行的配对实验为例,研究团队要求区分优等生与发育迟缓学生的星盘,而按 Mayer 的说法,分类结果比掷骰子还差。
这是值得一读的反对声音,它按证据分级属于 B 级:一种对异常研究抱有好感的视角,指出了方法问题,但尚未拿出一个能重复出阳性结果的新实验。Mayer 也承认,他自己曾参与一个小实验,看到结果与参与者的星盘吻合,但在样本量为一的情况下,这什么都算不上。
仍有争议之处:Ertel 的再分析
知识类别: 证据不足证据不足. 有人提出,但尚无足够的出处或研究可以确认。 五类标签Suitbert Ertel 对 Carlson 数据的一次再分析认为,存在一个原设计未能分离出来的小效应。这是少数意见:它没有被其他研究团队独立重复,主流研究界总体上仍维持从原始数据得出的阴性结论。本文把它列出来是为了透明,而不是要把它摆到已被重复的双盲结果同等的位置上。
在占星一方,对零星配对成功的案例还有另一种解释:认为起作用的因素不在星盘,而在占星师的通灵能力。Geoffrey Dean 曾从事占星,后来转向怀疑立场,他写到 Clark 那些成功的盲测时表示,它们证明的不是占星在运作,而只是占星师在运作。这种读法把问题转移到了另一个领域,而它本身也还没有坚实的证据。
本文没有说什么
本文只讨论一个很窄的问题:当让占星师在事先不知道谁是谁的条件下把星盘与真人配对时,他们能比随机做得更好吗。来自对照最严密的实验的答案是:不能。
这并不说明占星在文化上毫无意义,不说明它作为自我反思的工具没有用处,也没有对相信者或从业者作出任何评价。一个人坐下来读自己的星盘,发现多了一套思考自己的语言,这完全可能发生,而这种价值并不会被上述实验否定。实验只回答「预测准不准」的问题,不回答「体验有没有价值」的问题。
知识类别: 证据不足证据不足. 有人提出,但尚无足够的出处或研究可以确认。 五类标签关于东方体系,需要说清证据缺失之处:目前没有针对越南人的双盲实验,也没有针对紫微斗数或八字的对等实验。因此本文不会从西方占星的结果推出东方紫微斗数的结论。这是两个在理论框架、排盘方式和解读方式上都不同的体系,它们尚未用同一类测试检验过,这是文献的空白,而不是一个结论。关于如何为东方体系提出正确问题的框架,已在《紫微斗数是科学还是迷信:问错了问题,以及该问什么》一文中讨论。
