1966 年,伦敦大学学院的彼得·沃森在桌上摆了四张牌,正面是字母,背面是数字:D、K、3、7。规则是一句话:"如果一面是 D,那么另一面是 3。"问题只有一个——为了检验这句话是真是假,你最少需要翻开哪几张?
逻辑上的答案是 D 和 7:只有"D 的背面不是 3"或"7 的正面是 D"才能推翻它。翻 3 毫无用处——无论背面是什么,都不构成反例。可绝大多数人翻的偏偏是 D 和 3。在这个抽象版本上,答对的人通常不到一成,而受试者是当时最好的大学里的学生。
比错误率更古怪的是第二件事:他们说不出自己为什么这样选。沃森追问理由,得到的解释常常与他们实际做的事对不上——像是先有了答案,理由是回头补的。
1975 年,沃森与他的学生乔纳森·埃文斯把这件怪事逼到了墙角。他们把同一条规则改写成带否定的形式("如果一面不是 D……"),发现选择模式并不跟着逻辑走,而是跟着题面上出现过的符号走——句子里提到过的东西就被翻,没提到的就不被翻。他们把这叫作匹配偏差。
一条规则,逻辑结构没变,只换了措辞,答案就跟着变——这几乎逼出了唯一的解释:做选择的和讲道理的,不是同一套东西。先有一套不请自来的过程,把"看起来相关"的项挑出来;再有一套费力的过程,去处理已经被挑出来的那些。那篇论文的标题就是这个意思:推理中的双重过程?——带问号的。
此后二十五年,这个问号被拆成了一整个纲领:斯洛曼1996 年给出"联想式 vs 规则式"的证据清单;斯坦诺维奇与韦斯特2000 年给这两套东西起了后来传遍全世界的名字——系统一与系统二;2011 年丹尼尔·卡尼曼用一本畅销书把它送进了每一间会议室。而 2013 年,埃文斯与斯坦诺维奇写了一篇为它辩护、同时也把它大幅削薄的文章——这门学问最重要的一次自我整顿。
这一节的两块材料方向相反,缺一不可。第一块告诉你这个理论真正主张什么(比流行版本窄得多),第二块是最著名的普及者亲手贴上的警告标签。
先做一道题,别算,说出脑子里蹦出来的第一个数:
一支球棒和一个球一共 1.10 元。球棒比球贵 1.00 元。
那么球多少钱?
几乎所有人第一反应都是 0.10 元。而正确答案是 0.05 元(球棒 1.05,差正好是 1.00)。这道题的妙处不在难——它的算术是小学水平——而在于:0.10 这个答案是自己送上门的,而且送上门时不带任何"我可能错了"的标记。
流行版本会说:这是"系统一"太快,"系统二"太懒。这句话方向对,但把分界线画错了。埃文斯与斯坦诺维奇的定义要窄得多、也硬得多:区别不在快慢、不在有没有意识、更不在"感性与理性",而在于它要不要占用工作记忆。
有一个近乎实操的判据:你能不能一边做它,一边心里默背一串七位数?能,那多半是类型一——认字、看见熟人的脸、听母语、开熟路、下意识地觉得某个报价"不太对劲"。不能,那就是类型二——心算、比较两份合同、把一句话翻成外语、在脑子里推演"如果我这么说,他会怎么回"。
类型二真正独一无二的本事,叫认知解耦:在脑子里搭一个沙盘,同时清清楚楚地知道沙盘不是真的。设想一个反事实、演练一次尚未发生的对话、把自己的判断当成"一个待检验的假设"而不是"事实"——都靠它。这件事非常费力,所以它默认不开机。
接下来是三个最容易读反的地方,也是本篇后面所有内容的骨架:
一、快不等于错,慢不等于对。老消防员"觉得该撤"的那一秒钟,往往比新手推演十分钟更准。
二、类型二更常见的角色不是纠错,是辩护。它经常被用来给已经蹦出来的答案找理由,而不是推翻它。
三、它们不是接力赛。很多时候两者并行,而且直觉里本来就藏着逻辑——你在给出错误答案的那一刻,身体已经知道不对劲了。
最后一句留在这里,第四节由它接手:这门学问最有价值的部分,从来不是"人有两个脑子",而是它逼你追问——我此刻这个判断,究竟是被计算出来的,还是被送上门的。
抽象版的沃森选择任务,正确率通常不到一成。但把完全相同的逻辑结构换一层外衣,情况就完全不同了。
1982 年,理查德·格里格斯与詹姆斯·考克斯用了一个后来被引用无数次的版本:"如果一个人在喝酒,那么他必须年满 18 岁。"四张牌分别写着"在喝啤酒"、"在喝可乐"、"22 岁"、"16 岁"。多数人立刻就翻对了——喝啤酒的那张,和 16 岁的那张。
逻辑形式一模一样,难度天差地别。1989 年,勒达·科斯米德斯据此提出一个更强的主张:人对"作弊者检测"这类社会契约结构有专门的、进化而来的直觉,抽象条件句反而是人类心智不熟悉的题型。
谢恩·弗雷德里克把三道题打包成认知反射测验(CRT),球棒与球是其中第一道。在跨校的大样本里(约 3400 余名大学生),结果颇为难堪:麻省理工的学生平均答对 2.18 题(满分 3 题),普林斯顿 1.63,哈佛 1.43。在球棒与球这一道上,这些学校也有相当比例的学生给出了 0.10。
这道题的算术难度对他们来说等于零。失分的原因不是不会算,是没有意识到需要算。
典型的实验题长这样:在 1000 人的样本里,有 995 名律师和 5 名工程师。随机抽到的杰克安静、爱摆弄数字、不喜欢社交——他更可能是工程师还是律师?大多数人答"工程师",忽略了那个压倒性的基础比率。
维姆·德内斯与同事把这些答错者的过程记录下来,发现了一件反常识的事:与"基础比率和描述不冲突"的对照题相比,答错者在这类冲突题上反应时更长、对自己答案的信心更低,眼动记录显示他们的目光会回到那两个被"忽略"的数字上。
换句话说:他们不是没看见 995 这个数字,他们看见了,甚至感到了不安,然后还是说了"工程师"。
笛卡尔认为,人先理解一个命题,再决定信不信;斯宾诺莎认为,人理解即相信,"不信"是随后另加的一道工序。丹尼尔·吉尔伯特与同事做了一个实验来分这个胜负。
受试者阅读关于两起犯罪的陈述,其中一些被明确标注为假的。一半受试者在阅读时被一个按键任务打断,占住工作记忆。随后请他们为罪犯量刑。
结果是:被打断的那组,会把标为"假"的加重情节当成真的用进去——当那些假陈述对被告不利时,他们判出的刑期明显更重。没被打断的一组则不会。
心理学界曾有两条互相看不上的路线:一条专门证明专家直觉不可靠(卡尼曼一派),一条专门研究消防队长、护士、飞行员如何在几秒钟内做出正确判断(加里·克莱因的自然决策学派)。
2009 年,卡尼曼与克莱因合写了一篇文章,副标题是——《一次未能达成的分歧》。他们发现自己其实没什么可吵的,因为答案是条件性的:直觉可不可信,取决于两件事。
一、这个环境有没有足够稳定的规律可学?
二、这个人有没有通过长期练习,获得过快速、清晰、可靠的反馈?
火场有规律,且反馈立刻到来——所以老消防队长那句"我们得出去"值得信。长期股市、政治预测、面试识人,规律稀薄或反馈迟到失真——在那里,几十年的经验也长不出可靠的直觉,只长出可靠的自信。
这一节的第一条是这个理论近十年遭到的最猛一击,第二条来自它最著名的普及者本人,第五条是它在日常里最贵的一次误用。
正确的姿势:把它当一副追问来源的眼镜,而不是一张给人分类的量表。它值得你问的只有两句——这个判断是被算出来的,还是被送上门的?我此刻所在的环境,配不配得上我对自己直觉的这份信任?
而它最硬的一课是那句反常识的提醒:慢下来本身没有价值。慢下来只有在一件事上有价值——你打算用这段时间去检验那个答案,而不是去给它写辩护词。
先立边界:下面五条里,第一条与第三条有明确的经验证据支撑,其余是从这套框架里长出来的判断习惯,不是实验结论。
乔纳森·埃文斯是从沃森那张桌子上一路走过来的人。他的启发式—分析理论把推理拆成两步:先由一套前意识的启发式决定"哪些信息看起来相关",再由分析过程对这些被挑剩下的信息动手——于是偏差的真正源头不在推理本身,而在推理开始之前那一次无声的筛选。
他后来把主流形态命名为默认—干预式(default-interventionist):类型一先给出一个默认答案,类型二有权干预,但默认不行使这个权力。
而他反复提醒的一点最扎人:当类型二真的动起来时,它做的事往往不是推翻默认答案,而是替它把理由补齐。这正是 №033 在推理实验室里的样子。
史蒂文·斯洛曼1996 年在《心理学公报》上做了一件方法论上的关键事:他没有满足于罗列"直觉与理性"的对比,而是问——凭什么说这是两套东西,而不是一套东西的两种状态?
他给出的判据干净得像一把尺子:如果一个人能够同时相信两个互相矛盾的答案——明知道两条线一样长,却仍然看见其中一条更长——那就不是"一套系统换了个档位",而是两套东西在同时输出。
他把二者刻画为联想式(按相似与共现计算)与规则式(在符号结构上运算)。这个划分与后来的"类型一/类型二"不完全重合,但那把尺子留了下来:并存,而不是接力,才是两套过程的证据。
基思·斯坦诺维奇与理查德·韦斯特2000 年那篇长文(正是"系统一/系统二"这两个标签流行开来的地方)走的是一条别人没走的路:不看平均值,看个体差异——什么样的人不会掉进这些陷阱?
答案让人不太舒服:认知能力确实有帮助,但远没有想象中那么大。很多经典偏差在高智商人群里照样成立。他后来为此造了一个词——理性障碍:聪明,却系统性地不理性。
他的解释是"三分心智":自主心智负责送答案,算法心智负责有没有算力去解耦,反省心智负责要不要去用那份算力。智商测的是第二层——而决定你会不会在球棒与球那道题上翻车的,是第三层。与 №012 同处一条元认知的线上。
如果说前三家在细化这个理论,维姆·德内斯做的是把它的叙事翻了个面。传统故事是:愚蠢的直觉给出错答案,明智的推理有时来救场。德内斯问:人在答错的那一刻,真的一无所知吗?
证据说不是。当直觉答案与逻辑冲突时,即便最终答错的人,也表现出明确的冲突信号:反应时变长、对自己答案的信心显著下降、目光重新回到那条被忽略的关键信息上。他们察觉到了不对劲——只是没能把它变成一个不同的答案。
他称之为"聪明的直觉者":逻辑与概率的某些知识本身已经直觉化了,会自动激活。于是真正的问题被改写了——不是"人为什么察觉不到",而是"察觉到了为什么压不住"。这一改,把责任从"无知"挪到了"抑制"。