LESSON 062 · PSYCHOLOGY

双重过程理论

Dual-Process Theory · 快的那个不是笨的,慢的那个不是对的
提出者
埃文斯 / 斯坦诺维奇(沃森为先声)
年份
1975 / 2000 / 2013
领域
心理 · 认知科学 · 推理
俗名
系统一与系统二
一 缘起 · 四张牌,和说不出理由的聪明人 ORIGIN

1966 年,伦敦大学学院的彼得·沃森在桌上摆了四张牌,正面是字母,背面是数字:D、K、3、7。规则是一句话:"如果一面是 D,那么另一面是 3。"问题只有一个——为了检验这句话是真是假,你最少需要翻开哪几张?

逻辑上的答案是 D 和 7:只有"D 的背面不是 3"或"7 的正面是 D"才能推翻它。翻 3 毫无用处——无论背面是什么,都不构成反例。可绝大多数人翻的偏偏是 D 和 3。在这个抽象版本上,答对的人通常不到一成,而受试者是当时最好的大学里的学生。

比错误率更古怪的是第二件事:他们说不出自己为什么这样选。沃森追问理由,得到的解释常常与他们实际做的事对不上——像是先有了答案,理由是回头补的。

1975 年,沃森与他的学生乔纳森·埃文斯把这件怪事逼到了墙角。他们把同一条规则改写成带否定的形式("如果一面不是 D……"),发现选择模式并不跟着逻辑走,而是跟着题面上出现过的符号走——句子里提到过的东西就被翻,没提到的就不被翻。他们把这叫作匹配偏差。

一条规则,逻辑结构没变,只换了措辞,答案就跟着变——这几乎逼出了唯一的解释:做选择的和讲道理的,不是同一套东西。先有一套不请自来的过程,把"看起来相关"的项挑出来;再有一套费力的过程,去处理已经被挑出来的那些。那篇论文的标题就是这个意思:推理中的双重过程?——带问号的。

此后二十五年,这个问号被拆成了一整个纲领:斯洛曼1996 年给出"联想式 vs 规则式"的证据清单;斯坦诺维奇与韦斯特2000 年给这两套东西起了后来传遍全世界的名字——系统一与系统二;2011 年丹尼尔·卡尼曼用一本畅销书把它送进了每一间会议室。而 2013 年,埃文斯与斯坦诺维奇写了一篇为它辩护、同时也把它大幅削薄的文章——这门学问最重要的一次自我整顿。

二 原典 · 一份定义,和一句免责声明 THE PRIMARY TEXT

这一节的两块材料方向相反,缺一不可。第一块告诉你这个理论真正主张什么(比流行版本窄得多),第二块是最著名的普及者亲手贴上的警告标签。

EVANS & STANOVICH, 2013 · 判据只有一条
类型一(Type 1)过程是自主的:一旦触发条件出现就自行运转,不需要工作记忆,也不受意图控制。
类型二(Type 2)过程的定义特征只有一条——它占用工作记忆;其核心能力是认知解耦与假设性思维:在脑中运行一个"假如……"的模型,同时不把这个模型当成现实。

作者同时做了一件减法:他们主张放弃"系统"这个词而改称"过程/类型",并明确指出——快、无意识、自动、进化古老、并行这一串属性并不必然捆绑在一起,它们只是典型的相关物,不是定义。把它们列成两栏对照表,是这个理论最常见的教科书式误传。
Jonathan St. B. T. Evans & Keith E. Stanovich《Dual-Process Theories of Higher Cognition: Advancing the Debate》Perspectives on Psychological Science 8(3), 2013, pp.223–241。(文意转述)思想源头见 P. C. Wason & J. St. B. T. Evans《Dual processes in reasoning?》Cognition 3(2), 1975, pp.141–154。
KAHNEMAN, 2011 · 它们是虚构人物
"System 1 and System 2 are so central to the story I tell in this book that I must make it absolutely clear that they are fictitious characters. Systems 1 and 2 are not systems in the standard sense of entities with interacting aspects or parts."

——"系统一"和"系统二"在本书里如此核心,以至于我必须把话说到最白:它们是虚构人物。它们不是通常意义上那种由相互作用的部件构成的'系统'。"他接着说,应当把这两个名字当作昵称来用,像"老张"和"老李"一样——它们让作者好写,也让读者好懂,仅此而已。
Daniel Kahneman《Thinking, Fast and Slow》Farrar, Straus and Giroux, 2011, 第二部分导言。(英文为原书引语,中文为译文)
三 释义 · 分界线不在快慢,在占不占用工作记忆 PLAIN MEANING

先做一道题,别算,说出脑子里蹦出来的第一个数:

一支球棒和一个球一共 1.10 元。球棒比球贵 1.00 元。
那么球多少钱?

几乎所有人第一反应都是 0.10 元。而正确答案是 0.05 元(球棒 1.05,差正好是 1.00)。这道题的妙处不在难——它的算术是小学水平——而在于:0.10 这个答案是自己送上门的,而且送上门时不带任何"我可能错了"的标记。

流行版本会说:这是"系统一"太快,"系统二"太懒。这句话方向对,但把分界线画错了。埃文斯与斯坦诺维奇的定义要窄得多、也硬得多:区别不在快慢、不在有没有意识、更不在"感性与理性",而在于它要不要占用工作记忆。

有一个近乎实操的判据:你能不能一边做它,一边心里默背一串七位数?能,那多半是类型一——认字、看见熟人的脸、听母语、开熟路、下意识地觉得某个报价"不太对劲"。不能,那就是类型二——心算、比较两份合同、把一句话翻成外语、在脑子里推演"如果我这么说,他会怎么回"。

类型二真正独一无二的本事,叫认知解耦:在脑子里搭一个沙盘,同时清清楚楚地知道沙盘不是真的。设想一个反事实、演练一次尚未发生的对话、把自己的判断当成"一个待检验的假设"而不是"事实"——都靠它。这件事非常费力,所以它默认不开机。

接下来是三个最容易读反的地方,也是本篇后面所有内容的骨架:

一、快不等于错,慢不等于对。老消防员"觉得该撤"的那一秒钟,往往比新手推演十分钟更准。
二、类型二更常见的角色不是纠错,是辩护。它经常被用来给已经蹦出来的答案找理由,而不是推翻它。
三、它们不是接力赛。很多时候两者并行,而且直觉里本来就藏着逻辑——你在给出错误答案的那一刻,身体已经知道不对劲了。

最后一句留在这里,第四节由它接手:这门学问最有价值的部分,从来不是"人有两个脑子",而是它逼你追问——我此刻这个判断,究竟是被计算出来的,还是被送上门的。

四 后人之论 LATER INTERPRETATIONS
乔纳森·埃文斯 1984 起 · 从匹配偏差到"默认—干预"

乔纳森·埃文斯是从沃森那张桌子上一路走过来的人。他的启发式—分析理论把推理拆成两步:先由一套前意识的启发式决定"哪些信息看起来相关",再由分析过程对这些被挑剩下的信息动手——于是偏差的真正源头不在推理本身,而在推理开始之前那一次无声的筛选。

他后来把主流形态命名为默认—干预式(default-interventionist):类型一先给出一个默认答案,类型二有权干预,但默认不行使这个权力。

而他反复提醒的一点最扎人:当类型二真的动起来时,它做的事往往不是推翻默认答案,而是替它把理由补齐。这正是 №033 在推理实验室里的样子。

史蒂文·斯洛曼 1996 · 两套东西并存的判据

史蒂文·斯洛曼1996 年在《心理学公报》上做了一件方法论上的关键事:他没有满足于罗列"直觉与理性"的对比,而是问——凭什么说这是两套东西,而不是一套东西的两种状态?

他给出的判据干净得像一把尺子:如果一个人能够同时相信两个互相矛盾的答案——明知道两条线一样长,却仍然看见其中一条更长——那就不是"一套系统换了个档位",而是两套东西在同时输出。

他把二者刻画为联想式(按相似与共现计算)与规则式(在符号结构上运算)。这个划分与后来的"类型一/类型二"不完全重合,但那把尺子留了下来:并存,而不是接力,才是两套过程的证据。

基思·斯坦诺维奇 2000 / 2009 · 聪明与理性是两回事

基思·斯坦诺维奇与理查德·韦斯特2000 年那篇长文(正是"系统一/系统二"这两个标签流行开来的地方)走的是一条别人没走的路:不看平均值,看个体差异——什么样的人不会掉进这些陷阱?

答案让人不太舒服:认知能力确实有帮助,但远没有想象中那么大。很多经典偏差在高智商人群里照样成立。他后来为此造了一个词——理性障碍:聪明,却系统性地不理性。

他的解释是"三分心智":自主心智负责送答案,算法心智负责有没有算力去解耦,反省心智负责要不要去用那份算力。智商测的是第二层——而决定你会不会在球棒与球那道题上翻车的,是第三层。与 №012 同处一条元认知的线上。

维姆·德内斯 2012 · 直觉里本来就有逻辑

如果说前三家在细化这个理论,维姆·德内斯做的是把它的叙事翻了个面。传统故事是:愚蠢的直觉给出错答案,明智的推理有时来救场。德内斯问:人在答错的那一刻,真的一无所知吗?

证据说不是。当直觉答案与逻辑冲突时,即便最终答错的人,也表现出明确的冲突信号:反应时变长、对自己答案的信心显著下降、目光重新回到那条被忽略的关键信息上。他们察觉到了不对劲——只是没能把它变成一个不同的答案。

他称之为"聪明的直觉者":逻辑与概率的某些知识本身已经直觉化了,会自动激活。于是真正的问题被改写了——不是"人为什么察觉不到",而是"察觉到了为什么压不住"。这一改,把责任从"无知"挪到了"抑制"。

五 案例 CASE STUDIES
CASE 01 四张牌,和一张换了外衣就会做的四张牌 1966–1982 · 伦敦 / 佛罗里达

抽象版的沃森选择任务,正确率通常不到一成。但把完全相同的逻辑结构换一层外衣,情况就完全不同了。

1982 年,理查德·格里格斯与詹姆斯·考克斯用了一个后来被引用无数次的版本:"如果一个人在喝酒,那么他必须年满 18 岁。"四张牌分别写着"在喝啤酒"、"在喝可乐"、"22 岁"、"16 岁"。多数人立刻就翻对了——喝啤酒的那张,和 16 岁的那张。

逻辑形式一模一样,难度天差地别。1989 年,勒达·科斯米德斯据此提出一个更强的主张:人对"作弊者检测"这类社会契约结构有专门的、进化而来的直觉,抽象条件句反而是人类心智不熟悉的题型。

这个案例最该记住的不是"人不会逻辑",而是:同一道题,起作用的是哪一套直觉,取决于题目穿的是什么衣服。——它同时也是对"多用理性思考"这类建议的第一次泼冷水:真正改变答案的往往不是更努力,而是换个说法。
CASE 02 球棒与球:不是不会算,是没去算 2005 · 麻省理工、普林斯顿、哈佛

谢恩·弗雷德里克把三道题打包成认知反射测验(CRT),球棒与球是其中第一道。在跨校的大样本里(约 3400 余名大学生),结果颇为难堪:麻省理工的学生平均答对 2.18 题(满分 3 题),普林斯顿 1.63,哈佛 1.43。在球棒与球这一道上,这些学校也有相当比例的学生给出了 0.10。

这道题的算术难度对他们来说等于零。失分的原因不是不会算,是没有意识到需要算。

CRT 测的从来不是能不能,而是要不要——那个"等一下,我最好检查一遍"的动作会不会发生。斯坦诺维奇所谓"反省心智"在此显形:算力人人都有,肯不肯掉头去用它,才是分水岭。
CASE 03 你在答错的那一刻,已经知道自己错了 2000s–2010s · 图卢兹 / 巴黎

典型的实验题长这样:在 1000 人的样本里,有 995 名律师和 5 名工程师。随机抽到的杰克安静、爱摆弄数字、不喜欢社交——他更可能是工程师还是律师?大多数人答"工程师",忽略了那个压倒性的基础比率。

维姆·德内斯与同事把这些答错者的过程记录下来,发现了一件反常识的事:与"基础比率和描述不冲突"的对照题相比,答错者在这类冲突题上反应时更长、对自己答案的信心更低,眼动记录显示他们的目光会回到那两个被"忽略"的数字上。

换句话说:他们不是没看见 995 这个数字,他们看见了,甚至感到了不安,然后还是说了"工程师"。

这把"人是认知吝啬鬼"的老故事改写了:错误不是盲目的,是被压住的正确感。——对日常最有用的推论是:那种"哪里有点不对但说不上来"的模糊不适,通常不是噪声,是冲突检测在报警。值得停下来的信号,往往就长这个样子。
CASE 04 读到就先信了:否定是要花力气的 1993 · 得克萨斯大学

笛卡尔认为,人先理解一个命题,再决定信不信;斯宾诺莎认为,人理解即相信,"不信"是随后另加的一道工序。丹尼尔·吉尔伯特与同事做了一个实验来分这个胜负。

受试者阅读关于两起犯罪的陈述,其中一些被明确标注为假的。一半受试者在阅读时被一个按键任务打断,占住工作记忆。随后请他们为罪犯量刑。

结果是:被打断的那组,会把标为"假"的加重情节当成真的用进去——当那些假陈述对被告不利时,他们判出的刑期明显更重。没被打断的一组则不会。

这暗示"相信"是免费的、自动的,而"不信"要占用工作记忆。累的时候、忙的时候、一心二用的时候,人的默认设置是轻信。——所以谣言最好的传播时机,从来不是深思熟虑的下午,而是刷手机的深夜。该研究属经典社会认知发现,其效应量在后续文献中仍有讨论,此处取其方向而非精确大小。
CASE 05 消防队长与股票分析师:两个死对头合写的一篇文章 2009 · 《美国心理学家》

心理学界曾有两条互相看不上的路线:一条专门证明专家直觉不可靠(卡尼曼一派),一条专门研究消防队长、护士、飞行员如何在几秒钟内做出正确判断(加里·克莱因的自然决策学派)。

2009 年,卡尼曼与克莱因合写了一篇文章,副标题是——《一次未能达成的分歧》。他们发现自己其实没什么可吵的,因为答案是条件性的:直觉可不可信,取决于两件事。

一、这个环境有没有足够稳定的规律可学?
二、这个人有没有通过长期练习,获得过快速、清晰、可靠的反馈?

火场有规律,且反馈立刻到来——所以老消防队长那句"我们得出去"值得信。长期股市、政治预测、面试识人,规律稀薄或反馈迟到失真——在那里,几十年的经验也长不出可靠的直觉,只长出可靠的自信。

这是本篇最实用的一句:问题从来不是"该信直觉还是该信分析",而是"这个环境,有没有给直觉学会规律的机会"。——把问题从"我是什么样的人"改成"我站在什么样的环境里",是这门学问送给日常判断最大的一件礼物。
六 反例与限制 CRITIQUE & LIMITS

这一节的第一条是这个理论近十年遭到的最猛一击,第二条来自它最著名的普及者本人,第五条是它在日常里最贵的一次误用。

① 那些属性根本不聚成两簇2018 年,大卫·梅尔尼科夫与约翰·巴格在《认知科学趋势》上发表《神话般的数字二》,指控相当直接:几十年来人们默认"无意识、不可控、高效、快"会打包出现,"有意识、可控、费力、慢"会打包出现——但从来没有人真的去检验过这个打包假设,而反例遍地都是:可以是无意识却带意图的,可以是快却占用工作记忆的,可以是费力却不受控的。他们的结论是:把心理过程分成两类,是一个方便而诱人的神话。
同年,彭尼库克、德内斯、埃文斯、斯坦诺维奇与汤普森联名回应:被打倒的是那个"属性成簇"的旧版本,而 2013 年之后的定义早已把判据收缩到只剩工作记忆一条。争论至今未息——但双方在一件事上意见一致:教科书上那张"系统一/系统二"两栏属性对照表,是错的。
② 那两个"系统"是虚构人物——作者自己说的把系统一和系统二当成脑子里的两个小人、两块脑区、甚至两种人格类型("他是系统一思维的人"),全部是误读。脑成像里既没有"系统一区",也没有"系统二区"。卡尼曼在书里写得极清楚:它们是说明用的虚构角色。
这一点比听起来重要:一旦把比喻当成实体,你就会问出一堆没有答案的问题("怎样才能关掉系统一?"),而错过真正能答的那个问题——这件事占不占用工作记忆?
③ 测量工具本身很脆弱这条线上大量结论依赖 CRT 这三道题,而它有两个硬伤:其一,题目太出名了——今天相当比例的受试者事先见过球棒与球,测出来的是记忆不是反射;其二,CRT 与数学能力高度相关,"没去检查"与"检查了也算不出"在分数上长得一模一样。
更广地说,认知负荷、启动、双任务这一类范式正处在近十几年心理学复现浪潮的中心地带,方向大体稳固,具体效应量则应当保守对待。
④ 它有滑向"事后重新命名"的危险任何错误都可以归给"系统一太快",任何正确都可以归给"系统二介入了"——如果没有事前判据,这套语言就不再解释任何事情,只是给现象换了个说法。
这也是埃文斯与斯坦诺维奇 2013 年那次收缩的动机之一:把定义钉死在"要不要工作记忆"上,至少让它可以被双任务实验证伪。凡是听到"这是系统一在作祟"这种句子,值得追问一句:它做出了什么此刻还没发生、将来可以被检验的预测?
⑤ 最贵的误用:把它读成"要多用系统二"这是几乎所有普及版本都在暗示、而原始文献从不支持的一句话。真实结论是条件性的(见案例 05):在规律稳定、反馈及时的领域,直觉往往优于刻意分析;在规律稀薄的领域,再多的深思也只是给错误答案配上更长的理由——而类型二本来就更擅长辩护而非纠错。
还有一层伦理上的误用更该警觉:拿"系统一思维"给某个人、某类人、某个群体贴标签。这个理论描述的是过程,不是人——每个人的每一天都同时跑着这两类过程,没有谁生活在其中一边。

正确的姿势:把它当一副追问来源的眼镜,而不是一张给人分类的量表。它值得你问的只有两句——这个判断是被算出来的,还是被送上门的?我此刻所在的环境,配不配得上我对自己直觉的这份信任?
而它最硬的一课是那句反常识的提醒:慢下来本身没有价值。慢下来只有在一件事上有价值——你打算用这段时间去检验那个答案,而不是去给它写辩护词。

七 相关理论网络 CONNECTIONS
沃森选择任务
Wason Selection Task · 1966
⟸ 诊断工具
整个纲领的起点。它的价值不在"多少人做错",而在"换个外衣就做对了"——这才是两套过程存在的第一份证据。
启发式与偏差
Heuristics and Biases · Tversky & Kahneman
⟸ 母体纲领
那一整套偏差目录回答"人会怎样出错",双重过程理论试图回答"为什么会那样出错"。锚定与前景理论都住在这栋楼里。№045 №043
认知解耦
Cognitive Decoupling
⟹ 核心组件
类型二真正独有的能力:在脑中运行一个模型,同时不把它当真。反事实思维、假设检验、演练与共情都靠它,而它极其耗费工作记忆。
认知失调
Cognitive Dissonance · Festinger, 1957
↔ 机制近亲
类型二被拿去做辩护而非纠错时,产出的就是自我辩护。费斯廷格描述的那台机器,正是这台机器被误用的样子。№033
双曲贴现
Hyperbolic Discounting · Ainslie, 1975
↔ 同构问题
"现在的我"给出的答案不占用工作记忆、来得又快又强;"未来的我"必须靠解耦才能被想象出来。自控问题与推理问题在结构上是同一个。№044
心智理论
Theory of Mind · Premack & Woodruff, 1978
⟷ 平行争论
读心同样被分成"自动的一层"与"费力的一层",而那场争论的形状——两套系统还是一个连续体——与本篇几乎一模一样。№057
邓宁-克鲁格效应
Dunning–Kruger Effect
↔ 元认知一线
斯坦诺维奇的"反省心智"与达克效应问的是同一件事:判断自己判断得对不对的那一层能力,测不进智商,也最容易缺席。№012
自然决策与专家直觉
Naturalistic Decision Making · Klein
⚖ 对照修正
最重要的一次对照:它证明快的那一套在合适的环境里极其可靠,从而把"直觉 vs 分析"之争改写成"环境有没有规律"之问。
八 致用 APPLICATION

先立边界:下面五条里,第一条与第三条有明确的经验证据支撑,其余是从这套框架里长出来的判断习惯,不是实验结论。

判断"这个直觉能不能信":只问两个问题
卡尼曼与克莱因给的判据非常干净,而且不问你是谁:一、这个领域有没有足够稳定的规律?二、我在这里得到过快速、清晰、可靠的反馈吗?
两个都是——信它(认路、看代码、判断熟人今天不对劲、老医生看片子)。缺一个——别信,哪怕感觉再强烈(预测股价、判断一个刚见面的人可不可靠、猜别人为什么不回消息)。一个人可以在某个领域拥有黄金般的直觉,同时在隔壁领域拥有一模一样强烈、但毫无根据的直觉。
不要指望"更努力地想",要给检查装一个触发器
类型二默认不开机,喊口号没用。有用的是几个固定信号,撞上就强制停一下——答案来得异常快;数字过于整齐;结论恰好是我本来就希望的那个。
最后一条最灵。凡是"想要的答案"和"得出的答案"重合的时刻,几乎都值得再算一遍——因为那正是类型二最容易从检察官变成辩护律师的时刻。
把重要判断挪出"负荷时刻"
占住工作记忆的一切都会让纠错那一层下线:疲惫、饥饿、赶时间、边开会边回消息、情绪激动。此时你并不会变笨——类型一照常运转,只是没人复核了。
可操作的做法只有一条:把不可逆的决定(签字、发出去、点确认、说重话)与做出这个决定的时刻拆开。哪怕只隔一顿饭。谈判高手让人当场签字,用的正是这条。
写下来,是最便宜的外置工作记忆
认知解耦贵在占地方,而纸和屏幕是免费的额外空间。把选项、假设、以及反面证据写成三列,等于把一部分负担搬出脑子,给类型二腾出位置。
同理:逼自己复述对方的论点直到对方点头,是低成本的解耦训练——你必须在脑中运行一个你不同意的模型,还不能把它当成自己的。这件事做不到的人,通常不是不同意,而是没算力。
别拿它当标签,尤其别贴到人身上
听到"他这是系统一思维",先分辨这是描述还是贬低。这套理论说的是过程不是人,而且它有一半的内容在替直觉说话。
真正有用的问法不是"这个人快还是慢",而是——他这个判断所在的环境,给过他学会规律的机会吗?换成这一问,你会发现很多被当作"不理性"的判断只是长在没有反馈的地方,而很多被当作"深思熟虑"的结论不过是辩护词写得比较长。
九 反观三问 THREE QUESTIONS
我最近一次"凭感觉"做出的重要判断,发生在什么环境里?那个环境有稳定的规律吗?我在那里得到过快速而诚实的反馈吗——如果没有,我凭什么信任那份感觉?
我上一次花很长时间想一件事,最后得出的结论,与我一开始那个念头是否一致?如果一致,那段时间我究竟是在检验它,还是在给它写辩护词?
这一周里,那些让我隐隐觉得"哪里不太对但说不上来"的时刻,我处理了几个?如果德内斯是对的,那份不适正是我已经察觉但没能压住的东西——我把它们当成噪声删掉了,还是当成信号留下了?
十 延伸阅读 FURTHER READING
← PREVIOUS №061 拍卖理论 HOME 百里路