这门学问最有名的那句话,是一个化学工程师在下班以后想出来的。
本杰明·李·沃尔夫(Benjamin Lee Whorf, 1897–1941)从麻省理工拿了化学工程学位,然后在哈特福德火灾保险公司做了一辈子火险查勘员——去火灾现场,弄清楚火是怎么烧起来的,写报告。他一直做到去世,从没有过一个全职的学术职位。三十年代初,他开始在耶鲁旁听爱德华·萨丕尔(Edward Sapir)的课,研究霍皮语、阿兹特克语和玛雅文字,全部是业余时间。
而他的第一个念头,恰恰来自本职工作。他在一叠火灾报告里看出了一件古怪的事:有些火灾的直接原因,是一个词。
工人们在标着"空"(empty)的汽油桶旁边随手扔烟头,
因为那上面写着"空"——
而"空"汽油桶里装的,是比汽油更容易爆炸的油气。
沃尔夫的师承其实是一条明确的线。上游是弗朗茨·博厄斯(Franz Boas),美国人类学之父;博厄斯教出萨丕尔,萨丕尔教出沃尔夫。这条线的政治底色很要紧,也常被后人忘掉:博厄斯当年之所以扎进美洲原住民语言,是为了反驳"原始民族说着原始语言、所以头脑也原始"这种当时的主流偏见——他要证明每一种语言都是一套自洽、精密、各有各的必须表达之物的系统。这门学问的出发点,是平等主义。(记住这一点,第六节最后一条会用到它。)
还有一件事必须先说清楚,否则后面全乱:"萨丕尔-沃尔夫假说"这个名字,是在两位主角都去世之后由第三个人安上去的。萨丕尔 1939 年去世,沃尔夫 1941 年去世,年仅四十四岁;两人从未合写过任何一篇文章,也从未把自己的想法称作"假说"。这个标签由沃尔夫的同门哈里·霍伊尔(Harry Hoijer)在 1954 年一次纪念沃尔夫的会议上提出。后来那个人人都会背的"强版本/弱版本"二分,同样是后人加的。
一门学问最有名的名字,
是它的两位署名者都没听过的名字。
两块材料:一块是萨丕尔的宣言式表述,一块是沃尔夫真正给出定义的那一段。
整整一个世纪的混乱,几乎都来自没把两句话分开:
强版本(语言决定论):你的语言里没有的东西,你想不了。
弱版本(语言相对论):你的语言里必须说的东西,你会更习惯注意、更快想到、在没有别的线索时更倾向于用它来切分世界。
强版本几乎没有严肃学者支持,而且它自己就把自己说死了:如果语言真的决定了思维的边界,那么翻译不可能、学一个新概念不可能、这一整篇你正在读的中文文章也不该存在——因为它讲的每一个词,最初都不在中文里。凡是能被翻译成一句解释的东西,就不是"想不了"。
剩下的是弱版本。而弱版本值不值得写一整篇?值得,因为它讲的是一件很实在的事:
语言不决定你能想什么,
它决定你不费力气就会想什么。
换一个譬喻:母语是一套装在你脑子里的默认设置。默认设置从来不限制你能做什么——你随时可以改,只是改要花力气,而人在大多数时候不花那个力气。一门语言强制你标记的那些东西(时态、数、体、形状、方位、消息来源),就是它替你预先勾好的那几个复选框。你一辈子勾了几百万次,于是它们变成了你注意力的默认落点。
这个更精确的版本有一个好名字,来自心理语言学家丹·斯洛宾(Dan Slobin, 1996):为说而想(thinking for speaking)。他的意思是,语言影响的不是"思维"这个大得没边的东西,而是那个很具体的时刻——当你准备把一件事说出口时,你必须临时把经验切成这门语言要求的形状。而一个人一天要做几百次这种切分。
于是本篇真正要问的问题,从来不是那个宏大的"语言决定思维吗",而是三个小得多、也可测得多的问题:
一,效应存在吗?——存在,第五节有五个案例。
二,多大?——通常很小。小到常常要用毫秒来量。
三,在哪一层?——多半在快速、自动、不假思索的那一层;一旦你被要求慢下来、或者嘴被别的任务占住,效应常常就消失了(案例 05 是最干净的一次演示)。
这三个答案合起来,就是这门学问一百年的全部收成:
效应是真的,但它是一件工具的影子,不是一座牢房的墙。
沃尔夫在《习惯性思维与行为对语言的关系》(约 1939 年写成,1941 年发表)里写下这套理论最著名的一段现场观察:装过汽油的桶被清空之后,在仓库里被叫作 empty gasoline drums——"空汽油桶"。
在这些桶旁边,工人的行为明显松弛:抽烟,随手扔烟头。而实际上,"空"桶比满桶更危险——满桶里是液态汽油,"空"桶里是汽油挥发出来的、与空气按比例混好了的爆炸性蒸气。
沃尔夫的解释是:英语的 empty 同时携带两层意思——"没有装东西"与"无害、可忽略、不必当回事"。工人们没有做过任何错误的推理,他们只是被一个词悄悄安排了态度。
沃尔夫最大胆的主张是关于霍皮语的:他写道,霍皮语中没有直接指涉我们所谓"时间"的词、语法形式、结构或表达;霍皮人不把时间当作一条可以切成小段、可以数、可以浪费的直线。这个说法后来变成了整套理论的旗舰,也是大众文章里被复述最多的一条。
1983 年,语言学家埃克哈特·马洛特基(Ekkehart Malotki)出版《霍皮时间》(Mouton),厚达 677 页,逐条给出霍皮语里的时态标记、时间隐喻、时间单位(日、月)、以及大量与时间有关的语法结构。一本书,一个案例,几百页反例。
诚实的补充:后来一些学者(如 Penny Lee、John Leavitt)认为马洛特基有一部分打的是稻草人——沃尔夫真正说的是霍皮语不把时间"对象化"成可数的物体,而不是霍皮人不知道昨天和今天。这场争论至今没有完全平息。但即便退到那个更弱的版本,这个招牌案例也已经不能再当证据用了。
1969 年柏林与凯的《基本颜色词》几乎宣告了相对论的死亡(见第四节)。然后十五年后,保罗·凯自己回来了。
1984 年,凯与威廉·肯普顿(Willett Kempton)在《美国人类学家》上发表《什么是萨丕尔-沃尔夫假说?》。他们找来两组人:英语母语者(蓝、绿分属两个词),和塔拉乌马拉语母语者(一个词 siyóname 同时覆盖蓝与绿)。任务极简单:给你三张色卡,全部取自蓝-绿连续带,请指出哪一张与另外两张最不同。
结果是:英语者在跨越 blue/green 那道词界的地方,把差异夸大了;塔拉乌马拉语者没有。一个真实的、可测的沃尔夫效应。
但这篇论文真正的好,在它的第二个实验。凯与肯普顿推测这个效应的机制是"受试者偷偷用了命名策略"——先给色卡起名,再按名字判断。于是他们专门设计了一个能阻断这条路的版本,并且预言效应会消失。效应果然消失了。
澳大利亚昆士兰的古古依米提尔语(Guugu Yimithirr)几乎不用"左、右、前、后"这类以说话人身体为原点的说法。它用的是绝对方位:东、南、西、北。杯子在桌子的北边;请你往东挪一点;你北边的那条腿上有只蚂蚁。
这意味着一件相当苛刻的事:要说好这门语言,你必须在任何时刻、任何房间里、闭着眼睛,都知道自己朝向哪个方向。人类学家约翰·哈维兰(John Haviland, 1993)记录到,说话人的手势也严格跟着绝对方位走——讲同一个故事,人转个身,手指的方向跟着换。
莱文森团队设计的关键实验是非语言的:在一张桌子上给你看一排物品,然后把你转 180 度带到另一张桌子前,请你"照原样"摆出来。荷兰语母语者按相对方位重建(原来在我左边的,还放我左边);古古依米提尔语与恰帕斯的策尔塔尔语母语者按绝对方位重建(原来朝北的,还朝北)。两组人给出的答案,在几何上完全相反。
俄语没有一个统称的"蓝"。它强制区分 siniy(深蓝)与 goluboy(浅蓝),这不是两个可选的修饰说法,而是两个基本颜色词,就像英语的 blue 与 green。
温纳沃、维特霍夫特、弗兰克、吴、韦德与博罗迪茨基(2007)做了一个速度辨色任务:屏幕上三块蓝,请尽快指出下面两块里哪一块与上面那块相同。所有色块都跨在 siniy/goluboy 的边界附近。
结果:俄语母语者在两块颜色分属不同词类时,反应明显更快;英语母语者没有这个差别。到这里为止是标准的沃尔夫效应。
而这项研究真正的价值在最后一步——他们加了干扰任务。让受试者同时在心里默记一串数字(言语干扰),这个优势消失了;换成同时记一个空间图形(空间干扰),优势还在。
这是本站少有的一篇——它最著名的版本、最著名的例子、最著名的应用,三样全都塌了,而剩下的那一小块是真的。下面五条按塌得由远及近排列。
先立边界,这一节尤其需要:只有第一条与第五条有直接的实验依据(分别来自案例 05/03 与案例 04、以及第六节⑤),其余三条是从这套结构里长出来的判断习惯,不是定理的推论。这门学问的实证效应很小,任何"照此办理就能改变思维"的许诺都超出了它的能力。
博厄斯在《美洲印第安语手册》导论(1911)里立下的是两条至今成立的观察:其一,语言的分类是无意识的——没有人在说话时先想一遍"我该怎么归类";其二,每一门语言都有一组它必须表达、而别的语言可以不表达的范畴。
但他的目的与后人拿它去干的事恰好相反。博厄斯是要证明所谓"原始语言"同样精密、同样自洽,因此说这些语言的民族并不"头脑简单"。他本人明确反对由语言推出思维能力的高下。
萨丕尔把它往前推了一大步,推到了 1929 年那段宣言的位置。而值得注意的是,萨丕尔本人在别处也写过相当克制的话——他很清楚语言与文化的相关远不是简单的因果。
这一卡真正的要点是:这条线上的两位前辈都比后来那个"萨丕尔-沃尔夫假说"温和得多。被激进化的不是他们的主张,是他们的标签。
1969 年,人类学家布伦特·柏林(Brent Berlin)与语言学家保罗·凯(Paul Kay)出版《基本颜色词:其普遍性与演化》。他们让二十种语言的母语者在 320 张孟塞尔色卡上指认自己语言里的基本颜色词,再加上另外七十余种语言的文献描述。
如果语言真的随意切分世界,颜色应该是最好的战场——光谱是连续的,怎么切都行。结果恰恰相反:各语言的基本颜色词最多十一个,而且它们出现的先后顺序几乎固定(先黑白,然后红,然后绿或黄,然后蓝……共七个阶段)。一门语言只有两个颜色词,那两个几乎一定是黑与白;有了第三个,几乎一定是红。
这在当时被广泛读成对语言相对论的判决书:切分世界的不是语言,是人类共有的视觉系统。此后二十年,"沃尔夫"在英语学界几乎是一个可以用来嘲笑人的词。
但这一卡最该记住的是它的后半段:1984 年,同一个保罗·凯,亲手把相对论救回了一半。见案例 03。
人类学家约翰·卢西(John A. Lucy)在《语法范畴与认知》(Cambridge University Press, 1992)里做的事,比任何一次实证发现都重要:他重新写了这道题。
他指出,此前几十年的争吵之所以没有结论,是因为问题本身没法答。于是他提出三条方法学要求:必须比较至少两门语言(不能只拿英语说事);语言变量与认知变量必须分开、独立地测量(不能用语言证据去证明语言效应,那是循环);认知任务必须是非语言的(分类、记忆、匹配,而不是"请你说说")。
他自己的示范是尤卡坦玛雅语与英语的对照。玛雅语的名词大多不像英语那样自带"可数/不可数"的分野,数量表达需要借助指明材质与形状的量词。在非语言的分类与记忆任务里,玛雅语母语者更倾向于按材质归类,英语母语者更倾向于按形状归类。
从此这门学问的正确提问方式定了型:不问"语言决定思维吗",问——某一个具体的语法范畴,是否可测量地影响某一个具体的非语言任务?本篇后面所有值得引用的证据,都是照这个格式做出来的。
斯蒂芬·莱文森(Stephen C. Levinson,马普心理语言学研究所)带队做的是空间:有些语言根本不用"左/右/前/后",只用"东/南/西/北"。他把这类语言的使用者拉进旋转任务,发现他们在不说话的记忆与推理任务里同样按绝对方位工作(案例 04)。
勒拉·博罗迪茨基(Lera Boroditsky)做的是颜色、时间与因果,最著名的是俄语两种"蓝"的速度辨色实验(案例 05)。
新沃尔夫主义与老沃尔夫主义的区别,可以用一句话概括:他们放弃了"决定",改测"效应"。不再问语言给思维划了什么边界,只问:说这门语言的人,在这个具体任务上,是不是快了几十毫秒、错了几个百分点、倾向于选另一个选项。
代价是这门学问从此不再壮丽。它换来的是它终于可以被做错——博罗迪茨基自己就有一项经典研究长期未能被复现(见反例③)。一个能被证伪的小结论,胜过一个不能被证伪的大命题。