前几篇文章探讨了不同语系中的词汇运作方式有何不同。
在英语中,词汇研究常会谈到词族。在欧洲语言中,学习者需要处理动词形式、性、格、复合词和发音。到了普通话和日语,文字系统又增加了一层复杂度。到了阿拉伯语,词根、词形模式和方言会让整个情况都发生变化。
现在来看另一组令人着迷的语言:黏着语。
典型例子包括土耳其语、匈牙利语、芬兰语和韩语,不过这些语言各有自己的历史、结构和学习难点。
刚开始接触时,这些语言可能显得很吓人。一个单词可能非常长,里面可能包含英语需要用好几个独立单词才能表达的信息。对学习者来说,这常会带来一个共同的担心:
“是不是每个长单词都要当成一个单独词汇来背?”
好在答案是否定的。
在黏着语中,长单词往往由更小的、有意义的部分构成。一旦开始识别这些部分,语言就会变得有逻辑得多。
“黏着”是什么意思?
黏着型这个说法,来自把各种成分“黏”在一起的概念。
在黏着语中,单词通常是在词根后添加后缀或其他词缀构成的。每个添加上去的部分通常都有相对清晰的语法意义。一个单词里可能包含词根意义,再加上数量、所有关系、格、时态、礼貌程度、方向或其他关系等信息。
WALS 等语言类型学数据库会把黏着现象放在更广泛的形态结构尺度中,与孤立型、融合型和内屈折型模式并列。这些并不是严丝合缝的分类框,因为真实语言常常会混合多种特征,但这些类别有助于理解语言如何构词。
用英语做一个简单对比或许有帮助。
英语通常会分成几个词来表达:
in my houses(在我的几所房子里)
黏着语可能会把其中一些信息放进一个单词里:
词根 + 复数 + 所有关系 + 位置。
这并不意味着学习者必须把每一种可能的完整形式都分别背下来。相反,需要理解词根和常见后缀。
这正是学习这类语言词汇的关键。
为什么词数会产生误导
在英语中,house、houses 和 house’s 这些形式很容易联系起来。但在黏着语中,一个名词或动词词根可能会出现更多形式。
一篇关于黏着语的计算语言学说明用芬兰语 talo(“房子”)举例,并解释了土耳其语、芬兰语、匈牙利语和韩语等语言如何通过添加后缀,从一个给定词根生成许多形式。
这会给词汇统计带来问题。
如果把每个表层形式都算作一个单独单词,黏着语看起来可能大得难以想象。但这样会产生误导。这些形式中有很多并不像互不相关的单词那样是独立词汇项,而是已知部分的组合。
对学习者来说,实际问题不是:
“我背了多少种不同的词形?”
更好的问题是:
“我能不能识别词根,并理解这些后缀在做什么?”
这就是为什么黏着语会奖励模式识别能力。
土耳其语:清晰的后缀与元音和谐
土耳其语是最清晰的黏着语例子之一。
土耳其语单词通常通过给词根添加后缀来构成。这些后缀可以表达复数、所有关系、格、时态、人称、否定和其他意义。Britannica 对突厥语族语言结构的描述强调,后缀会组合起来形成很长的派生词干,而许多突厥语会使用元音和谐,也就是后缀中的元音会随词内元音而变化。
学习者常见的经典例子来自 ev,意思是“房子”:
- ev — 房子
- evler — 房子们
- evlerim — 我的房子们
- evlerimde — 在我的房子们里面
- evlerimden — 从我的房子们那里
对以英语为母语的初学者来说,evlerimden 可能看起来像一个全新的单词。但实际上,它由几个部分构成:
ev + ler + im + den
房子 + 复数 + 我的 + 来自
这就是为什么土耳其语一开始可能让人觉得难,但之后会显得非常系统。一旦识别出这些后缀,许多长单词就会更容易理解。
难点不只是记住词根。学习者还需要培养对后缀链和元音和谐的快速识别能力。
匈牙利语:一个词里包含许多关系
匈牙利语也以后缀丰富而闻名。
匈牙利语常常把英语用介词表达的关系放进词尾里。英语会说“在房子里”“从房子里来”或“到房子那里”,匈牙利语则把相应词尾附加到名词上。
例如,用 ház 表示“房子”:
- ház — 房子
- házban — 在房子里
- házból — 从房子里来
- házhoz — 到房子那里
- házam — 我的房子
- házaimban — 在我的房子们里面
同样,学习者不应该把每个形式都当成完全独立的单词。词根承载核心意义,后缀则添加语法信息。
匈牙利语尤其有意思,因为它有许多类似格的词尾,也有一个非常高产的后缀系统。学习者最初接触时可能会觉得不知所措。一个词可能会出现和词典条目看起来相当不同的形式。
但更深层的逻辑是相似的:
词根 + 后缀 + 后缀 + 后缀
越能识别常见词尾,这门语言就越透明。
这也是为什么学习匈牙利语词汇不应只是“单词 = 译义”。还应该包括常见形式和句型。
学习 ház = 房子 很有用。但学习 házban、házból、házhoz 和 házam,能帮助理解匈牙利语实际是如何运作的。
芬兰语:格、词尾与单词识别
芬兰语也是一个经典例子,在这门语言中,词汇和形态变化紧密相连。
芬兰语使用许多格词尾,也有丰富的屈折变化。学习者常听说芬兰语有很多格,这可能听起来很吓人。但从词汇角度看,关键并不在于格的数量本身。关键在于,熟悉的单词可能会带着许多不同词尾出现。
例如,talo 的意思是“房子”。学习者可能会遇到这样的形式:
- talo — 房子
- talossa — 在房子里
- talosta — 从房子里来
- taloon — 进房子里
- taloni — 我的房子
如果只记住基本形式,在真实阅读或听力中,可能无法立刻认出所有这些形式。
关于芬兰语单词识别的研究考察了母语者和二语学习者如何处理形态复杂的芬兰语单词,结果显示,词形透明或半透明的屈折名词会根据学习者背景的不同,以不同方式影响识别。
这给学习者带来一个很实用的启示:
在芬兰语中,词汇学习必须同时训练对词干和词尾的识别。
只知道词典形还不够。需要在真实句子中反复看到这个词,连同常见词尾一起看到很多次。
韩语:后缀、助词与礼貌程度
韩语也有许多黏着语特征,但它的学习难点不同于土耳其语、匈牙利语或芬兰语。
韩语使用助词和动词词尾来表达语法关系、时态、礼貌程度、语体等级和社会语义细微差别。一项关于韩语敬语一致的研究把韩语描述为一种黏着语:它积极使用助词和动词后缀来传递语法信息,同时在语境中也允许成分省略和较灵活的语序。
例如,韩语动词常会带上表示时态、礼貌程度和句类的词尾。词典形只是起点。
学习者可能学会了动词词干,但在真实韩语中,会根据不同情境遇到带有不同词尾的形式:
- 随意语体,
- 礼貌语体,
- 正式语体,
- 疑问句,
- 命令句,
- 建议句,
- 敬语形式。
这意味着,韩语词汇无法完全脱离社会语境来学习。
知道一个动词,不只是知道它的意思,还要知道它在自然口语中如何出现。和亲近朋友说话时使用的形式,放到正式场合可能并不合适。用于谈论自己的形式,也可能不同于尊敬地谈论别人时使用的形式。
所以学习韩语词汇应该包括:
- 词干,
- 常见助词,
- 常见词尾,
- 礼貌等级,
- 句型,
- 以及真实会话语境。
这就是为什么韩语在某些方面可能显得简单——例如,它没有许多欧洲语言那样的语法性——但在另一些方面又很复杂。
为什么黏着语一开始会显得难
黏着语在入门阶段常常让人觉得困难,主要有三个原因。
第一,单词可能看起来很长。初学者看到一个长形式,可能会以为它是一个全新的单词。
第二,查词典可能更难。如果不知道如何去掉词尾,可能不容易找到词根。
第三,听力可能很有挑战。在真实语流中,后缀会快速出现,学习者必须几乎立刻识别出词根和词尾。
但也有好消息。
黏着语往往高度系统化。一旦理解了常见构件,进步就可能加快。学习者不再分别死记每个形式,而是开始解码它们。
这门语言也会从一长串神秘长词,变成一套可重复使用的模式。
这里的“5000 个词”是什么意思?
在黏着语中,“5000 个词”是一个很危险的简化说法。
它指的是 5000 个词根吗?
5000 个词典条目?
5000 个表层形式?
还是包括常见后缀模式在内的 5000 个高频词汇单位?
这些并不是同一回事。
一个掌握 3000 个词根并理解常见后缀的学习者,可能比另一个背了 8000 个孤立词形却看不到系统的人理解得更多。
对于土耳其语、匈牙利语、芬兰语和韩语来说,真正的力量来自把词汇知识和形态意识结合起来。
换句话说:
词根 + 后缀 + 模式 = 可用词汇
更适合学习者的策略
对于黏着语来说,最佳策略不是把长单词当作孤立项目来记。
更好的策略是:
词根 → 常见后缀 → 完整词形 → 句子语境
例如,学习名词时,不要只学基本形式。要连同常见的位置、所有关系或格形式一起学。
学习动词时,不要只学词典形。要连同常见的时态、礼貌程度或人称词尾一起学。
阅读时,先练习找出词根。然后再看后缀。想一想每一部分贡献了什么信息。
久而久之,这会形成一种很强的思维习惯:
长单词不再像怪兽。它们会变成结构清晰的信息。
真正的启示
黏着语说明了为什么单靠词汇量很容易产生误导。
一个长单词未必是一个新单词。它可能只是一个熟悉的词根,加上几个熟悉的词尾。理解结构的学习者,能解码的内容会远远超过单纯词数所暗示的范围。
这并不是说这些语言很容易。土耳其语的元音和谐、匈牙利语的后缀链、芬兰语的格形式和韩语的礼貌词尾都需要练习。但它们不是随机的。
它们是系统。
对学习者来说,目标不只是收集单词。目标是识别单词是如何构成的。
在黏着语中,当学习者能看到内部结构时,词汇学习会变得强大得多:
词根、后缀、意义、语法和语境共同运作。
所以,如果你正在学习土耳其语、匈牙利语、芬兰语或韩语,不要被长单词吓退。
寻找词根。
寻找词尾。
寻找模式。
然后在真实句子中一次又一次遇到同样的结构。
长单词就是这样变成可理解语言的。
在本系列的最后一篇文章中,我们会把所有内容串起来,提出一个很实际的问题:语言学习者到底应该如何统计不同语言中的词汇量?