语言类型学是语言学的一个分支,按照结构特征对不同语言进行系统比较。它探讨哪些模式会出现、出现的频率如何,以及哪些特征往往共同出现。类型学研究大多比较具体的构式或特征,而不是将每种语言归入一个涵盖所有方面的类型。其更广泛的目标是描述语言的多样性,并概括人类语言的可能形式及其限度。(wals.info)
研究范围与历史发展
类型学分类不同于按语系进行的分类,后者关注的是共同的历史起源。语言即使没有密切的亲缘关系,也可能在结构上相似;而有亲缘关系的语言也可能发展出不同的结构。因此,类型学是对历史语言学的补充,而非替代。地理分布模式同样重要:相邻语言可能通过语言接触形成共同特征,这是区域类型学的核心研究问题。仅凭结构相似,既不能确定语言具有共同起源,也不能确定它们之间发生过接触。(wals.info)
十九世纪的形态分类区分了孤立语、黏着语和屈折语。这些类别作为入门性的标签仍有价值,但现代研究会将早期分类混在一起的不同维度分别考察。跨语言语法比较的一项重要进展,是约瑟夫·格林伯格于1963年发表的研究《语法的若干共性:特别参照有意义成分的次序》。该研究概括了成分次序与其他语法特征之间的联系,推动形成了一套影响深远的语言共性实证研究方案。(wals.info)
主要比较维度
在音系学中,类型学研究者比较各语言的语音单位清单及其组织方式。研究问题包括:一种语言有多少个具有区别作用的辅音,以及哪些组合会出现。统计音位时,需要采用一致的分析判断:一个复杂的语音在某种语言中可能构成一个辅音,在另一种语言中却可能是多个语音组成的序列。因此,语音单位清单的比较既依赖针对具体语言的分析,也依赖标准化编码。(wals.info)
形态学(语言学)中的类型学研究考察词如何表达语法信息。孤立型模式使用相对独立的语法词;黏着型模式的典型特点是将可辨识的标记组合起来;屈折型模式则可能用一个标记表达多个语法范畴。这些描述并不是对整种语言所作的互斥分类。研究者会分别考察语音上的依附关系、一个语素所表达的范畴数量,以及标记形式的变异。另一个维度是综合度,关注一个词中包含多少语法信息。(wals.info)
句法中一种常见的比较涉及语序。以S表示主语、O表示宾语、V表示动词,可得到六种排列方式:SOV、SVO、VSO、VOS、OVS和OSV。在WALS的相关样本中,SOV和SVO是最常见的优势语序;英语属于SVO型。不过,有些语言没有单一的优势语序,而且分类结果取决于所考察的构式。例如,德语会根据分句结构以及是否存在助动词,在不同语序模式之间交替。优势语序标签并不能说明一种语言允许的所有句子语序。(wals.info)
另一个主要维度是形态句法配列。这里,S表示不及物谓词唯一的论元,A表示及物谓词中更接近施事的论元,P表示其中更接近受事的论元。主格—宾格型格标记将S与A归为一类;作格—通格型格标记则将S与P归为一类。必须针对不同机制和构式分别研究配列方式。完整名词短语和代词可能具有不同的格标记模式,格标记也不一定与动词上的人称标记一致。(wals.info)
共性与相关关系
类型学概括在强度和逻辑形式上有所不同。绝对共性主张,某一特征在其规定的范围内毫无例外地成立。统计倾向指的是反复出现、但并非没有例外的模式。蕴涵共性的形式是“如果一种语言具有X,那么它也具有Y”;反过来则不一定成立。格林伯格的研究提出了一些蕴涵关系,将有意义成分的不同排列次序联系起来。(babel.ucsc.edu)
许多提出的关系涉及语法特征之间的相关关系。例如,宾语—动词次序与其他若干成分次序模式有关。这类关系往往是概率性的,而非严格的要求。研究者必须区分观察到的分布与对这种分布的解释:某种关联反复出现,本身并不能揭示产生它的历史过程或功能机制。地理分布可以提供额外证据,帮助评估基于语言接触的解释。(wals.info)
比较概念与研究方法
跨语言比较需要明确的定义。在一部语法描写中被称为“主语”“形容词”或“过去时”的范畴,不能自动视为与其他语言中同名的范畴完全相同。一项颇具影响的方法论区分,是将特定语言的描写范畴与为某项跨语言研究设计的比较概念分开。研究者可以依据共同标准比较结构,而不必假定所有语言都具有相同的语法范畴。(cambridge.org)
抽样同样重要。如果一个样本集主要由某一语系或某一地理区域的语言构成,它所反映的可能是继承而来或在当地扩散的模式,而非全球分布。因此,研究会根据所探讨的问题,力求在语言谱系和地理分布上获得适当的覆盖。确定已获证实的结构有哪些,以及估计这些结构的相对频率,是两种不同的抽样目标;同一个样本不一定能同样有效地满足这两个目标。(wals.info)
数据库与证据的局限
世界语言结构地图集(WALS)通过特征描述、语言分类和地理地图,组织可供比较的语言结构信息。其各章明确说明所用定义,以及分类时遇到的难题和所作的判断。不同特征所覆盖的语言各不相同,因此,不能将它们各自的统计总量视为对同一个统一样本的描述而互换使用。(wals.info)
数据库条目是分析性的概述,不能替代完整的语法描写。一个语序取值可能掩盖特定构式中的交替现象,而代词与其他名词短语的配列取值也可能不同。此外,还必须区分缺失条目与已经证实的特征不存在。因此,可靠的比较依赖有据可查的编码标准、充分的原始描写资料,以及对语言内部变异的重视。(wals.info)