研究提出固定后缀依赖比,量化拉脱维亚语借词性别分配的双轨机制

新指标区分形态锚定与自由选择,发现阴性借词更依赖固定派生后缀,阳性借词集中于自由选择区,且该模式随时间更显著。

AI解读:这篇论文要解决的是一个老问题:英语借词进入拉脱维亚语等语言后,为什么大多被归为阳性?过去的研究常常把固定形态规则和默认性别混在一起,说不清到底是规则强制还是人们默认选阳性。作者提出固定后缀依赖比(FSDR),用来量化不同性别借词对固定派生后缀的依赖程度。分析1832个拉脱维亚语名词词目后发现,阴性借词明显更依赖固定后缀,阳性借词更多落在自由选择区——说明阳性是借词性别分配里的默认选项,而阴性需要有明确的后缀线索才能被选中。对计算语言学和语言接触研究者来说,这个指标提供了一个可量化的测试框架,能把“默认性别”从理论假设变成可检验的观测值。但它只针对拉脱维亚语借词系统,结论能推广到什么范围还需要更多语言的数据验证。

一篇提交至arXiv的计算语言学论文(编号arXiv:2609.03930)提出“固定后缀依赖比”(Fixed Suffix Dependency Ratio, FSDR),用于量化不同性别对固定派生后缀的依赖程度,从而区分借词性别分配中的“形态锚定”与“自由选择”。研究基于 1832 个拉脱维亚语名词词目(lemma types),发现借词系统内部存在显著FSDR不对称:阴性借词显著更依赖固定派生后缀,阳性借词则更集中于自由选择区。

核心发现与理论意义

作者Yelingyun Zhang、Atis Kapenieks和Marina Platonova在摘要中指出,已有研究多次观察到英语借词在不同接受语(recipient languages)中倾向于集中为阳性,但其成因难以确定,因为固定形态规则与默认分配常被放在一起分析。FSDR的作用是将这两者分离:它度量不同性别对固定派生后缀的依赖程度,检验分布中哪些部分是形态规则“锚定”的、哪些是自由选择的。

  • 研究对象为 1832 个拉脱维亚语名词词目。
  • 结果显示性别间FSDR存在显著不对称:阴性借词依赖固定后缀的程度更高,阳性借词更多集中在自由选择区。
  • 该模式具有借词特异性(loanword specificity),且在当代用法中变得更明显。
  • 论文据此将FSDR定位为检验默认性别(default gender)的定量框架,说明阳性默认如何在语言接触中被激活和强化。

信息来源