印度-欧洲亲属关系数据集
Cormac Anderson1,2, Matthew Scarborough3, Lechosław Jocz4
1Department of Linguistic and Cultural Evolution, Max Planck Institute for Evolutionary Anthropology, Deutscher Platz 6, 04103, Leipzig, Germany. cormacanderson@gmail.com.
印度-欧洲相关关系 (IE-CoR) 数据集绘制了160种印度-欧洲语言之间的词汇关系. 这种基准资源有助于对语言演变和历史语言学的计算研究.
科学领域:
- 计算语言学
- 历史语言学
- 语言演变研究
背景情况:
- 印欧语言家族是庞大的,具有复杂的历史关系.
- 了解相关模式对于重建原语言和追踪语言演变至关重要.
- 现有的数据集往往缺乏全面的覆盖范围或计算分析的标准化格式.
研究的目的:
- 介绍印欧相关关系 (IE-CoR) 数据集,这是语言研究的新型资源.
- 为印欧语言演变提供计算研究的基准数据集.
- 促进对印欧语言的词汇继承和水平转移的研究.
主要方法:
- 一个涉及160种印欧语言的关系数据集的编制.
- 根据170个参考含义,分析了4,981个相关集合中的25731个词汇条目.
- 包括水平传输,时间校准和地理/社会元数据的数据.
- 遵守跨语言数据格式 (CLDF) 协议以实现互操作性.
主要成果:
- 该数据集包含160种语言的25731个词汇条目,分为4981个相关数据集.
- 它代表了所有13个主要的印欧基层,并包括横向词汇转移的数据.
- 数据集包括时间校准,地理和社会元数据以进行增强分析.
结论:
- 对于计算历史语言学而言,IE-CoR数据集提供了一个全面的标准化资源.
- 它是印欧语言演变研究的重要基准.
- 数据集的设计促进了互操作性,并可作为其他语言家族的模型.
更多相关视频
07:28Studying Metabolic Brain Connectivity Using 2-Deoxy-2-[18F]Fluoro-D-Glucose Dynamic Positron Emission Tomography at the Single-subject Level
Published on: January 24, 2025
12:49Transcranial Direct Current Stimulation tDCS of Wernicke's and Broca's Areas in Studies of Language Learning and Word Acquisition
Published on: July 13, 2019
相关概念视频
Evolutionary Relationships through Genome Comparisons
Kendall's Coefficient of Concordance
Synteny and Evolution
Around 80 million years ago, the human and mice lineages diverged from the common ancestor. During the course of evolution, the ancestral...
Language and Cognition
Phylogeny
Convergent Evolution
