Video Experimental Relacionado
Updated: Sep 9, 2025

Leveraging CyVerse Resources for De Novo Comparative Transcriptomics of Underserved Non-model Organisms
Published on: May 9, 2017
El conjunto de datos de Relaciones Cognadas Indoeuropeas
Cormac Anderson1,2, Matthew Scarborough3, Lechosław Jocz4
1Department of Linguistic and Cultural Evolution, Max Planck Institute for Evolutionary Anthropology, Deutscher Platz 6, 04103, Leipzig, Germany. cormacanderson@gmail.com.
El conjunto de datos de Relaciones cognadas indoeuropeas (IE-CoR) traza las relaciones de las palabras en 160 idiomas indoeuropeos. Este recurso de referencia ayuda a la investigación computacional en la evolución del lenguaje y la lingüística histórica.
Área de la Ciencia:
- Lingüística computacional
- La lingüística histórica
- Estudios de la evolución del lenguaje
Sus antecedentes:
- La familia de lenguas indoeuropeas es vasta, con relaciones históricas complejas.
- La comprensión de los patrones afines es crucial para reconstruir los protoidiomas y rastrear la evolución lingüística.
- Los conjuntos de datos existentes a menudo carecen de una cobertura completa o formatos estandarizados para el análisis computacional.
Objetivo del estudio:
- Introducir el conjunto de datos de Relaciones Cognadas Indoeuropeas (IE-CoR), un nuevo recurso para la investigación lingüística.
- Proporcionar un conjunto de datos de referencia para estudios computacionales sobre la evolución de las lenguas indoeuropeas.
- Facilitar el estudio de la herencia léxica y la transferencia horizontal entre las lenguas indoeuropeas.
Principales métodos:
- Compilación de un conjunto de datos relacionales que cubre 160 lenguas indoeuropeas.
- Análisis de 25.731 entradas de lexema en 4.981 conjuntos afines basados en 170 significados de referencia.
- Incluir datos sobre la transferencia horizontal, la calibración en el tiempo y los metadatos geográficos y sociales.
- Adherencia a los protocolos de formato de datos entre lenguas (CLDF) para la interoperabilidad.
Principales resultados:
- El conjunto de datos del IE-CDR contiene 25.731 entradas de léxicos en 160 idiomas, organizadas en 4.981 conjuntos afines.
- Representa los 13 principales clados indoeuropeos e incluye datos sobre la transferencia horizontal de palabras.
- El conjunto de datos incorpora la calibración del tiempo, los metadatos geográficos y sociales para un análisis mejorado.
Conclusiones:
- El conjunto de datos del IE-CoR ofrece un recurso completo y estandarizado para la lingüística histórica computacional.
- Sirve como un punto de referencia valioso para la investigación de la evolución de las lenguas indoeuropeas.
- El diseño del conjunto de datos promueve la interoperabilidad y puede servir de modelo para otras familias lingüísticas.
Más Videos Relacionados
07:28Studying Metabolic Brain Connectivity Using 2-Deoxy-2-[18F]Fluoro-D-Glucose Dynamic Positron Emission Tomography at the Single-subject Level
Published on: January 24, 2025
12:49Transcranial Direct Current Stimulation tDCS of Wernicke's and Broca's Areas in Studies of Language Learning and Word Acquisition
Published on: July 13, 2019
Videos de Conceptos Relacionados
Evolutionary Relationships through Genome Comparisons
Kendall's Coefficient of Concordance
Synteny and Evolution
Around 80 million years ago, the human and mice lineages diverged from the common ancestor. During the course of evolution, the ancestral...
Language and Cognition
Phylogeny
Convergent Evolution