Video Experimental Relacionado
Updated: Jan 21, 2026

An Experimental Paradigm for Measuring the Effects of Ageing on Sentence Processing
Published on: October 25, 2019
Identificación de idiomas de bajos recursos en oraciones de código mixto de inglés y Kokborok
1Department of Computer Science & Engineering, National Institute of Technology; enjula.phd23@nitap.ac.in.
Este estudio presenta un modelo no supervisado para la detección de idiomas a nivel de palabra en texto de bajos recursos de inglés-Kokborok. El novedoso enfoque logra una precisión del 93,15%, superando los métodos existentes para la identificación de idiomas de código mixto.
Área de la Ciencia:
- Lingüística Computacional
- Procesamiento del Lenguaje Natural
- Tecnologías de Idiomas de Bajos Recursos
Sus antecedentes:
- El uso de texto multilingüe requiere la detección automática de idiomas.
- El cambio de código y la mezcla de códigos son prevalentes en muchos idiomas, incluidos los idiomas indios.
- La investigación existente a menudo pasa por alto pares de idiomas de bajos recursos.
Objetivo del estudio:
- Desarrollar un modelo no supervisado para la identificación del idioma a nivel de palabra.
- Abordar el desafío específico de detectar idiomas en texto de código mixto de inglés-Kokborok.
- Ser pionero en la identificación de idiomas para pares de idiomas de bajos recursos.
Principales métodos:
- Un enfoque híbrido que combina un diccionario de frecuencia con un modelo de n-gramas de caracteres.
- Utilización de la técnica de Viterbi para integrar un modelo de Markov de n-gramas de caracteres y un léxico de frecuencia.
- Un método no supervisado diseñado para escenarios de bajos recursos.
Principales resultados:
- Se logró una precisión a nivel de palabra del 93,15% para la identificación del idioma inglés-Kokborok.
- Superó al modelo BiLSTM-CRF (88,5%) y a una línea de base basada en reglas (85,3%).
- Demostró la eficacia de combinar métodos léxicos y estadísticos.
Conclusiones:
- El modelo no supervisado propuesto es eficaz para la detección de idiomas a nivel de palabra en entornos de bajos recursos.
- La combinación de enfoques léxicos y estadísticos es una estrategia viable para idiomas de bajos recursos.
- Este trabajo proporciona un método fundamental para analizar texto de código mixto en pares de idiomas no abordados previamente.
Más Videos Relacionados
Videos de Conceptos Relacionados
Language
Corballis and Suddendorf (2007) and Tomasello and Rakoczy (2003) highlight the role of language in...
Short-distance Transport of Resources
lncRNA - Long Non-coding RNAs
lncRNA - Long Non-coding RNAs
Components of Language
Language Development
The critical period for language acquisition suggests that the ability to acquire language is at its peak early in life. As people age, this proficiency decreases. Language development begins very...

