Investigadores de BUAP e IPN crean dataset de voz para estudiar y preservar la lengua Yuhmu

investigacion
  • Investigadores de la BUAP y el IPN desarrollan un conjunto de datos de voz para preservar la lengua Yuhmu.

Investigadores de la Facultad de Ciencias de la Computación de la BUAP y de la Unidad Profesional Interdisciplinaria de Ingeniería del Instituto Politécnico Nacional, campus Tlaxcala (UPIIT-IPN) participan en el proyecto ZETZOHO-YUHMU. SPEECH DATASET, una iniciativa enfocada en el estudio, documentación y preservación de lenguas indígenas con pocos recursos lingüísticos.

El proyecto busca fortalecer el estudio de la lengua Yuhmu mediante tecnología de voz

En el proyecto colaboran los catedráticos e investigadores Arturo Olvera López e Iván Olmos Pineda, de la Facultad de Ciencias de la Computación, así como Eric Ramos-Aguilar, Ricardo Ramos-Aguilar y Daniel Sánchez-Ruiz, de la UPIIT-IPN.

El repositorio presenta un conjunto de datos orientado al análisis de lenguas con pocos recursos y en riesgo de desaparecer, entre ellas la lengua Yuhmu, una variante de la lengua otomí. Su objetivo es ofrecer herramientas y materiales que permitan avanzar en la investigación del reconocimiento automático del habla (ASR) y en el análisis de la pronunciación en contextos donde existe una cantidad limitada de información lingüística disponible.

Los datos de voz pueden apoyar el aprendizaje y la preservación de lenguas indígenas

El conjunto de datos constituye una base para el desarrollo de sistemas tecnológicos capaces de ofrecer retroalimentación sobre la pronunciación durante los procesos de aprendizaje de idiomas.

Además, el proyecto puede contribuir a los esfuerzos de preservación, documentación y fortalecimiento de las lenguas indígenas en México, particularmente aquellas que cuentan con una representación limitada en las tecnologías relacionadas con el procesamiento del lenguaje natural.

Un repositorio de libre acceso para la investigación lingüística y tecnológica

De acuerdo con Arturo Olvera López, el repositorio es de libre acceso y puede ser de utilidad para la comunidad científica que desarrolla investigaciones relacionadas con el procesamiento del lenguaje natural y las lenguas indígenas mexicanas.

El investigador destacó la importancia de generar recursos tecnológicos para idiomas que actualmente se encuentran poco representados en comparación con la cantidad de personas que los hablan.

El proyecto ZETZOHO-YUHMU. SPEECH DATASET puede consultarse como un recurso para investigadores, desarrolladores y especialistas interesados en el reconocimiento del habla, la inteligencia artificial, el procesamiento del lenguaje natural y la preservación de la diversidad lingüística de México.


Nosotros

Paralelo 19 es un periódico digital que tiene como principal objetivo mantener informada a la ciudadanía de manera veraz y objetiva.

El proyecto nace de la inquietud de periodistas, emprendedores y comunicólogos de otorgar la mejor información a los lectores en todos sus sectores; el político, el social, el cultural, el deportivo, el laboral, el empresarial y el religioso, con la finalidad de brindarles una experiencia multimedia que satisfaga las necesidades de la audiencia.

Leer más…