

Por Redacción
Con el propósito de impulsar la investigación en tecnologías del lenguaje y contribuir a la preservación de las lenguas indígenas de México, los investigadores Arturo Olvera López e Iván Olmos Pineda, académicos de la Facultad de Ciencias de la Computación de la BUAP, desarrollan el proyecto ZETZOHO-YUHMU. SPEECH DATASET, un repositorio de datos de voz enfocado en el estudio de lenguas con pocos recursos y en riesgo de desaparición.
El proyecto reúne un conjunto de datos de la lengua Yuhmu, una variante del otomí, diseñado para apoyar investigaciones en reconocimiento automático del habla (ASR, por sus siglas en inglés) y en el análisis de la pronunciación en contextos donde la disponibilidad de información lingüística es limitada.
Además de servir como herramienta para el desarrollo de sistemas de reconocimiento de voz, el repositorio proporciona una base para crear aplicaciones que ofrezcan retroalimentación sobre la pronunciación durante el aprendizaje de idiomas y fortalezcan las acciones de documentación y conservación de las lenguas originarias del país.
En esta iniciativa también participan los investigadores Eric Ramos-Aguilar, Ricardo Ramos-Aguilar y Daniel Sánchez-Ruiz, de la Unidad Profesional Interdisciplinaria de Ingeniería del Instituto Politécnico Nacional, campus Tlaxcala (UPIIT-IPN), resultado de una colaboración interinstitucional orientada a ampliar los recursos tecnológicos para el estudio del patrimonio lingüístico nacional.
El repositorio, denominado Conjunto de datos de voz de Zetzoho-Yuhmu, es de acceso libre para investigadores, desarrolladores y especialistas interesados en el procesamiento del lenguaje natural y las tecnologías del habla aplicadas a lenguas indígenas.
Al respecto, el investigador Arturo Olvera López destacó la importancia de poner este recurso al alcance de la comunidad científica.
«El repositorio es de libre acceso y puede ser de mucha utilidad para la comunidad que hace investigación relacionada al procesamiento del lenguaje natural considerando lenguas indígenas en México que actualmente están poco representadas respecto a la cantidad de personas hablantes de la lengua», señaló.
Con este proyecto, la BUAP fortalece la investigación en inteligencia artificial, procesamiento del lenguaje natural y tecnologías del habla, al tiempo que contribuye a la preservación, documentación y difusión de la diversidad lingüística de México mediante herramientas de acceso abierto.



Deja un comentario