BUAP e IPN crean repositorio digital para preservar la lengua Yuhmu con inteligencia artificial
- El conjunto de datos de libre acceso permitirá estudiar la pronunciación, desarrollar sistemas de reconocimiento de voz y documentar esta variante del otomí en peligro de extinción.
Académicos de la BUAP y del Instituto Politécnico Nacional desarrollaron el proyecto ZETZOHO-YUHMU Speech Dataset, un repositorio digital orientado al estudio, documentación y preservación de la lengua Yuhmu, variante del otomí considerada entre las lenguas con pocos recursos tecnológicos.
La iniciativa es encabezada por Arturo Olvera López e Iván Olmos Pineda, investigadores de la Facultad de Ciencias de la Computación de la BUAP. También participan especialistas de la UPIIT-IPN, campus Tlaxcala, quienes colaboraron en la integración y procesamiento del material lingüístico.

El repositorio reúne datos de voz que podrán emplearse en proyectos de reconocimiento automático del habla, análisis de pronunciación y procesamiento del lenguaje natural, especialmente en escenarios donde existen pocos registros disponibles para entrenar modelos tecnológicos.
Además de apoyar la investigación, la información servirá como base para crear herramientas que ofrezcan retroalimentación durante el aprendizaje de la lengua y contribuyan a conservar su pronunciación. La tecnología se convierte así en una aliada para evitar la pérdida de conocimiento lingüístico y cultural.

Arturo Olvera destacó que el material es de libre acceso y puede ser utilizado por comunidades académicas interesadas en lenguas indígenas mexicanas, las cuales continúan poco representadas en bases de datos, aplicaciones digitales y sistemas de inteligencia artificial.







