PUEBLA, México. Arturo Olvera López e Iván Olmos Pineda, profesores e investigadores de la Facultad de Ciencias de la Computación de la Benemérita Universidad Autónoma de Puebla (BUAP), participan en el desarrollo del proyecto ZETZOHO-YUHMU. SPEECH DATASET, un repositorio de datos enfocado en la conservación y estudio de la lengua Yuhmu, una variante del otomí considerada en riesgo de extinción.
El proyecto está diseñado para impulsar investigaciones en reconocimiento automático del habla (ASR, por sus siglas en inglés) y el análisis de pronunciación en contextos donde los datos lingüísticos son escasos.
Preservación tecnológica y desarrollo multidisciplinario
La herramienta ofrece una base técnica destinada al entrenamiento de sistemas de retroalimentación de pronunciación para el aprendizaje del idioma, al tiempo que refuerza las iniciativas interinstitucionales de documentación digital y preservación de lenguas indígenas originarias de México.
En la consolidación de este conjunto de datos colaboran también los investigadores Eric Ramos-Aguilar, Ricardo Ramos-Aguilar y Daniel Sánchez-Ruiz, adscritos a la Unidad Profesional Interdisciplinaria de Ingeniería del Instituto Politécnico Nacional, campus Tlaxcala (UPIIT-IPN).
Acceso abierto para la investigación científica
Sobre el impacto de la plataforma, el doctor Arturo Olvera López destacó la apertura del acervo científico para el desarrollo de nuevas tecnologías aplicadas a la diversidad lingüística:
«El repositorio es de libre acceso y puede ser de mucha utilidad para la comunidad que hace investigación relacionada al procesamiento del lenguaje natural considerando lenguas indígenas en México que actualmente están poco representadas respecto a la cantidad de personas hablantes de la lengua», concluyó el investigador.













