Un programa que traduce nuestra voz a otros idiomas

Investigadores de Microsoft han desarrollado un software capaz de aprender el sonido de nuestra voz y hacer que hablemos en un idioma distinto al materno. El sistema podría utilizarse para hacer que el software de aprendizaje de idiomas fuera más personal, o para crear herramientas para viajeros.

En una demostración realizada el martes de la semana pasada en Redmond, Washington (EE.UU.), el científico de investigación de Microsoft Frank Soong mostró cómo su software es capaz de leer un texto en español usando la voz de su jefe, Rick Rashid, director de las iniciativas de investigación de Microsoft.

Durante una segunda demostración, Soong utilizó su software para hacer que Craig Mundie, jefe de investigación y director de estrategia de Microsoft, pudiera hablar mandarín.

En inglés, una versión sintética de la voz de Mundie dio la bienvenida a los asistentes a una jornada de puertas abiertas celebrada por Microsoft Research, que acabó con la siguiente frase: "Con la ayuda de este sistema, puedo hablar mandarín". La frase se repitió en chino mandarín, con una voz similar a la de Mundie.

"Podremos crear distintas aplicaciones", señaló Soong, que desarrolló el sistema con sus colegas de Microsoft Research Asia, el segundo laboratorio de investigación más grande de la compañía localizado en Beijing, China.

"Para un hablante monolingüe que viaje a un país extranjero, ofreceremos reconocimiento de voz seguido por una traducción, y finalmente por un texto pasado a voz en un idioma diferente, pero conservando su propia voz", indicó Soong.

La nueva técnica también podría usarse para ayudar a los estudiantes a aprender un idioma, añadió. Proporcionar ejemplos de frases extranjeras con la voz propia de una persona podría ser alentador, o fácil de imitar. Soong también mostró cómo su nuevo sistema podría mejorar una aplicación telefónica de direcciones de navegación, permitiendo a una voz sintética en inglés leer a la perfección textos escritos en señales de tráfico chinas a lo largo de una ruta en Beijing.

El sistema necesita alrededor de una hora de entrenamiento para desarrollar un modelo capaz de leer cualquier texto con la voz de una persona. Ese modelo se convierte en otro capaz de leer textos en otro idioma, comparándolo con el modelo base de texto a voz del idioma de destino.

Los sonidos individuales utilizados por el primer modelo para construir palabras con la voz de una persona en su propia lengua han sido cuidadosamente ajustados para dar al nuevo modelo de texto a voz plena capacidad para pronunciar frases en la segunda lengua.

En la fotografía de arriba, ilustra la nota el traductor universal del "Capitán Kirk", en la serie "Viaje a las estrellas".

Fuente: Neo Teo