Janus Recognition Toolkit ( JRTk ), a veces denominado Janus, es un conjunto de herramientas de reconocimiento de voz de propósito general desarrollado y mantenido por los Interactive Systems Laboratories de la Universidad Carnegie Mellon y el Instituto Tecnológico de Karlsruhe . Es útil tanto para la investigación como para el desarrollo de aplicaciones y forma parte del sistema de traducción de voz a voz JANUS. [ 1 ]
JRTk proporciona un entorno flexible basado en scripts Tcl/Tk que permite a los investigadores crear reconocedores de voz de última generación y desarrollar, implementar y evaluar nuevos métodos. Implementa un enfoque orientado a objetos que, a diferencia de otros conjuntos de herramientas, no consiste en un conjunto de bibliotecas y módulos precompilados, sino en un intérprete programable con objetos transparentes y eficientes.
Desde la versión 5, JRTk incorpora el decodificador IBIS, un decodificador de una sola pasada basado en un árbol de prefijos de pronunciación único reentrante que utiliza el concepto de polimorfismo del contexto lingüístico. Por lo tanto, puede incorporar todo el conocimiento lingüístico en una etapa temprana. Es posible decodificar en una sola pasada, utilizando el mismo motor en combinación con un modelo de lenguaje estadístico de n-gramas, así como con gramáticas libres de contexto. También es posible utilizar el decodificador para reevaluar retículos de forma muy eficiente.
JRTk utiliza el concepto de Modelos Ocultos de Markov (HMM) para el modelado acústico y ofrece numerosas técnicas de vanguardia para el preprocesamiento acústico, el entrenamiento de modelos acústicos y la decodificación del habla. Gracias a su arquitectura flexible y orientada a objetos, permite configurar todos los componentes de forma muy flexible (por ejemplo, pasos de preprocesamiento a ejecutar, topología del HMM, secuencia de entrenamiento, parámetros del algoritmo, secuencias de adaptación, etc.), sin necesidad de modificar el código fuente ni recompilarlo.
JRTk ha sido utilizado por Interactive System Labs en muchos proyectos de reconocimiento de voz, tales como:
Referencias
- ↑ Sebastian Stüker. "KIT - Janus Recognition Toolkit" . Isl.ira.uka.de. Archivado del original el 19 de julio de 2012. Consultado el 23 de abril de 2012 .
- ↑ Patricia Lichtblau (1 de febrero de 2012). "Puente UE - Página de inicio" . Eu-bridge.eu . Consultado el 23 de abril de 2012 .
- ↑ Esben Eidevik (15 de abril de 2012). "Página de inicio de EVEIL-3D" . Eveil-3d.eu . Consultado el 23 de abril de 2012 .
- ↑ "IARPA - Convocatorias - Oficina de Análisis Incisivo, Programa Babel" . Iarpa.gov. Archivado del original el 22 de abril de 2012. Consultado el 23 de abril de 2012 .
- ↑ "Bienvenido al sitio de Quaero" . Quaero.org. Archivado del original el 8 de mayo de 2001. Consultado el 23 de abril de 2012 .
- ↑ "SFB 588 - Robots Humanoides" . Sfb588.uni-karlsruhe.de . Consultado el 23 de abril de 2012 .
- ↑ "Comisión Europea : CORDIS : Servicio de Proyectos y Resultados : Tecnología y corpus para la traducción de voz a voz" . Cordis.europa.eu . Consultado el 16 de julio de 2016 .
- ↑ "Comisión Europea : CORDIS : Servicio de Proyectos y Resultados : Agente facilitador en el intercambio multicultural" . Cordis.europa.eu . Consultado el 16 de julio de 2016 .
- ↑ "Comisión Europea : CORDIS : Servicio de Proyectos y Resultados : Negociación mediante el lenguaje hablado en el comercio electrónico" . Cordis.europa.eu . Consultado el 16 de julio de 2016 .
- software de reconocimiento de voz