Moses es un motor de traducción automática estadística que se puede utilizar para entrenar modelos estadísticos de traducción de texto de un idioma de origen a un idioma de destino, desarrollado por la Universidad de Edimburgo . [ 2 ] Moses permite decodificar nuevos textos en el idioma de origen utilizando estos modelos para producir traducciones automáticas en el idioma de destino. El entrenamiento requiere un corpus paralelo de pasajes en los dos idiomas, normalmente pares de oraciones traducidas manualmente. Moses es software libre y de código abierto , publicado bajo la Licencia Pública General de la Biblioteca GNU (LGPL), y disponible como código fuente y archivos binarios para Windows [ 3 ] y Linux . Su desarrollo está respaldado principalmente por el proyecto EuroMatrix , con financiación de la Comisión Europea .
Entre sus características se encuentran:
- Un algoritmo de búsqueda en haz que encuentra rápidamente la traslación de mayor probabilidad dentro de un conjunto de opciones.
- Traducción de fragmentos de texto cortos basada en frases.
- Maneja palabras con múltiples representaciones factorizadas para permitir la integración de información lingüística y de otro tipo (por ejemplo, forma superficial, lema y morfología , categoría gramatical , clase de palabra).
- Decodifica las formas ambiguas de una oración fuente, representadas como una red de confusión , para facilitar la integración con herramientas anteriores, como los reconocedores de voz.
- Compatibilidad con modelos de lenguaje (ML) grandes como IRSTLM (un ML exacto que utiliza mapeo de memoria ) y RandLM (un ML inexacto basado en filtros de Bloom ).
Véase también
Referencias
Lecturas adicionales
- Philipp Koehn, Hieu Hoang, Alexandra Birch, Chris Callison-Burch, Marcello Federico, Nicola Bertoldi, Brooke Cowan, Wade Shen, Christine Moran, Richard Zens, Chris Dyer, Ondrej Bojar, Alexandra Constantin, Evan Herbst. (2007) "Moses: Kit de herramientas de código abierto para la traducción automática estadística". Reunión anual de la Asociación de Lingüística Computacional (ACL), sesión de demostración, Praga, República Checa, junio de 2007 .
Enlaces externos
- Sitio web oficial
- Kit de herramientas IRST LM en SourceForge
- RandLM en SourceForge
- Software de traducción automática
- Kits de herramientas para el procesamiento del lenguaje natural
- Software libre programado en C++
- Procesamiento estadístico del lenguaje natural
- Fragmentos de traducción
- Stubs de procesamiento del lenguaje natural