Articulo de referencia

SemEval

[[Computational linguistics]] [[Semantics]]"},"label3":{"wt":"Umbrella Organization:"},"data3":{"wt":"[http://www.clres.com/siglex.html ACL-SIGLEX] hhdgdhc"},"header4":{"wt":"Wo...

SemEval ( Evaluación Semántica ) es una serie continua de evaluaciones de sistemas de análisis semántico computacional ; surgió de la serie de evaluación del sentido de las palabras Senseval . El objetivo de estas evaluaciones es explorar la naturaleza del significado en el lenguaje. Si bien el significado es intuitivo para los humanos, transferir esas intuiciones al análisis computacional ha resultado difícil.

Esta serie de evaluaciones proporciona un mecanismo para caracterizar con mayor precisión lo que se requiere para realizar cálculos con significado. De este modo, las evaluaciones ofrecen un mecanismo emergente para identificar los problemas y las soluciones en los cálculos con significado. Estos ejercicios han evolucionado para articular más dimensiones involucradas en nuestro uso del lenguaje. Comenzaron con intentos aparentemente simples de identificar computacionalmente los sentidos de las palabras . Han evolucionado para investigar las interrelaciones entre los elementos de una oración (por ejemplo, la asignación de roles semánticos ), las relaciones entre oraciones (por ejemplo, la correferencia ) y la naturaleza de lo que decimos ( relaciones semánticas y análisis de sentimientos ).

El propósito de los ejercicios SemEval y Senseval es evaluar sistemas de análisis semántico. " Análisis semántico " se refiere a un análisis formal del significado, y "computacional" se refiere a enfoques que, en principio, apoyan una implementación efectiva. [ 1 ]

Las tres primeras evaluaciones, Senseval-1 a ​​Senseval-3, se centraron en la desambiguación del sentido de las palabras (WSD), aumentando en cada ocasión el número de idiomas ofrecidos en las tareas y el número de equipos participantes. A partir del cuarto taller, SemEval-2007 (SemEval-1), la naturaleza de las tareas evolucionó para incluir tareas de análisis semántico ajenas a la desambiguación del sentido de las palabras. [ 2 ]

Impulsada por la concepción de la conferencia *SEM , la comunidad SemEval decidió celebrar talleres de evaluación anualmente en colaboración con dicha conferencia. También se decidió que no todas las tareas de evaluación se realizarían cada año; por ejemplo, ninguna de las tareas de WSD se incluyó en el taller SemEval-2012.

Historia

Evaluación preliminar de algoritmos para la desambiguación del sentido de las palabras.

Desde sus inicios, la evaluación de la calidad de los algoritmos de desambiguación del sentido de las palabras se había centrado principalmente en la evaluación intrínseca , y «casi no se habían realizado intentos de evaluar los componentes WSD integrados». [ 3 ] Solo muy recientemente (2006) las evaluaciones extrínsecas comenzaron a aportar evidencia del valor de WSD en aplicaciones para usuarios finales. [ 4 ] Hasta aproximadamente 1990, los debates sobre la tarea de desambiguación del sentido se centraron principalmente en ejemplos ilustrativos en lugar de una evaluación exhaustiva. A principios de la década de 1990 se observaron los comienzos de evaluaciones intrínsecas más sistemáticas y rigurosas, incluyendo una experimentación más formal con pequeños conjuntos de palabras ambiguas. [ 5 ]

Senseval a SemEval

En abril de 1997, Martha Palmer y Marc Light organizaron un taller titulado Etiquetado con semántica léxica: ¿Por qué, qué y cómo? en conjunto con la Conferencia sobre Procesamiento Aplicado del Lenguaje Natural. [ 6 ] En ese momento, había un claro reconocimiento de que los corpus anotados manualmente habían revolucionado otras áreas del PLN, como el etiquetado de partes de la oración y el análisis sintáctico , y que los enfoques basados ​​en corpus tenían el potencial de revolucionar también el análisis semántico automático. [ 7 ] Kilgarriff recordó que había "un alto grado de consenso sobre la necesidad de evaluar el campo", y varias propuestas prácticas de Resnik y Yarowsky iniciaron una discusión que condujo a la creación de los ejercicios de evaluación de Senseval. [ 8 ] [ 9 ] [ 10 ]

Ciclo de 3, 2 o 1 año(s) de SemEval

Después de SemEval-2010, muchos participantes sienten que el ciclo de 3 años es una espera larga. Muchas otras tareas compartidas como Conference on Natural Language Learning (CoNLL) y Recognizing Textual Entailments (RTE) se llevan a cabo anualmente. Por esta razón, los coordinadores de SemEval dieron la oportunidad a los organizadores de tareas de elegir entre un ciclo de 2 años o uno de 3 años. [ 11 ] La comunidad de SemEval favoreció el ciclo de 3 años. Aunque los votos dentro de la comunidad de SemEval favorecieron un ciclo de 3 años, los organizadores y coordinadores habían acordado dividir la tarea de SemEval en 2 talleres de evaluación. Esto fue desencadenado por la introducción de la nueva conferencia *SEM . Los organizadores de SemEval pensaron que sería apropiado asociar nuestro evento con la conferencia *SEM y realizar el taller de SemEval junto con la conferencia *SEM. Los organizadores recibieron respuestas muy positivas (de los coordinadores/organizadores de las tareas y de los participantes) sobre la asociación con la conferencia anual *SEM, y 8 tareas se mostraron dispuestas a trasladarse a 2012. Así nacieron SemEval-2012 y SemEval-2013. El plan actual es adoptar un calendario anual para SemEval y asociarlo con la conferencia *SEM, pero no todas las tareas tienen que realizarse cada año. [ 12 ]

Lista de talleres de Senseval y SemEval

  • Senseval-1 tuvo lugar en el verano de 1998 para los idiomas inglés, francés e italiano, y culminó con un taller celebrado en el castillo de Herstmonceux, Sussex, Inglaterra, del 2 al 4 de septiembre.
  • Senseval-2 tuvo lugar en el verano de 2001, seguido de un taller celebrado en julio de 2001 en Toulouse, en conjunto con ACL 2001. Senseval-2 incluyó tareas para vasco , chino , checo , danés , neerlandés , inglés , estonio , italiano , japonés , coreano , español y sueco .
  • Senseval-3 tuvo lugar entre marzo y abril de 2004, seguido de un taller celebrado en julio de 2004 en Barcelona, ​​en el marco de ACL 2004. Senseval-3 incluyó 14 tareas diferentes para la desambiguación del sentido de las palabras, así como la identificación de roles semánticos, anotaciones multilingües, formas lógicas y adquisición de subcategorización.
  • SemEval-2007 (Senseval-4) tuvo lugar en 2007, seguido de un taller organizado conjuntamente con ACL en Praga. SemEval-2007 incluyó 18 tareas diferentes destinadas a la evaluación de sistemas para el análisis semántico de texto. Un número especial de Language Resources and Evaluation está dedicado a los resultados. [ 13 ]
  • SemEval-2010 tuvo lugar en 2010, seguido de un taller organizado conjuntamente con ACL en Uppsala. SemEval-2010 incluyó 18 tareas diferentes destinadas a la evaluación de sistemas de análisis semántico.
  • SemEval-2012 tuvo lugar en 2012; estuvo asociada a la nueva *SEM, Primera Conferencia Conjunta sobre Semántica Léxica y Computacional, y se celebró conjuntamente con NAACL en Montreal, Canadá. SemEval-2012 incluyó ocho tareas diferentes destinadas a evaluar sistemas semánticos computacionales. Sin embargo, no se incluyó ninguna tarea de WSD en SemEval-2012; las tareas relacionadas con WSD se programaron para la próxima edición de SemEval-2013.
  • SemEval-2013 estuvo asociado con NAACL 2013, la Asociación Norteamericana de Lingüística Computacional, Georgia, EE. UU., y tuvo lugar en 2013. Incluyó 13 tareas diferentes destinadas a evaluar sistemas semánticos computacionales.
  • SemEval-2014 tuvo lugar en 2014. Se celebró conjuntamente con COLING 2014, la 25.ª Conferencia Internacional sobre Lingüística Computacional, y SEM 2014, la Segunda Conferencia Conjunta sobre Semántica Léxica y Computacional, en Dublín, Irlanda. SemEval-2014 incluyó 10 tareas diferentes para evaluar diversos sistemas semánticos computacionales.
  • SemEval-2015 tuvo lugar en 2015. Se celebró conjuntamente con NAACL-HLT 2015, la conferencia de 2015 del capítulo norteamericano de la Asociación de Lingüística Computacional – Tecnologías del Lenguaje Humano, y *SEM 2015, la Tercera Conferencia Conjunta sobre Semántica Léxica y Computacional, en Denver, EE. UU. SemEval-2015 incluyó 17 tareas diferentes para evaluar diversos sistemas semánticos computacionales.

Marco del taller SemEval

El marco de los talleres de evaluación SemEval/Senseval emula las Conferencias de Comprensión de Mensajes (MUC) y otros talleres de evaluación organizados por ARPA (Advanced Research Projects Agency, ahora denominada Defense Advanced Research Projects Agency (DARPA) ).

Marco de SemEval, adaptado de la introducción de MUC.
Marco de SemEval, adaptado de la introducción de MUC.

Etapas de los talleres de evaluación SemEval/Senseval [ 14 ]

  1. En primer lugar, se invitó a todos los posibles participantes a expresar su interés y a participar en el diseño del ejercicio.
  2. Se elaboró ​​un cronograma para el taller final.
  3. Se acordó un plan para seleccionar los materiales de evaluación.
  4. Se adquirieron "estándares de oro" para cada tarea; a menudo, los anotadores humanos se consideraban un estándar de oro para medir la precisión y la exhaustividad de los sistemas informáticos. Estos "estándares de oro" son a los que aspiran los sistemas computacionales. En las tareas de WSD, se encomendó a los anotadores humanos la tarea de generar un conjunto de respuestas correctas de WSD (es decir, el sentido correcto de una palabra dada en un contexto dado).
  5. Los materiales de referencia, sin respuestas, se entregaron a los participantes, quienes tuvieron un breve plazo para ejecutar sus programas sobre ellos y devolver sus conjuntos de respuestas a los organizadores.
  6. Posteriormente, los organizadores calificaron las respuestas y las puntuaciones se anunciaron y se debatieron en un taller.

Tareas de evaluación semántica

Senseval-1 y Senseval-2 se centraron en la evaluación de sistemas WSD en los principales idiomas que contaban con corpus y diccionarios informatizados disponibles. Senseval-3 fue más allá de los lexemas y comenzó a evaluar sistemas que analizaban áreas más amplias de la semántica, como los roles semánticos (técnicamente conocidos como roles Theta en semántica formal), la transformación de la forma lógica (comúnmente la semántica de frases, cláusulas u oraciones se representaba en formas lógicas de primer orden ) y Senseval-3 exploró el rendimiento del análisis semántico en la traducción automática .

A medida que los diferentes tipos de sistemas semánticos computacionales superaron la cobertura de WSD, Senseval evolucionó a SemEval, donde se evaluaban más aspectos de los sistemas semánticos computacionales.

Panorama general de los problemas en el análisis semántico

Los ejercicios de SemEval proporcionan un mecanismo para examinar cuestiones del análisis semántico de textos. Los temas de interés no alcanzan el rigor lógico de la semántica computacional formal, que busca identificar y caracterizar los tipos de problemas relevantes para la comprensión humana del lenguaje. El objetivo principal es replicar el procesamiento humano mediante sistemas informáticos. Las tareas (que se muestran a continuación) son desarrolladas por individuos y grupos para abordar problemas identificables, a medida que estos adquieren una forma concreta.

El primer ámbito importante del análisis semántico es la identificación del significado intencionado a nivel de palabra (incluyendo expresiones idiomáticas). Esto se conoce como desambiguación de sentidos (un concepto que está evolucionando, alejándose de la idea de que las palabras tienen sentidos discretos y, en cambio, se caracterizan por su uso, es decir, por su contexto). Las tareas en este ámbito incluyen la desambiguación de muestras léxicas y de palabras completas, la desambiguación multilingüe e interlingüística y la sustitución léxica. Dada la dificultad de identificar los sentidos de las palabras, otras tareas relevantes para este tema incluyen la inducción de sentidos, la adquisición de subcategorizaciones y la evaluación de recursos léxicos.

La segunda área principal del análisis semántico es la comprensión de cómo se relacionan los diferentes elementos oracionales y textuales. Las tareas en esta área incluyen el etiquetado de roles semánticos, el análisis de relaciones semánticas y la resolución de correferencias. Otras tareas abordan cuestiones más especializadas del análisis semántico, como el procesamiento de información temporal, la resolución de metonimias y el análisis de sentimientos. Estas tareas tienen numerosas aplicaciones potenciales, como la extracción de información, la respuesta a preguntas, el resumen de documentos, la traducción automática, la construcción de tesauros y redes semánticas, el modelado del lenguaje, la paráfrasis y el reconocimiento de implicaciones textuales. En cada una de estas aplicaciones potenciales, la contribución de los distintos tipos de análisis semántico constituye el tema de investigación más relevante.

Por ejemplo, en la tarea de inducción del sentido de las palabras y desambiguación , hay tres fases separadas:

  1. En la fase de entrenamiento , se pidió a los participantes de la tarea de evaluación que utilizaran un conjunto de datos de entrenamiento para generar los inventarios de sentidos de un conjunto de palabras polisémicas. El conjunto de datos de entrenamiento consistía en un conjunto de sustantivos/verbos polisémicos y las instancias de oraciones en las que aparecían. No se permitieron otros recursos aparte de los componentes de procesamiento del lenguaje natural morfológicos y sintácticos, como analizadores morfológicos , etiquetadores de partes de la oración y analizadores sintácticos .
  2. En la fase de prueba , se proporcionó a los participantes un conjunto de pruebas para la subtarea de desambiguación utilizando el inventario de sentidos inducidos de la fase de entrenamiento.
  3. En la fase de evaluación , las respuestas de la fase de prueba se evaluaron en un marco supervisado y no supervisado .

La evaluación no supervisada para WSI consideró dos tipos de evaluación: la medida V (Rosenberg y Hirschberg, 2007) y la puntuación F pareada (Artiles et al., 2009). Esta evaluación sigue la evaluación supervisada de la tarea WSI de SemEval-2007 (Agirre y Soroa, 2007).

Descripción general de las tareas de Senseval y SemEval

Las tablas que aparecen a continuación reflejan la evolución del taller desde Senseval hasta SemEval y ofrecen una visión general de qué áreas de la semántica computacional se evaluaron a lo largo de los talleres Senseval/SemEval.

La tarea de desambiguación del sentido de las palabras multilingüe (WSD) se presentó en el taller SemEval-2013. [ 17 ] Esta tarea tiene como objetivo evaluar sistemas de desambiguación del sentido de las palabras en un escenario multilingüe utilizando BabelNet como su inventario de sentidos. A diferencia de tareas similares como la WSD interlingüe o la tarea de sustitución léxica multilingüe , donde no se especifica un inventario de sentidos fijo, la WSD multilingüe utiliza BabelNet como su inventario de sentidos. Antes del desarrollo de BabelNet, se llevó a cabo una tarea de evaluación de WSD con muestras léxicas bilingües en SemEval-2007 sobre bitextos chino-inglés. [ 18 ]

La tarea de desambiguación del sentido de las palabras entre idiomas se presentó en el taller de evaluación SemEval-2007 y se volvió a proponer en el taller SemEval-2013. [ 19 ] Para facilitar la integración de sistemas de desambiguación del sentido de las palabras en otras aplicaciones de procesamiento del lenguaje natural (PLN), como la traducción automática y la recuperación de información multilingüe , se introdujo la tarea de evaluación de desambiguación del sentido de las palabras entre idiomas, un enfoque independiente del idioma y con poco conocimiento para la desambiguación del sentido de las palabras. La tarea es una tarea de desambiguación del sentido de las palabras no supervisada para sustantivos en inglés mediante corpus paralelos. Sigue la variante de muestra léxica de la tarea clásica de desambiguación del sentido de las palabras, restringida a solo 20 sustantivos polisémicos.

Cabe destacar que SemEval-2014 solo tiene dos tareas que eran multilingües/interlingües, a saber: (i) la tarea de Asistente de Escritura en L2 , que es una tarea interlingüe de WSD que incluye inglés, español, alemán, francés y holandés, y (ii) la tarea de Similitud Textual Semántica Multilingüe que evalúa sistemas en textos en inglés y español.

Áreas de evaluación

Las principales tareas en la evaluación semántica incluyen las siguientes áreas del procesamiento del lenguaje natural . Se espera que esta lista crezca a medida que el campo avance. [ 20 ]

La siguiente tabla muestra las áreas de estudio que participaron en Senseval-1 hasta SemEval-2014 (S se refiere a Senseval y SE se refiere a SemEval, por ejemplo, S1 se refiere a Senseval-1 y SE07 se refiere a SemEval2007):

Tipo de anotaciones semánticas

Las tareas de SemEval han generado muchos tipos de anotaciones semánticas, cada una con su propio esquema. En SemEval-2015, los organizadores decidieron agrupar las tareas en varias categorías. Estas categorías se basan en el tipo de anotaciones semánticas que se pretenden lograr. [ 21 ] A continuación se enumeran los tipos de anotaciones semánticas que se utilizan en los talleres de SemEval:

  1. Aprendizaje de relaciones semánticas
  2. Preguntas y respuestas
  3. Análisis semántico
  4. Taxonomía semántica
  5. Análisis de sentimientos
  6. Similitud de texto
  7. Tiempo y espacio
  8. Desambiguación e inducción del sentido de las palabras

La asignación de una tarea y su pista es flexible; una tarea podría convertirse en su propia pista, por ejemplo, la tarea de evaluación de taxonomía en SemEval-2015 estaba dentro de la pista de Aprendizaje de Relaciones Semánticas y en SemEval-2016, hay una pista dedicada a la Taxonomía Semántica con una nueva tarea de Enriquecimiento de la Taxonomía Semántica . [ 22 ] [ 23 ]

Véase también

Referencias

  1. Blackburn, P., y Bos, J. (2005), Representación e inferencia para el lenguaje natural: Un primer curso de semántica computacional , CSLI Publications. ISBN 1-57586-496-7.
  2. Navigli, R (2009). "Desambiguación del sentido de las palabras". ACM Computing Surveys . 41 (2): 1– 69. doi : 10.1145/1459352.1459355 . S2CID 461624 . 
  3. Palmer, M., Ng, HT y Hoa, TD (2006), Evaluación de sistemas WSD , en Eneko Agirre y Phil Edmonds (eds.), Desambiguación del sentido de las palabras: algoritmos y aplicaciones , Text, Speech and Language Technology, vol. 33. Ámsterdam: Springer, 75–106.
  4. Resnik, P. (2006), WSD en aplicaciones de PLN , en Eneko Agirre y Phil Edmonds (eds.), Desambiguación del sentido de las palabras: algoritmos y aplicaciones. Dordrecht: Springer, 299–338.
  5. Yarowsky, D. (1992), Desambiguación del sentido de las palabras mediante modelos estadísticos de las categorías de Roget entrenados con grandes corpus . Actas de la 14.ª Conferencia sobre Lingüística Computacional, 454–60. doi : 10.3115/992133.992140
  6. Palmer, M., & Light, M. (1999), Etiquetado con semántica léxica: ¿Por qué, qué y cómo? | Taller ACL SIGLEX sobre etiquetado de texto con semántica léxica: ¿qué, por qué y cómo? Archivado el 15 de julio de 2010 en Wayback Machine Natural Language Engineering 5(2): i–iv.
  7. Ng, HT (1997), Tomarse en serio la desambiguación del sentido de las palabras . Actas del taller ACL SIGLEX sobre etiquetado de texto con semántica léxica: ¿Por qué, qué y cómo? 1–7.
  8. Philip Resnik y Jimmy Lin (2010). Evaluación de sistemas de PLN . En Alexander Clark, Chris Fox y Shalom Lappin (eds.). Manual de lingüística computacional y procesamiento del lenguaje natural. Wiley-Blackwellis. 11:271
  9. Adam Kilgarriff y Martha Palmer (eds. 2000). Número especial de Computers and the Humanities, SENSEVAL98: Evaluación de sistemas de desambiguación del sentido de las palabras . Kluwer, 34: 1–2.
  10. Scott Cotton, Phil Edmonds, Adam Kilgarriff y Martha Palmer (eds. 2001). SENSEVAL-2: Segundo taller internacional sobre evaluación de sistemas de desambiguación del sentido de las palabras . Taller SIGLEX, ACL03, Toulouse, Francia.
  11. SIGLEX: Foro de mensajes (2010) Recuperado el 15 de agosto de 2012 de http://www.clres.com/siglex/messdisp.php?id=111
  12. Publicación del grupo de Google SemEval 3. Recuperado el 15 de agosto de 2012 de https://groups.google.com/forum/?fromgroups#!topic/semeval3/8YXMvVlH-CM%5B1-25%5D
  13. Recursos y evaluación del lenguaje Volumen 43, Número 2
  14. Kilgarriff, A. (1998). SENSEVAL: Un ejercicio de evaluación de programas de desambiguación del sentido de las palabras . En Actas de LREC, Granada, mayo de 1998. Págs. 581-588.
  15. "Tareas < SemEval-2017" . alt.qcri.org . Consultado el 4 de mayo de 2018 .
  16. "Tareas < SemEval-2018" . alt.qcri.org . Consultado el 4 de mayo de 2018 .
  17. Navigli, R., Jurgens, D., & Vannella, D. (2013, junio). Tarea 12 de Semeval-2013: Desambiguación del sentido de las palabras en varios idiomas. En Actas del 7.º Taller Internacional sobre Evaluación Semántica (SemEval 2013), en conjunto con la Segunda Conferencia Conjunta sobre Semántica Léxica y Computacional (* SEM 2013) (págs. 222-231).
  18. Peng Jin, Yunfang Wu y Shiwen Yu. Tarea 05 de SemEval-2007: muestra léxica multilingüe chino-inglés . Actas del 4.º Taller Internacional sobre Evaluaciones Semánticas, págs. 19-23, 23-24 de junio de 2007, Praga, República Checa.
  19. Lefever, E., & Hoste, V. (2013, junio). Tarea 10 de Semeval-2013: Desambiguación del sentido de las palabras entre idiomas. En Segunda conferencia conjunta sobre semántica léxica y computacional (Vol. 2, pp. 158-166).
  20. Portal SemEval (s.f.). En ACLwiki. Recuperado el 12 de agosto de 2010 de http://aclweb.org/aclwiki/index.php?title=SemEval_Portal
  21. Sitio web de SemEval-2015 . Consultado el 14 de noviembre de 2014. http://alt.qcri.org/semeval2015/index.php?id=tasks
  22. Georgeta Bordea, Paul Buitelaar, Stefano Faralli y Roberto Navigli. 2015. Tarea 17 de Semeval-2015: Evaluación de extracción de taxonomías (TExEval) . En Actas del 9.º Taller Internacional sobre Evaluación Semántica. Denver, EE. UU.
  23. Sitio web de SemEval-2016 . Consultado el 4 de junio de 2015. http://alt.qcri.org/semeval2016/
  • Grupo de Interés Especial en el Léxico (SIGLEX) de la Asociación de Lingüística Computacional. Archivado el 25/01/2008 en la Wayback Machine (ACL).
  • Semeval-2010 – Taller de Evaluación Semántica (avalado por SIGLEX)
  • Senseval : organización internacional dedicada a la evaluación de sistemas de desambiguación del sentido de las palabras (avalada por SIGLEX).
  • Portal SemEval en la Wiki de la Asociación de Lingüística Computacional
  • Tareas de Senseval / SemEval:
    • Senseval-1 : el primer ejercicio de evaluación de sistemas de desambiguación del sentido de las palabras; la tarea de muestra léxica se evaluó en inglés, francés e italiano.
    • Senseval-2 evaluó los sistemas de desambiguación del sentido de las palabras en tres tipos de tareas (la de todas las palabras, la de muestras léxicas y la de traducción).
    • Senseval-3 incluía tareas para la desambiguación del sentido de las palabras, así como la identificación de roles semánticos, anotaciones multilingües, formas lógicas y adquisición de subcategorización.
    • SemEval-2007 incluyó tareas más elaboradas que Senseval, ya que abarca diferentes áreas de estudio en el procesamiento del lenguaje natural.
    • SemEval-2010 añadió tareas pertenecientes a nuevas áreas de estudio en semántica computacional, a saber: correferencia, elipsis, extracción de frases clave, sustantivos compuestos e implicación textual.
    • SemEval-2012 – se celebró conjuntamente con la primera conferencia *SEM y la Tarea de Similitud Semántica se promocionó como la Tarea Compartida *SEM
    • SemEval-2013 – SemEval pasó de un ciclo de 2 a 3 años a un taller anual.
    • SemEval-2014 : la primera vez que SemEval se ubica en un evento que no pertenece a la ACL en COLING.
    • SemEval-2015 : el primer SemEval con tareas categorizadas en varias pistas.
    • SemEval-2016 : la segunda edición de SemEval sin una tarea WSD (la primera fue en SemEval-2012).
    • *SEM – conferencia para artículos relacionados con SemEval que no sean sistemas de tareas.
  • Conferencias de comprensión de mensajes (MUC)
  • BabelNet
  • WordNet multilingüe abierto archivado el 19/08/2014 en Wayback Machine – Compilación de WordNets con licencias abiertas