Articulo de referencia

Garak (software)

garak es una herramienta de seguridad informática que proporciona información sobre vulnerabilidades de seguridad en modelos de lenguaje y sistemas de diálogo, y facilita las p...

garak es una herramienta de seguridad informática que proporciona información sobre vulnerabilidades de seguridad  en modelos de lenguaje y sistemas de diálogo, y facilita las pruebas de penetración y el análisis de vulnerabilidades (red teaming ). Cuenta con el respaldo de Nvidia. Oficialmente, su nombre es la abreviatura de "generative AI red-teaming & assessment kit" (kit de evaluación y análisis de IA generativa).

Garak se describe como el escáner de vulnerabilidades LLM líder en una revisión independiente de 2024 realizada por Fujitsu Research . [ 1 ] Se utiliza y recomienda como herramienta en artículos de Microsoft, [ 2 ] Trend Micro, [ 3 ] Nvidia [ 4 ] y Cisco, [ 5 ] y ha sido cubierto en importantes medios de noticias de TI. [ 6 ] [ 7 ]

Historia

garak fue desarrollado en la primavera de 2023 por el profesor Leon Derczynski de la ITU Copenhague [ 8 ] durante un año sabático en la Universidad de Washington . Se publicó por primera vez bajo la licencia GPL el 13 de junio de 2023. [ 9 ] Posteriormente, la licencia se actualizó a Apache 2.0. El software ahora está alojado en Nvidia, donde se mantiene como un proyecto de código abierto con soporte a largo plazo, y ha estado disponible a través del GitHub público de Nvidia desde noviembre de 2024. [ 10 ]

Estructura

Los componentes principales de garak son sondas , generadores y detectores . [ 11 ] Las sondas gestionan los ataques e implementan una técnica adversaria. Los generadores abstraen los objetivos, que pueden ser un LLM, un sistema de diálogo o cualquier cosa que pueda tomar texto y devolver texto (además de otras modalidades opcionales). Las sondas intentan atacar a los generadores y pasan la salida resultante a un detector. Los detectores evalúan si la salida indica o no un ataque exitoso. Todo se compila en un informe mediante una página HTML y un objeto JSON que resume los resultados.

Véase también

Referencias

  1. Brokman, Jonathan (2025). «Perspectivas y brechas actuales en los escáneres de vulnerabilidades LLM de código abierto: un análisis comparativo». 2025 IEEE/ACM International Workshop on Responsible AI Engineering (RAIE) . pp. 1–8 . doi : 10.1109/RAIE66699.2025.00005 . ISBN  979-8-3315-1466-2.
  2. Kumar, Ram Shankar Siva (22 de febrero de 2024). "Anuncio del marco de automatización abierto de Microsoft para sistemas de IA generativa de equipos rojos" . Microsoft . Recuperado el 7 de septiembre de 2025 .
  3. "Explotando DeepSeek-R1: Rompiendo la seguridad de la cadena de pensamiento" . Trend Micro. 4 de marzo de 2025. Consultado el 7 de septiembre de 2025 .
  4. Briski, Kari (16 de enero de 2025). "NVIDIA lanza microservicios NIM para proteger las aplicaciones de IA ágínica" . NVIDIA . Consultado el 7 de septiembre de 2025 .
  5. "Detección de servidores LLM expuestos: un estudio de caso de Shodan sobre Ollama" . Cisco. Septiembre de 2025. Consultado el 7 de septiembre de 2025 .
  6. "Justo cuando tu máster en Derecho vuelve a descarrilarse, Cisco y Nvidia están en la puerta sonriendo" . The Register . Consultado el 7 de septiembre de 2025 .
  7. Balaji (6 de enero de 2025). "Garak: un escáner de vulnerabilidades LLM de código abierto para pruebas de penetración en IA" . GBHackers .
  8. Jensen, Theis Duelund. "Investigador de la UIT desarrolla software para proteger modelos de lenguaje a gran escala" . Universidad de TI de Copenhague . Consultado el 7 de septiembre de 2025 .
  9. "garak 0.9" . PyPI . Consultado el 7 de septiembre de 2025 .
  10. ^ "NVIDIA lanza Garak para proteger los LLM" . Revista Analytics India . 18 de noviembre de 2024 . Consultado el 7 de septiembre de 2025 .
  11. ^ Derczynski, León; Galinkin, Erick; Martín, Jeffrey; Majumdar, Subho; Inie, Nanna (2024). "garak: un marco para la prueba de seguridad de modelos de lenguajes grandes". arXiv : 2406.11036 [ cs.CL ].
  • Sitio web oficial
  • garak en el Índice de Paquetes de Python
  • garak en GitHub
  • Charla de Garak en DEF CON 2024
  • Vulnerabilidad de LLM en Nvidia NeMo Guardrails
  • Seguridad de Nvidia para la IA agencial