Articulo de referencia

Gestión de eventos (ITIL)

La gestión de eventos , según la define ITIL , es el proceso que supervisa todos los eventos que ocurren a través de la infraestructura de TI . Permite el funcionamiento normal,...

La gestión de eventos , según la define ITIL , es el proceso que supervisa todos los eventos que ocurren a través de la infraestructura de TI . Permite el funcionamiento normal, detectando cambios de estado y escalando eventos de excepción y otras prioridades. [ 1 ]

Un evento se define como cualquier suceso detectable o discernible que tenga relevancia para la gestión de la infraestructura de TI o la prestación de servicios de TI, así como para la evaluación del impacto que una desviación podría tener en dichos servicios. Los eventos suelen ser notificaciones generadas por un servicio de TI, un elemento de configuración (CI) o una herramienta de monitorización.

Propósito/alcance

  • El objetivo es la capacidad de detectar eventos, investigarlos y determinar la acción de control correcta.
  • Los eventos (advertencias y excepciones) se pueden utilizar para automatizar muchas actividades rutinarias.
  • La gestión de eventos se puede aplicar a cualquier aspecto de la gestión de servicios que se pueda controlar y automatizar (elementos de configuración).
  • Proporcionar mecanismos para la detección temprana de incidentes.
  • Algunos tipos de actividades automatizadas pueden supervisarse por excepción, lo que reduce el tiempo de inactividad.

Gestión de eventos

Notificación y detección de eventos

Las notificaciones de eventos pueden ser propietarias; solo ciertas herramientas de administración pueden detectarlas. La mayoría de los elementos de configuración (CI) generan notificaciones de eventos mediante el protocolo abierto SNMP ( Protocolo simple de administración de red ). Los CI se configuran para generar un conjunto de eventos según la experiencia del diseñador. Una vez generada una notificación de evento, la herramienta específica la detectará (la leerá y la interpretará).

Filtrado de eventos

El filtrado implica que la notificación del evento puede ignorarse o comunicarse a la herramienta de administración. Si se ignora, el evento generalmente se registra en un archivo de registro del dispositivo, pero no se realiza ninguna otra acción. Durante el filtrado, el evento recibe un nivel de correlación (tipo: informativo, advertencia o excepción). El filtrado no siempre es obligatorio; algunos elementos de configuración (CI) generan eventos importantes que se comunican directamente a la herramienta de administración (incluso si están duplicados).

Importancia del evento

Categorización estándar basada en la importancia de un evento:

  • Informativo (INFO): este evento no requiere ninguna acción inmediata y no representa una excepción. Se registra en los archivos de registro y se conserva durante un período predeterminado. Este tipo de evento se utiliza para comprobar el estado de un dispositivo o servicio, confirmar el estado de una actividad y generar estadísticas (inicio de sesión de usuario, finalización de un trabajo por lotes, encendido del dispositivo, número de usuarios conectados a una aplicación).
  • Advertencia (WARN/ALERT): este evento se genera cuando un dispositivo o servicio (aplicación/utilidad) se acerca a un umbral acordado ( KPI ). Las advertencias tienen como objetivo notificar al grupo/proceso/herramienta para que tome las medidas necesarias y evite que se produzca una excepción.
  • Excepción (ERROR): indica que un servicio o dispositivo está funcionando por debajo de los parámetros/indicadores normales (predefinidos). Esto significa que el servicio empresarial se ve afectado y el dispositivo o servicio presenta fallos, degradación del rendimiento o pérdida de funcionalidad ( servidor web caído, cobertura CS perdida para varios sitios). Un fallo del dispositivo es un error.

Tenga en cuenta que la información adicional que aparece a continuación no es un tipo de evento, sino un análisis que se puede realizar a partir de los registros de eventos:

  • Análisis de tendencias Los registros de eventos deben analizarse periódicamente para detectar indicios de que los patrones de eventos [INFO, WARN, ALERT, ERROR] puedan indicar un problema subyacente que pueda abordarse antes de una interrupción grave del servicio.

Respuesta

En este punto del proceso, existen varias opciones de respuesta disponibles. Algunas de las opciones disponibles son:

  • Registro de eventos: independientemente del tipo de evento, se recomienda registrar tanto el evento como las acciones realizadas. El evento puede registrarse como un registro de eventos o dejarse como una entrada en el registro del sistema del dispositivo.
  • Alerta e intervención humana: para los eventos que requieren intervención humana, es necesario escalarlos. El propósito de la alerta es notificar al recurso (persona) adecuado para gestionar el evento.

Registro de incidentes: se puede generar un incidente cuando se detecta una excepción.

  • RFC : en el caso de un RFC, hay dos escenarios subrayados:
    • Como excepción (se han añadido dos nuevos dispositivos de red sin la autorización necesaria).
    • Para evitar un fallo en el sistema de archivos , es necesario actualizar el servidor. El cambio puede tardar un tiempo en surtir efecto.

Evento cerrado

  • En el caso de eventos que generaron un incidente , problema o cambio, estos deben cerrarse formalmente con un enlace al registro correspondiente del otro proceso.
  • Los eventos informativos simplemente se registran y luego se utilizan como entrada para otros procesos, como la administración de copias de seguridad y almacenamiento. Los eventos de respuesta automática generalmente se cierran con la generación de un segundo evento.

Véase también

Referencias

  1. "Prácticas para gestionar operaciones". Obtenga la certificación ITIL® 4 Foundation en 7 días . Berkeley, California: Apress. 26 de noviembre de 2020. doi : 10.1007/978-1-4842-6361-7_11 . ISBN 978-1-4842-6361-7.