Articulo de referencia

conmutación por error

Un módem de banda ancha móvil proporciona una conexión a Internet de respaldo para garantizar la resiliencia de la red. La conmutación por error consiste en cambiar a un servido...

Un módem de banda ancha móvil proporciona una conexión a Internet de respaldo para garantizar la resiliencia de la red.

La conmutación por error consiste en cambiar a un servidor , sistema , componente de hardware o red redundante o de reserva ante el fallo o la terminación anormal de la aplicación , [ 1 ] servidor, sistema, componente de hardware o red previamente activa en una red informática . La conmutación por error y la conmutación de red son esencialmente la misma operación, excepto que la conmutación por error es automática y generalmente se realiza sin previo aviso, mientras que la conmutación de red requiere intervención humana.

Historia

El término «failover», aunque probablemente utilizado por ingenieros mucho antes, se puede encontrar en un informe desclasificado de la NASA de 1962. [ 2 ] El término «switchover» se puede encontrar en la década de 1950 [ 3 ] al describir los «sistemas de reserva en caliente» y «en frío», con el significado actual de conmutación inmediata a un sistema en funcionamiento (en caliente) y conmutación retardada a un sistema que necesita arrancar (en frío). Las actas de una conferencia de 1957 describen sistemas informáticos con conmutación de emergencia (es decir, failover) y conmutación programada (para mantenimiento). [ 4 ]

conmutación por error

Los diseñadores de sistemas suelen proporcionar capacidad de conmutación por error en servidores, sistemas o redes que requieren alta disponibilidad y un alto grado de fiabilidad .

A nivel de servidor, la automatización de conmutación por error suele enviar una señal de actividad entre dos servidores, ya sea a través de la red o mediante una conexión independiente (por ejemplo, RS-232 ). En el diseño más común, mientras se mantenga una señal de actividad regular entre el servidor principal y el segundo servidor, este último no activará sus sistemas. Sin embargo, algunos sistemas utilizan activamente todos los servidores y pueden transferir su trabajo a los servidores restantes tras un fallo. También puede existir un tercer servidor de reserva con componentes en funcionamiento para la conmutación en caliente y así evitar tiempos de inactividad. El segundo servidor asume el trabajo del primero en cuanto detecta una alteración en la señal de actividad de la primera máquina. Algunos sistemas tienen la capacidad de enviar una notificación de conmutación por error.

Algunos sistemas, por diseño, no realizan la conmutación por error de forma totalmente automática, sino que requieren intervención humana. Esta configuración de "automatización con aprobación manual" se ejecuta automáticamente una vez que un usuario ha aprobado la conmutación por error.

Reversión

La recuperación automática es el proceso de restaurar un sistema, componente o servicio que previamente se encontraba en estado de fallo a su estado original de funcionamiento, y de hacer que el sistema de reserva pase de estar en funcionamiento a estar en modo de espera.

Uso

El uso de software de virtualización ha permitido que las prácticas de conmutación por error dependan menos del hardware físico mediante un proceso denominado migración, en el que una máquina virtual en ejecución se traslada de un host físico a otro, con poca o ninguna interrupción del servicio.

La tecnología de conmutación por error y recuperación también se utiliza habitualmente en la base de datos Microsoft SQL Server, donde SQL Server Failover Cluster Instance (FCI) se instala y configura sobre Windows Server Failover Cluster (WSFC). Los grupos y recursos de SQL Server que se ejecutan en WSFC pueden conmutarse manualmente al segundo nodo [ 5 ] para cualquier mantenimiento planificado en el primer nodo, o bien, conmutarse automáticamente al segundo nodo en caso de problemas en el primero. Del mismo modo, se puede realizar una operación de recuperación al primer nodo una vez resuelto el problema o finalizado el mantenimiento.

Véase también

Referencias

  1. Para la conmutación por error a nivel de aplicación, véase, por ejemplo, Jayaswal, Kailash (2005). "27" . Administering Data Centers: Servers, Storage, And Voice Over IP . Wiley-India. p.  364. ISBN 978-81-265-0688-0. Recuperado el 07-08-2009 . Aunque es imposible evitar cierta pérdida de datos durante una conmutación por error de una aplicación, ciertos pasos pueden [...] minimizarla..
  2. Informe de la NASA posterior al lanzamiento del Mercury-Atlas , 15 de junio de 1962.
  3. Ingeniero de Petróleo para la Gestión - Volumen 31 - Página D-40
  4. Actas de la Conferencia Conjunta de Informática del Oeste , Macmillan 1957
  5. https://www.dbsection.com/how-to-failover-cluster-from-one-node-to-another/