Articulo de referencia

gestor de clúster

En el ámbito de la computación en clúster y paralela , un gestor de clúster suele ser un software de backend con interfaz gráfica de usuario (GUI) o interfaz de línea de comando...

En el ámbito de la computación en clúster y paralela , un gestor de clúster suele ser un software de backend con interfaz gráfica de usuario (GUI) o interfaz de línea de comandos (CLI) que se ejecuta en un conjunto de nodos del clúster que gestiona (en algunos casos, se ejecuta en un servidor diferente o en un clúster de servidores de gestión). El gestor de clúster trabaja junto con un agente de gestión de clúster. Estos agentes se ejecutan en cada nodo del clúster para gestionar y configurar servicios, un conjunto de servicios o para gestionar y configurar el propio servidor del clúster (véase supercomputación ). En algunos casos, el gestor de clúster se utiliza principalmente para distribuir el trabajo que debe realizar el clúster (o la nube ). En este último caso, un subconjunto del gestor de clúster puede ser una aplicación de escritorio remoto que se utiliza no para la configuración, sino simplemente para enviar trabajo y recibir los resultados del trabajo del clúster. En otros casos, el clúster está más relacionado con la disponibilidad y el equilibrio de carga que con los clústeres de computación o de servicios específicos.

Véase también

Lecturas adicionales

Gestión de clústeres

  • Control adaptativo de sistemas de procesamiento de flujos a gran escala. Actas de la 26ª Conferencia Internacional IEEE sobre Sistemas de Computación Distribuida .
  • Diseño, implementación y evaluación del benchmark de carreteras lineales en el núcleo de procesamiento de flujos. Actas de la conferencia internacional ACM SIGMOD de 2006 sobre gestión de datos.
  • Programación de trabajos en paralelo: Informe de situación (2004) 10º Taller sobre estrategias de programación de trabajos para el procesamiento en paralelo, Nueva York, NY, junio de 2004.
  • Condor-G: Un agente de gestión de computación para redes multiinstitucionales. Revista Springer, Cluster Computing, Volumen 5, Número 3 / Julio de 2002.
  • De los clústeres a la estructura: la perspectiva de la gestión de trabajos Cluster Computing, 2003. Actas. Conferencia Internacional IEEE de 2003 sobre
  • Descripción general del marco de gestión Galaxy para la computación en clúster empresarial escalable. Conferencia Internacional IEEE sobre Computación en Clúster (Cluster'00), 2000.
  • Problemas de rendimiento e interoperabilidad en la incorporación de sistemas de gestión de clústeres dentro de un entorno de computación en red de área amplia. ACM/IEEE Supercomputing 2000: High Performance Networking and Computing.
  • DIRAC: una arquitectura ligera y escalable para computación de alto rendimiento Grid Computing , 2004. Actas. Quinto Taller Internacional IEEE/ACM sobre
  • AgentTeamwork: Coordinación de tareas de computación en malla con agentes móviles. Revista Springer, Applied Intelligence, Volumen 25, Número 2 / Octubre de 2006.
  • Mesos: Una plataforma para el intercambio de recursos de grano fino en el centro de datos. Informe tecnológico de la UC Berkeley, mayo de 2010.

computación autónoma

  • El modelo de lavandería para computación en clúster autónoma Computación autónoma , 2006. ICAC '06. Conferencia internacional IEEE sobre.
  • Gestión de flujos distribuidos mediante middleware auto-adaptativo basado en utilidades. Actas de la Segunda Conferencia Internacional sobre Computación Automática (2005).

Tolerancia a fallos

  • Tolerancia a fallos en el sistema de procesamiento de flujos distribuidos Borealis. Actas de la conferencia internacional ACM SIGMOD de 2005 sobre gestión de datos.
  • Inyector de fallos activado por estado global para la evaluación de sistemas distribuidos. IEEE Transactions on Parallel and Distributed Systems / Julio de 2004.
  • Tolerancia a fallos a nivel de sitio de trabajo para entornos de clúster y de red. Conferencia Internacional IEEE sobre Computación en Clúster (Cluster 2005).
  • Inyección de fallos en aplicaciones Java distribuidas. Simposio sobre procesamiento paralelo y distribuido, 2006. IPDPS 2006. XX Congreso Internacional.
  • Balanceo de carga y tolerancia a fallos en clústeres de estaciones de trabajo que migran grupos de procesos comunicantes. ACM SIGOPS Operating Systems Review, octubre de 1995.

Fondo

  • Un breve análisis de los planificadores de lotes en clúster comerciales