Nota:
El acceso a esta página requiere autorización. Puede intentar iniciar sesión o cambiar directorios.
El acceso a esta página requiere autorización. Puede intentar cambiar los directorios.
Se aplica a:SQL Server
Tanto los grupos de disponibilidad Always On de SQL Server como las instancias de clúster de conmutación por error (FCI) de Always On usan la característica de clúster de conmutación por error de Windows Server (WSFC) como tecnología de plataforma. WSFC usa un método basado en quórum para supervisar el estado general del clúster y maximizar la tolerancia a errores en el nivel de nodo. Entender los modos de cuórum WSFC y la configuración de las votaciones en los nodos es muy importante para el diseño, el funcionamiento y la solución de problemas de una solución de recuperación ante desastres AlwaysOn de alta disponibilidad.
Detección del estado del clúster por quórum
Cada nodo de un clúster WSFC participa en un intercambio periódico de señales de latido para compartir el estado de salud del nodo con los demás nodos. Los nodos que no responden se consideran que se encuentran en estado de error.
Un conjunto de nodos de quórum es una mayoría de los nodos con derecho a voto y testigos en el clúster WSFC. Un voto de quórumperiódico determina el estado general de un clúster WSFC. La presencia de un quórum significa que el clúster está en buen estado y puede ofrecer tolerancia a fallos a nivel de nodo.
La ausencia de quórum indica que el clúster no está en buen estado. Debe mantenerse el estado general del clúster WSFC para garantizar que haya nodos secundarios en buen estado disponibles a los que los nodos primarios puedan conmutar por error. Si el voto de quórum falla, el clúster WSFC se dejará fuera de línea como medida preventiva. También hará que todas las instancias de SQL Server registradas con el clúster se detengan.
Importante
Si un clúster WSFC se pone sin conexión debido a un error del quórum, se requiere una intervención manual para volver a ponerlo en conexión.
Para más información, consulte: Recuperación de desastres del clúster WSFC mediante cuórum forzado (SQL Server).
Modos de quórum
Un modo de quórum se configura a nivel del clúster de WSFC y determina el método usado para la votación de quórum. La utilidad Administrador de clústeres de conmutación por error recomendará un modo de quórum en función del número de nodos del clúster.
Los siguientes modos de quórum se pueden usar para determinar qué constituye un quórum de votos:
Mayoría de nodos. Más de la mitad de los nodos con derecho a voto del clúster deben votar a favor para que el clúster se considere en buen estado.
Nodo y mayoría del recurso compartido de archivos. Similar al modo de quórum de Mayoría de nodos, excepto que también se configura un recurso compartido de archivos remoto como testigo de voto, y la conectividad desde cualquier nodo hasta ese recurso compartido también se contabiliza como un voto afirmativo. Más de la mitad de los votos posibles deben ser afirmativos para que el clúster esté en buen estado.
Como práctica recomendada, el recurso compartido de archivos testigo no debe residir en ningún nodo del clúster y debe ser visible para todos los nodos del clúster.
Mayoría de nodos y discos Similar al modo de quórum de mayoría de nodos, salvo que un recurso de clúster de disco compartido también se designa como testigo de voto, y la conectividad de cualquier nodo con ese disco compartido también se contabiliza como un voto afirmativo. Más de la mitad de los votos posibles deben ser afirmativos para que el clúster esté en buen estado.
Solo disco duro. Un recurso de clúster de disco compartido se designa como testigo y la conectividad de cualquier nodo a ese disco compartido se considera voto afirmativo.
Sugerencia
Al utilizar una configuración de almacenamiento asimétrica para grupos de disponibilidad de Always On, normalmente debe usar el modo de quórum Mayoría de nodos cuando tenga un número impar de nodos con derecho a voto, o el modo de quórum Nodo y mayoría de recurso compartido de archivos cuando tenga un número par de nodos con derecho a voto.
Nodos que votan y nodos que no votan
De forma predeterminada, cada nodo del clúster WSFC se incluye como miembro del quórum del clúster; cada nodo tiene un único voto para determinar el estado general del clúster y cada nodo intentará continuamente establecer un quórum. Hasta este punto, la explicación del quórum ha delimitado cuidadosamente el conjunto de nodos del clúster WSFC que participan en la votación sobre el estado del clúster como nodos con derecho a voto.
Ningún nodo de un clúster WSFC puede determinar de forma concluyente que el clúster, en su conjunto, está en buen o mal estado. En un momento dado, desde la perspectiva de cada nodo, algunos de los otros nodos pueden parecer desconectados, estar en proceso de conmutación por error o no responder debido a un fallo de comunicación de red. Una función clave del voto de quórum es determinar si el estado aparente de cada uno de los nodos del clúster WSFC es de hecho ese estado real de los nodos.
Para todos los modelos de quórum excepto "Solo disco", la eficacia de un voto de quórum depende de que las comunicaciones entre todos los nodos que votan del clúster sean confiables. Las comunicaciones de red entre los nodos de la misma subred física se deben considerar predecibles; el voto de quórum debe ser de confianza.
Sin embargo, si un nodo de otra subred se considera que no responde durante una votación de quórum, pero en realidad está en línea y, por lo demás, funciona correctamente, lo más probable es que se deba a un fallo en las comunicaciones de red entre subredes. Dependiendo de la topología del clúster, del modo de quórum y de la configuración de la directiva de conmutación por error, ese fallo en las comunicaciones de red puede dar lugar de hecho a más de un conjunto (o subconjunto) de nodos con derecho a voto.
Cuando más de un subconjunto de nodos que votan puede establecer un cuórum por sí solo, lo que se conoce como escenario de división de cerebro. En este escenario, los nodos de los quórums independientes pueden comportarse de forma diferente y en conflicto entre sí.
Nota
El escenario de división de cerebro solo es posible si un administrador del sistema realiza manualmente una operación forzada de quórum o, en circunstancias muy poco habituales, una conmutación por error forzada; subdividiendo explícitamente el conjunto de nodos de quórum.
Para simplificar la configuración del cuórum y aumentar el tiempo de actividad, puede ser aconsejable ajustar el valor de NodeWeight de cada nodo para que el voto del nodo no se cuente en el cuórum.
Importante
Para usar la configuración de NodeWeight, se debe aplicar la siguiente corrección urgente a todos los servidores del clúster WSFC:
KB2494036: hay disponible una revisión para permitir configurar un nodo de clúster que no tiene votos de quórum en Windows Server 2008 y en Windows Server 2008 R2
Ajustes recomendados para la votación de quórum
Al habilitar o deshabilitar el voto de un nodo determinado de WSFC, siga estas instrucciones:
Sin voto de forma predeterminada. Suponga que cada nodo no debe votar sin una justificación explícita.
Incluya todas las réplicas principales. Cada nodo de WSFC que aloje una réplica principal de un grupo de disponibilidad o sea el propietario preferido de una FCI debe tener un voto.
Incluya los posibles nodos propietarios de la conmutación por error automática. Cada nodo que pueda hospedar una réplica principal, como consecuencia de una conmutación automática por error de un grupo de disponibilidad o de una conmutación por error de una FCI, debe tener un voto. Si solo hay un grupo de disponibilidad en el clúster de WSFC y las réplicas de disponibilidad están hospedadas en instancias independientes, esta regla incluye solo la réplica secundaria que es el destino de la conmutación por error automática.
Excluya los nodos secundarios del sitio. En general, no proporcione votos a los nodos de WSFC que residen en un sitio secundario de recuperación de desastres. No desea que los nodos del sitio secundario contribuyan a la decisión de poner el clúster fuera de conexión cuando no hay ningún problema con el sitio principal.
Número impar de votos. Si es necesario, agregue un recurso compartido de archivos de testigo, un nodo testigo o un disco testigo al clúster y ajuste el modo de quórum para evitar posibles empates en la votación del quórum.
Vuelva a valorar las asignaciones de votos después de la conmutación por error. No querrá conmutar por error a una configuración de clúster que no admita un quórum válido.
Importante
Al validar la configuración del voto de cuórum de WSFC, el Asistente para grupos de disponibilidad de Always On muestra una advertencia si se cumple cualquiera de las siguientes condiciones:
- El nodo de clúster que hospeda la réplica principal no tiene un voto
- Una réplica secundaria está configurada para la conmutación por error automática y su nodo de clúster no tiene voto.
- KB2494036 no está instalado en todos los nodos de clúster que hospedan las réplicas de disponibilidad. Este parche es necesario para añadir o eliminar los votos de los nodos del clúster en implementaciones multisitio. Sin embargo, no suele ser necesaria en las implementaciones de un solo sitio y la advertencia puede omitirse de forma segura.
Sugerencia
SQL Server proporciona varias vistas de administración dinámica (DMV) del sistema que pueden ayudarle a administrar la configuración relacionada con la configuración del clúster WSFC y la votación de cuórum de los nodos.
Para más información, consulte: sys.dm_hadr_cluster, sys.dm_hadr_cluster_members, sys.dm_os_cluster_nodes y sys.dm_hadr_cluster_networks
Tareas relacionadas
Contenido relacionado
- Guía de soluciones AlwaysOn de Microsoft SQL Server para lograr alta disponibilidad y recuperación ante desastres
- Comprobación de la configuración del voto de cuórum en los asistentes de los grupos de disponibilidad AlwaysOn
- Tecnologías de Windows Server: Clústeres de conmutación por error
- Failover Cluster Step-by-Step Guide: Configuring the Quorum in a Failover Cluster (Guía paso a paso de clústeres de conmutación por error: Configuración del quórum en un clúster de conmutación por error)
- Recuperación ante desastres del clúster WSFC mediante quórum forzado (SQL Server)
- Clústeres de conmutación por error de Windows Server con SQL Server