01
Congelar alcance y requisitos previos
Seleccione una versión de Proxmox VE actualmente soportada de la guía de administración oficial y lea sus requisitos específicos antes de la instalación. Prepare nombres de host únicos, direcciones de administración estables, sincronización de tiempo, acceso administrativo, copias de seguridad verificadas y una ruta de recuperación independiente. Registre los presupuestos de recursos del nodo y los invitados para que los servicios de administración, almacenamiento y recuperación no se queden sin asignación.
Prefiera nodos que puedan comunicarse a través de una ruta estable de clase LAN. Proxmox documenta un clúster basado en quórum y requiere una entrega confiable de Corosync con latencia inferior a 5 milisegundos para un funcionamiento estable. Esto hace que un clúster extendido a través de regiones públicas distantes sea un diseño diferente y generalmente inadecuado a menos que pueda demostrar que su red cumple con los requisitos oficiales. No se implica ninguna red privada entre regiones por una lista de servidores públicos.
02
Diseñe el quórum antes de unir nodos
Anote los votos y cada partición que pretenda sobrevivir. Un clúster de tres nodos es el punto de partida directo porque la mayoría puede permanecer después de perder un nodo con voto. Un diseño de dos nodos no se vuelve seguro mediante conmutación por error deseada; Proxmox documenta QDevice como una forma de proporcionar un voto adicional, y ese votante externo introduce sus propios requisitos de alcance y ubicación.
El quórum protege el estado consistente del clúster, no la disponibilidad de la aplicación por sí misma. Decida cómo se reinician los invitados, qué almacenamiento requieren sus discos y qué sucede cuando un nodo está aislado pero sigue ejecutándose. Evite cambiar los votos esperados para forzar que una partición sea escribible como respuesta rutinaria.
03
Planifique el tráfico de Corosync y de carga de trabajo con honestidad
Enumere la gestión de listas, Corosync, migración, almacenamiento, copias de seguridad y tráfico público de invitados por separado, y luego asigne cada uno a las interfaces entregadas y direcciones enrutadas. Las rutas físicas dedicadas o la separación por VLAN pueden reducir la interferencia, pero un pedido Tungsto no garantiza una VLAN privada ni un enlace de clúster adicional. Confirme cualquier característica de red requerida antes de realizar el pedido; de lo contrario, diseñe dentro de las interfaces y el enrutamiento público realmente suministrados.
Corosync valora la latencia estable y la entrega ordenada fiable más que el ancho de banda principal. La migración, la replicación y las copias de seguridad pueden crear flujos mucho mayores, así que prográmelos y mídalos sin privar de comunicación al clúster. Aplique cortafuegos de host según los requisitos oficiales de puertos y restrinja la exposición de la gestión; no copie un conjunto de reglas de una versión no relacionada.
04
Elija el almacenamiento según el resultado de recuperación prometido
El almacenamiento local mantiene simples los dominios de fallo pero no hace que un disco invitado esté disponible en otro nodo. La replicación local ZFS puede reducir el punto de recuperación, pero es asíncrona y puede perder cambios entre replicaciones. El almacenamiento compartido puede hacer que los mismos volúmenes invitados sean visibles para múltiples nodos, mientras que el almacenamiento distribuido añade requisitos de capacidad, red y operación. Nada de esto elimina la necesidad de una copia de seguridad separada.
Defina dónde viven las imágenes ISO, los discos invitados y las copias de seguridad, cómo se monitorea el espacio libre y qué sucede cuando el almacenamiento se llena. Proxmox advierte que los invitados que usan un almacenamiento thin-provisioned completo pueden recibir errores de E/S. Mantenga los medios de restauración y las credenciales fuera del clúster que pueda necesitar reconstruir.
05
Utiliza un plan de aceptación y fallo por etapas
Parchee y verifique cada nodo independiente antes de crear el primer clúster, luego únase a un nodo a la vez utilizando la guía de la versión seleccionada. Después de cada cambio, registre la membresía, el quórum, el estado de tiempo, la visibilidad del almacenamiento y el estado de la copia de seguridad. Agregue un invitado no productivo solo después de que el plano de control esté saludable.
Planifique ejercicios controlados para un nodo no disponible, una ruta Corosync no disponible, almacenamiento no disponible y restauración desde copia de seguridad. Defina el resultado esperado y las condiciones de aborto antes de cada ejercicio; no ejecute pruebas destructivas contra la única copia de una carga de trabajo. Las solicitudes de energía y reinstalación de hardware Tungsto pueden ponerse en cola para procesamiento del operador, por lo que no son un controlador HA gestionado ni un temporizador de recuperación garantizado. El entregable final es un runbook propio con resultados observados de su implementación, no una promesa de disponibilidad sin calificar.
Respuestas directas
Preguntas sobre esta guía
¿Un clúster de tres nodos Proxmox garantiza alta disponibilidad?
No. Tres votos ayudan al quórum, pero la alta disponibilidad de invitados también necesita almacenamiento adecuado, fencing y política de reinicio, capacidad de reserva, redes confiables y recuperación probada. Tungsto no opera el clúster como un servicio de alta disponibilidad administrado.
¿Puedo asumir una VLAN privada entre servidores Tungsto?
No. Una VLAN o red de clúster dedicada no está garantizada por el catálogo. Confirme el producto de red exacto antes de elegir una topología que dependa de él.