Estado del servicio y disponibilidad Facturación solo con criptomonedas · Registro sin KYC

Guía del operador · 5 min de lectura

Cómo construir un clúster Proxmox

Prepare un clúster Proxmox VE operado por el cliente en torno a quórum, nodos compatibles, redes fiables, almacenamiento y recuperación. Esta guía proporciona un método para validar su despliegue, no una promesa de alta disponibilidad gestionada.

Quórum antes que conveniencia

Un diseño de tres nodos es la base de producción más simple porque el clúster puede perder un miembro con voto y conservar la mayoría. Evalúe el enfoque documentado de QDevice para un diseño de dos nodos y pruebe su comportamiento ante fallos y particiones. No coloque todas las dependencias de voto detrás del mismo conmutador o ruta de alimentación.

Separar clases de tráfico

Planifique la separación de la gestión, la comunicación del clúster, la migración, el almacenamiento y las cargas de trabajo públicas utilizando las interfaces y los servicios de red realmente confirmados para el pedido. Corosync valora más una latencia baja y estable que el ancho de banda bruto. La migración y el almacenamiento replicado pueden consumir mucho más rendimiento, por lo que los sistemas 10 Gbps EPYC son un punto de partida práctico.

Opciones de almacenamiento

El ZFS local es simple y rápido, pero no hace que una VM sea altamente disponible por sí solo. La replicación reduce la exposición del punto de recuperación pero sigue siendo asíncrona. Ceph puede proporcionar almacenamiento distribuido, pero necesita nodos adicionales, memoria, capacidad de red y atención operativa. Haga coincidir el diseño con el objetivo de recuperación prometido.

Secuencia de construcción

  1. Instale versiones coincidentes de Proxmox VE y aplique parches a cada host.
  2. Establezca direcciones de gestión estables y sincronización horaria.
  3. Cree el clúster en el primer nodo y luego una los demás.
  4. Configure el almacenamiento y la copia de seguridad antes de habilitar las cargas de trabajo.
  5. Pruebe la pérdida de un host, la ruta de conmutación y la sesión de gestión.

Profundizar

Construya una decisión que pueda verificar.

Guía mínima de 4

Congelar alcance y requisitos previos

Seleccione una versión de Proxmox VE actualmente soportada de la guía de administración oficial y lea sus requisitos específicos antes de la instalación. Prepare nombres de host únicos, direcciones de administración estables, sincronización de tiempo, acceso administrativo, copias de seguridad verificadas y una ruta de recuperación independiente. Registre los presupuestos de recursos del nodo y los invitados para que los servicios de administración, almacenamiento y recuperación no se queden sin asignación.

Prefiera nodos que puedan comunicarse a través de una ruta estable de clase LAN. Proxmox documenta un clúster basado en quórum y requiere una entrega confiable de Corosync con latencia inferior a 5 milisegundos para un funcionamiento estable. Esto hace que un clúster extendido a través de regiones públicas distantes sea un diseño diferente y generalmente inadecuado a menos que pueda demostrar que su red cumple con los requisitos oficiales. No se implica ninguna red privada entre regiones por una lista de servidores públicos.

Diseñe el quórum antes de unir nodos

Anote los votos y cada partición que pretenda sobrevivir. Un clúster de tres nodos es el punto de partida directo porque la mayoría puede permanecer después de perder un nodo con voto. Un diseño de dos nodos no se vuelve seguro mediante conmutación por error deseada; Proxmox documenta QDevice como una forma de proporcionar un voto adicional, y ese votante externo introduce sus propios requisitos de alcance y ubicación.

El quórum protege el estado consistente del clúster, no la disponibilidad de la aplicación por sí misma. Decida cómo se reinician los invitados, qué almacenamiento requieren sus discos y qué sucede cuando un nodo está aislado pero sigue ejecutándose. Evite cambiar los votos esperados para forzar que una partición sea escribible como respuesta rutinaria.

Planifique el tráfico de Corosync y de carga de trabajo con honestidad

Enumere la gestión de listas, Corosync, migración, almacenamiento, copias de seguridad y tráfico público de invitados por separado, y luego asigne cada uno a las interfaces entregadas y direcciones enrutadas. Las rutas físicas dedicadas o la separación por VLAN pueden reducir la interferencia, pero un pedido Tungsto no garantiza una VLAN privada ni un enlace de clúster adicional. Confirme cualquier característica de red requerida antes de realizar el pedido; de lo contrario, diseñe dentro de las interfaces y el enrutamiento público realmente suministrados.

Corosync valora la latencia estable y la entrega ordenada fiable más que el ancho de banda principal. La migración, la replicación y las copias de seguridad pueden crear flujos mucho mayores, así que prográmelos y mídalos sin privar de comunicación al clúster. Aplique cortafuegos de host según los requisitos oficiales de puertos y restrinja la exposición de la gestión; no copie un conjunto de reglas de una versión no relacionada.

Elija el almacenamiento según el resultado de recuperación prometido

El almacenamiento local mantiene simples los dominios de fallo pero no hace que un disco invitado esté disponible en otro nodo. La replicación local ZFS puede reducir el punto de recuperación, pero es asíncrona y puede perder cambios entre replicaciones. El almacenamiento compartido puede hacer que los mismos volúmenes invitados sean visibles para múltiples nodos, mientras que el almacenamiento distribuido añade requisitos de capacidad, red y operación. Nada de esto elimina la necesidad de una copia de seguridad separada.

Defina dónde viven las imágenes ISO, los discos invitados y las copias de seguridad, cómo se monitorea el espacio libre y qué sucede cuando el almacenamiento se llena. Proxmox advierte que los invitados que usan un almacenamiento thin-provisioned completo pueden recibir errores de E/S. Mantenga los medios de restauración y las credenciales fuera del clúster que pueda necesitar reconstruir.

Utiliza un plan de aceptación y fallo por etapas

Parchee y verifique cada nodo independiente antes de crear el primer clúster, luego únase a un nodo a la vez utilizando la guía de la versión seleccionada. Después de cada cambio, registre la membresía, el quórum, el estado de tiempo, la visibilidad del almacenamiento y el estado de la copia de seguridad. Agregue un invitado no productivo solo después de que el plano de control esté saludable.

Planifique ejercicios controlados para un nodo no disponible, una ruta Corosync no disponible, almacenamiento no disponible y restauración desde copia de seguridad. Defina el resultado esperado y las condiciones de aborto antes de cada ejercicio; no ejecute pruebas destructivas contra la única copia de una carga de trabajo. Las solicitudes de energía y reinstalación de hardware Tungsto pueden ponerse en cola para procesamiento del operador, por lo que no son un controlador HA gestionado ni un temporizador de recuperación garantizado. El entregable final es un runbook propio con resultados observados de su implementación, no una promesa de disponibilidad sin calificar.

Respuestas directas

Preguntas sobre esta guía

¿Un clúster de tres nodos Proxmox garantiza alta disponibilidad?

No. Tres votos ayudan al quórum, pero la alta disponibilidad de invitados también necesita almacenamiento adecuado, fencing y política de reinicio, capacidad de reserva, redes confiables y recuperación probada. Tungsto no opera el clúster como un servicio de alta disponibilidad administrado.

¿Puedo asumir una VLAN privada entre servidores Tungsto?

No. Una VLAN o red de clúster dedicada no está garantizada por el catálogo. Confirme el producto de red exacto antes de elegir una topología que dependa de él.