Статус и доступность услуг Оплата только криптовалютой · Регистрация без KYC

Руководство оператора · 5 мин. чтения

Как построить кластер Proxmox

Подготовьте управляемый клиентом кластер Proxmox VE с учётом кворума, совместимых узлов, надёжной сети, хранилища и восстановления. Это руководство предлагает метод проверки вашего развёртывания, а не обещание управляемой высокой доступности.

Кворум прежде удобства

Трехузловая конструкция является простейшей производственной базой, поскольку кластер может потерять одного голосующего участника и сохранить большинство. Оцените документированный подход QDevice для двухузловой конструкции и протестируйте его поведение при сбоях и разделении. Не размещайте все зависимости голосования за одним коммутатором или линией питания.

Разделяйте классы трафика

Планируйте разделение управления, кластерной связи, миграции, хранилища и публичных рабочих нагрузок, используя интерфейсы и сетевые службы, фактически подтверждённые для заказа. Corosync ценит низкую стабильную задержку больше, чем сырую пропускную способность. Миграция и реплицируемое хранилище могут потреблять гораздо больше пропускной способности, поэтому системы 10 Gbps EPYC являются практичной отправной точкой.

Варианты хранилища

Локальный ZFS прост и быстр, но сам по себе не делает виртуальную машину высокодоступной. Репликация снижает подверженность точке восстановления, но остается асинхронной. Ceph может обеспечить распределенное хранилище, но требует дополнительных узлов, памяти, пропускной способности сети и операционного внимания. Сопоставьте проект с обещанной целью восстановления.

Последовательность сборки

  1. Установите соответствующие выпуски Proxmox VE и обновите каждый хост.
  2. Установите стабильные адреса управления и синхронизацию времени.
  3. Создайте кластер на первом узле, затем присоедините остальные.
  4. Настройте хранилище и резервное копирование перед включением рабочих нагрузок.
  5. Проверьте потерю хоста, пути коммутатора и сеанса управления.

Углубиться

Примите решение, которое можно проверить.

4 минимальное руководство

Заморозьте объём и предварительные условия

Выберите поддерживаемый в настоящее время выпуск Proxmox VE из официального руководства по администрированию и прочитайте его требования, специфичные для выпуска, перед установкой. Подготовьте уникальные имена хостов, стабильные адреса управления, синхронизацию времени, административный доступ, проверенные резервные копии и независимый путь восстановления. Зафиксируйте бюджеты ресурсов узла и гостевых систем, чтобы службы управления, хранение и работы по восстановлению не были выделены в ущерб.

Предпочитайте узлы, которые могут общаться по стабильному пути класса LAN. Proxmox описывает кластер на основе кворума и требует надёжной доставки Corosync с задержкой ниже 5 миллисекунд для стабильной работы. Это делает кластер, растянутый между удалёнными публичными регионами, иной и, как правило, неподходящей конструкцией, если вы не можете продемонстрировать, что его сеть соответствует официальным требованиям. Никакая частная межрегиональная магистраль не подразумевается публичным листингом сервера.

Спроектируйте кворум перед добавлением узлов

Запишите голоса и каждый раздел, который вы намерены сохранить. Кластер из трёх узлов — простой стартовый вариант, потому что большинство может остаться после потери одного голосующего узла. Двухузловая схема не становится безопасной благодаря желаемому отказу; Proxmox документирует QDevice как способ предоставить дополнительный голос, и этот внешний избиратель вводит свои требования к доступности и размещению.

Кворум защищает согласованное состояние кластера, но не доступность приложения сам по себе. Решите, как перезапускаются гости, какое хранилище требуется для их дисков и что происходит, когда узел изолирован, но всё ещё работает. Избегайте изменения ожидаемых голосов, чтобы принудительно сделать раздел доступным для записи, как рутинную реакцию.

Честно планируйте трафик Corosync и рабочей нагрузки

Раздельно опишите управление списками, Corosync, миграцию, хранилище, резервное копирование и публичный гостевой трафик, затем сопоставьте каждый пункт с предоставленными интерфейсами и маршрутизируемыми адресами. Выделенные физические каналы или разделение VLAN могут снизить взаимные помехи, но заказ Tungsto не гарантирует частную VLAN или дополнительную кластерную линию. Подтвердите любую необходимую сетевую функцию до заказа; в противном случае проектируйте в рамках фактически предоставленных интерфейсов и публичной маршрутизации.

Corosync ценит стабильную задержку и надежную упорядоченную доставку больше, чем пиковую пропускную способность. Миграция, репликация и резервное копирование могут создавать гораздо большие потоки, поэтому планируйте и измеряйте их, не лишая кластерную связь ресурсов. Применяйте межсетевые экраны хоста из официальных требований к портам и ограничивайте доступ к управлению; не копируйте набор правил из несвязанной версии.

Выбирайте хранилище исходя из обещанного результата восстановления

Локальное хранилище упрощает домены отказов, но не делает гостевой диск доступным на другом узле. Локальная репликация ZFS может сократить точку восстановления, однако она асинхронна и может потерять изменения между репликациями. Общее хранилище может сделать одни и те же гостевые тома видимыми для нескольких узлов, в то время как распределённое хранилище добавляет требования к ёмкости, сети и эксплуатации. Ничто из этого не устраняет необходимость в отдельной резервной копии.

Определите, где находятся ISO-образы, диски гостевых машин и резервные копии, как отслеживается свободное место и что происходит при заполнении хранилища. Proxmox предупреждает, что гостевые машины, использующие полностью тонко выделенное хранилище, могут получать ошибки ввода-вывода. Храните носители восстановления и учётные данные вне кластера, который может потребоваться перестроить.

Используйте поэтапный план приёмки и действий при сбоях

Исправьте и проверьте каждый автономный узел перед созданием первого кластера, затем присоединяйте узлы по одному, используя руководство выбранной версии. После каждого изменения фиксируйте членство, кворум, состояние времени, видимость хранилища и статус резервного копирования. Добавляйте непроизводственную гостевую систему только после того, как плоскость управления станет работоспособной.

Планируйте контролируемые учения: недоступность одного узла, недоступность одного пути Corosync, недоступность хранилища и восстановление из резервной копии. Определите ожидаемый результат и условия прекращения перед каждым учением; не проводите разрушительные тесты на единственной копии рабочей нагрузки. Запросы на питание оборудования Tungsto и переустановку могут быть поставлены в очередь на обработку оператором, поэтому они не являются управляемым контроллером HA или гарантированным таймером восстановления. Конечный результат — собственный runbook с наблюдаемыми результатами вашего развёртывания, а не безусловное обещание доступности.

Прямые ответы

Вопросы по этому руководству

Гарантирует ли кластер Proxmox из трех узлов высокую доступность?

Нет. Три голоса помогают кворуму, но гостевая высокая доступность также требует подходящего хранилища, фехтования и политики перезапуска, резервной ёмкости, надёжной сети и проверенного восстановления. Tungsto не управляет кластером как управляемой службой высокой доступности.

Могу ли я рассчитывать на частную VLAN между серверами Tungsto?

Нет. VLAN или выделенная кластерная сеть не гарантируются каталогом. Подтвердите точный сетевой продукт, прежде чем выбирать топологию, зависящую от него.