01
Заморозьте объём и предварительные условия
Выберите поддерживаемый в настоящее время выпуск Proxmox VE из официального руководства по администрированию и прочитайте его требования, специфичные для выпуска, перед установкой. Подготовьте уникальные имена хостов, стабильные адреса управления, синхронизацию времени, административный доступ, проверенные резервные копии и независимый путь восстановления. Зафиксируйте бюджеты ресурсов узла и гостевых систем, чтобы службы управления, хранение и работы по восстановлению не были выделены в ущерб.
Предпочитайте узлы, которые могут общаться по стабильному пути класса LAN. Proxmox описывает кластер на основе кворума и требует надёжной доставки Corosync с задержкой ниже 5 миллисекунд для стабильной работы. Это делает кластер, растянутый между удалёнными публичными регионами, иной и, как правило, неподходящей конструкцией, если вы не можете продемонстрировать, что его сеть соответствует официальным требованиям. Никакая частная межрегиональная магистраль не подразумевается публичным листингом сервера.
02
Спроектируйте кворум перед добавлением узлов
Запишите голоса и каждый раздел, который вы намерены сохранить. Кластер из трёх узлов — простой стартовый вариант, потому что большинство может остаться после потери одного голосующего узла. Двухузловая схема не становится безопасной благодаря желаемому отказу; Proxmox документирует QDevice как способ предоставить дополнительный голос, и этот внешний избиратель вводит свои требования к доступности и размещению.
Кворум защищает согласованное состояние кластера, но не доступность приложения сам по себе. Решите, как перезапускаются гости, какое хранилище требуется для их дисков и что происходит, когда узел изолирован, но всё ещё работает. Избегайте изменения ожидаемых голосов, чтобы принудительно сделать раздел доступным для записи, как рутинную реакцию.
03
Честно планируйте трафик Corosync и рабочей нагрузки
Раздельно опишите управление списками, Corosync, миграцию, хранилище, резервное копирование и публичный гостевой трафик, затем сопоставьте каждый пункт с предоставленными интерфейсами и маршрутизируемыми адресами. Выделенные физические каналы или разделение VLAN могут снизить взаимные помехи, но заказ Tungsto не гарантирует частную VLAN или дополнительную кластерную линию. Подтвердите любую необходимую сетевую функцию до заказа; в противном случае проектируйте в рамках фактически предоставленных интерфейсов и публичной маршрутизации.
Corosync ценит стабильную задержку и надежную упорядоченную доставку больше, чем пиковую пропускную способность. Миграция, репликация и резервное копирование могут создавать гораздо большие потоки, поэтому планируйте и измеряйте их, не лишая кластерную связь ресурсов. Применяйте межсетевые экраны хоста из официальных требований к портам и ограничивайте доступ к управлению; не копируйте набор правил из несвязанной версии.
04
Выбирайте хранилище исходя из обещанного результата восстановления
Локальное хранилище упрощает домены отказов, но не делает гостевой диск доступным на другом узле. Локальная репликация ZFS может сократить точку восстановления, однако она асинхронна и может потерять изменения между репликациями. Общее хранилище может сделать одни и те же гостевые тома видимыми для нескольких узлов, в то время как распределённое хранилище добавляет требования к ёмкости, сети и эксплуатации. Ничто из этого не устраняет необходимость в отдельной резервной копии.
Определите, где находятся ISO-образы, диски гостевых машин и резервные копии, как отслеживается свободное место и что происходит при заполнении хранилища. Proxmox предупреждает, что гостевые машины, использующие полностью тонко выделенное хранилище, могут получать ошибки ввода-вывода. Храните носители восстановления и учётные данные вне кластера, который может потребоваться перестроить.
05
Используйте поэтапный план приёмки и действий при сбоях
Исправьте и проверьте каждый автономный узел перед созданием первого кластера, затем присоединяйте узлы по одному, используя руководство выбранной версии. После каждого изменения фиксируйте членство, кворум, состояние времени, видимость хранилища и статус резервного копирования. Добавляйте непроизводственную гостевую систему только после того, как плоскость управления станет работоспособной.
Планируйте контролируемые учения: недоступность одного узла, недоступность одного пути Corosync, недоступность хранилища и восстановление из резервной копии. Определите ожидаемый результат и условия прекращения перед каждым учением; не проводите разрушительные тесты на единственной копии рабочей нагрузки. Запросы на питание оборудования Tungsto и переустановку могут быть поставлены в очередь на обработку оператором, поэтому они не являются управляемым контроллером HA или гарантированным таймером восстановления. Конечный результат — собственный runbook с наблюдаемыми результатами вашего развёртывания, а не безусловное обещание доступности.
Прямые ответы
Вопросы по этому руководству
Гарантирует ли кластер Proxmox из трех узлов высокую доступность?
Нет. Три голоса помогают кворуму, но гостевая высокая доступность также требует подходящего хранилища, фехтования и политики перезапуска, резервной ёмкости, надёжной сети и проверенного восстановления. Tungsto не управляет кластером как управляемой службой высокой доступности.
Могу ли я рассчитывать на частную VLAN между серверами Tungsto?
Нет. VLAN или выделенная кластерная сеть не гарантируются каталогом. Подтвердите точный сетевой продукт, прежде чем выбирать топологию, зависящую от него.