サービスステータスと可用性 暗号通貨のみの請求 · KYCなしサインアップ

オペレーターガイド · 5分で読了

Proxmoxクラスタの構築方法

顧客運用のProxmox VEクラスターを、クォーラム、互換ノード、信頼できるネットワーク、ストレージ、リカバリーを中心に準備してください。このガイドはデプロイメントを検証する方法を提供するものであり、マネージド高可用性の約束ではありません。

利便性より定足数

3ノード設計は、クラスターが1つの投票メンバーを失っても過半数を維持できるため、最も単純な本番ベースラインです。2ノード設計の場合は、文書化されたQDeviceアプローチを評価し、その障害とパーティション動作をテストしてください。すべての投票依存関係を同じスイッチまたは電源経路の背後に置かないでください。

トラフィッククラスを分離する

注文で実際に確認されたインターフェースとネットワークサービスを使用して、管理、クラスタ通信、移行、ストレージ、パブリックワークロードの分離を計画してください。Corosyncは生の帯域幅よりも低く安定したレイテンシを重視します。移行と複製ストレージははるかに多くのスループットを消費する可能性があり、そのため10 Gbps EPYCシステムが実用的な出発点です。

ストレージの選択肢

ローカルZFSはシンプルで高速ですが、それ自体でVMを高可用性にするわけではありません。レプリケーションは復旧ポイントの露出を減らしますが、依然として非同期です。Cephは分散ストレージを提供できますが、追加のノード、メモリ、ネットワーク容量、運用上の注意が必要です。設計を約束された復旧目標に合わせてください。

ビルドシーケンス

  1. 一致するProxmox VEリリースをインストールし、各ホストにパッチを適用します。
  2. 安定した管理アドレスと時刻同期を設定する。
  3. 最初のノードでクラスターを作成し、その後他のノードを参加させます。
  4. ワークロードを有効にする前にストレージとバックアップを構成します。
  5. ホスト、スイッチパス、管理セッションの喪失をテストします。

さらに深く

検証可能な決定を構築してください。

4最小ガイド

スコープと前提条件を凍結する

公式管理ガイドから現在サポートされている Proxmox VE リリースを選択し、インストール前にリリース固有の要件を読んでください。一意のホスト名、安定した管理アドレス、時刻同期、管理アクセス、検証済みバックアップ、独立した回復パスを準備してください。管理サービス、ストレージ、回復作業が割り当てられないように、ノードとゲストのリソース予算を記録してください。

安定したLANクラスの経路で通信できるノードを優先してください。Proxmoxはクォーラムベースのクラスターを文書化しており、安定した運用には5ミリ秒未満のレイテンシで信頼性の高いCorosync配信が必要です。これにより、遠く離れたパブリックリージョンにまたがるクラスターは、ネットワークが公式要件を満たすことを実証できない限り、異なる一般的に不適切な設計になります。パブリックサーバーのリストによってプライベートなリージョン間ファブリックが暗示されることはありません。

ノードを参加させる前にクォーラムを設計する

投票と生き残らせたいすべてのパーティションを書き留めてください。3ノードクラスタは、1つの投票ノードが失われても過半数が残るため、単純な出発点です。2ノード設計は希望的フェイルオーバーで安全になるわけではありません。Proxmoxは追加の投票を提供する方法としてQDeviceを文書化しており、その外部投票者は独自の到達可能性と配置要件をもたらします。

クォーラムは一貫したクラスター状態を保護しますが、それ自体ではアプリケーションの可用性を保証しません。ゲストの再起動方法、ディスクに必要なストレージ、ノードが隔離されても実行中の場合の対処を決定してください。ルーチン対応としてパーティションを書き込み可能にするために期待票を変更することは避けてください。

Corosyncとワークロードトラフィックを正直に計画する

リスト管理、Corosync、移行、ストレージ、バックアップ、パブリックゲストトラフィックを個別にリストし、それぞれを提供されたインターフェースとルーティングされたアドレスにマッピングします。専用の物理パスまたはVLAN分離により干渉を減らせますが、Tungsto注文はプライベートVLANや追加のクラスタリンクを保証しません。注文前に必要なネットワーク機能を確認してください。そうでない場合は、実際に提供されるインターフェースとパブリックルーティング内で設計します。

Corosyncは、ヘッドライン帯域幅よりも安定したレイテンシと信頼性の高い順序付き配信を重視します。移行、レプリケーション、バックアップははるかに大きなフローを生み出す可能性があるため、クラスタ通信を枯渇させずにスケジュールして測定してください。公式のポート要件からホストファイアウォールを適用し、管理露出を制限してください。無関係なバージョンのルールセットをコピーしないでください。

約束されたリカバリー結果からストレージを選択する

ローカルストレージは障害ドメインをシンプルに保ちますが、ゲストディスクを別のノードで利用可能にするわけではありません。ローカルZFSレプリケーションはリカバリポイントを短縮できますが、非同期であり、レプリケーション間の変更を失う可能性があります。共有ストレージは同じゲストボリュームを複数のノードに表示でき、分散ストレージは容量、ネットワーク、運用要件を追加します。これらはいずれも個別のバックアップの必要性を排除しません。

ISOイメージ、ゲストディスク、バックアップの保存場所、空き容量の監視方法、ストレージが満杯になった場合の対処を定義してください。Proxmoxは、完全にシンプロビジョニングされたストレージを使用するゲストがI/Oエラーを受け取る可能性があると警告しています。復元メディアと資格情報は、再構築が必要になる可能性のあるクラスタの外に保管してください。

段階的な受け入れと障害計画を使用する

最初のクラスタを作成する前に各スタンドアロンノードにパッチを適用して検証し、選択したバージョンのガイドに従ってノードを1台ずつ参加させます。各変更後、メンバーシップ、クォーラム、時刻状態、ストレージの可視性、バックアップ状態を記録します。コントロールプレーンが健全になってから、非本番ゲストを追加します。

1つのノードが利用不可、1つのCorosyncパスが利用不可、ストレージが利用不可、バックアップからの復元という制御された演習を計画します。各演習の前に期待される結果と中止条件を定義します。ワークロードの唯一のコピーに対して破壊的なテストを実行しないでください。Tungstoハードウェアの電源および再インストール要求はオペレーター処理のためにキューに入れられる場合があるため、管理されたHAコントローラーや保証された復旧タイマーではありません。最終成果物は、展開からの観察結果を含む所有ランブックであり、無条件の可用性の約束ではありません。

直接の回答

このガイドに関する質問

3ノードのProxmoxクラスターは高可用性を保証しますか?

いいえ。3票はクォーラムに役立ちますが、ゲストHAには適切なストレージ、フェンシング、再起動ポリシー、予備容量、信頼性の高いネットワーク、テスト済みの回復も必要です。Tungsto はクラスターを管理されたHAサービスとして運用しません。

Tungstoサーバー間のプライベートVLANを想定できますか?

いいえ。VLANまたは専用クラスターネットワークはカタログで保証されていません。それに依存するトポロジーを選択する前に、正確なネットワーク製品を確認してください。