Serverbetrieb
Einen nicht erreichbaren Server wiederherstellen
Triage bei Zugriffsverlust, schützen Sie wiederherstellbare Daten und wählen Sie den am wenigsten destruktiven betreibergestützten Wiederherstellungspfad.
Auf dieser Seite
Bevor Sie beginnen
- Servername, Region, aktueller Zustand, primäre Adresse und Zeitpunkt des letzten erfolgreichen Zugriffs.
- Ein aktuelles unabhängiges Backup und ein Verständnis darüber, welche Daten sich seit diesem Backup geändert haben.
- Der lokale private SSH-Schlüssel und jegliches Wiederherstellungsmaterial für die Festplattenverschlüsselung; senden Sie private Schlüssel niemals an den Support.
- Ein Wartungsprotokoll für kürzliche Firewall-, Netzwerk-, Boot-, Speicher- oder Betriebssystemänderungen.
Klassifizieren Sie den Fehler, bevor Sie handeln
Unterscheiden Sie zunächst ein Kontostatusproblem von einem Verbindungsproblem. Ein PROVISIONING- oder SUSPENDED-Status, eine ausstehende Adresse oder ein Server, dessen bezahlter Zeitraum abgelaufen ist, erfordert eine andere Reaktion als ein erreichbarer Server, der SSH ablehnt. Notieren Sie die genaue Meldung, statt sie als „down“ zusammenzufassen.
Prüfen Sie praktischerweise von einem zweiten vertrauenswürdigen Netzwerk aus, aber führen Sie keine aggressiven Scans durch. Wenn die Adresse erreichbar ist, aber die Authentifizierung fehlschlägt, bestätigen Sie den Anmeldenamen und den passenden privaten Schlüssel. Wenn sich der Hostschlüssel ohne genehmigte Neuinstallation geändert hat, stoppen Sie und behandeln Sie es als Identitätsproblem.
| Symptom | Mögliche Grenze | Am wenigsten destruktiver nächster Schritt |
|---|---|---|
| Server wird noch bereitgestellt | Lieferung nicht abgeschlossen | Fragen Sie den Betreiber nach dem Bereitstellungsstatus. |
| SSH-Zeitüberschreitung | Strom, Routing, Firewall oder SSH-Dienst | Fordern Sie KVM-Zugriff vor der Neuinstallation an. |
| Zugriff verweigert | Anmeldung oder Schlüsselkonflikt | Überprüfen Sie den Kontonamen und die Paarung von öffentlichem und privatem Schlüssel. |
| Hostschlüssel geändert | Neuinstallation, Neuzuweisung oder Abfangen | Überprüfen Sie den neuen Fingerabdruck außerhalb des Bandes. |
| Dateisystem- oder Bootfehler | Festplatten-, RAID- oder Betriebssystemausfall | Verwenden Sie zuerst die schreibgeschützte Wiederherstellung und bewahren Sie Beweise auf. |
Wählen Sie die kleinste Aktion
Wählen Sie nicht „Ausschalten“, es sei denn, der Betreiber hat zugestimmt, wie die Maschine wieder eingeschaltet wird. Der aktuelle Client API bietet keine Einschaltaktion. Die Rotation des Root-Passworts ist ebenfalls nur eine in die Warteschlange gestellte Anfrage und die API gibt kein generiertes Passwort zurück, daher ist dies heute kein Self-Service-Wiederherstellungspfad.
- Erfassen Sie den aktuellen Serverzustand und alle sichtbaren Kennungen, bevor Sie etwas in die Warteschlange stellen.
- Wenn das Betriebssystem möglicherweise einfach hängt, stellen Sie eine Neustartanforderung in die Warteschlange und notieren Sie deren Aktionssuffix.
- Wenn die Netzwerk- oder Bootkonfiguration verdächtig ist, stellen Sie KVM in die Warteschlange und bitten Sie den Betreiber, Konsolenzugriff bereitzustellen.
- Wenn Rettungsmedien erforderlich sind, bereiten Sie eine vertrauenswürdige benutzerdefinierte ISO und Prüfsumme vor und koordinieren Sie dann deren Mount mit dem Betreiber.
- Verwenden Sie die Neuinstallation nur, wenn die Datenwiederherstellung abgeschlossen ist oder ein unabhängiges Backup verifiziert wurde.
Schützen Sie Daten während der Wiederherstellung
Bevorzugen Sie schreibgeschützte Inspektion vor der Reparatur. Identifizieren Sie Festplatten, Partitionen, Dateisysteme und Einhängepunkte, bevor Sie ein Gerät auswählen. Namen können sich nach dem Booten von alternativen Medien unterscheiden, insbesondere bei NVMe- und Multi-Disk-Speichersystemen. Wenn der Ausfall RAID oder Dateisystemschäden betreffen könnte, erfassen Sie Diagnosen und konsultieren Sie einen qualifizierten Betreiber, bevor Sie Arrays zusammenstellen oder Reparaturwerkzeuge ausführen.
Initialisieren Sie niemals eine Festplatte, erstellen Sie kein neues Dateisystem, bauen Sie kein Array neu auf und installieren Sie nicht neu, nur um zu sehen, ob es hilft. Diese Operationen können für die Wiederherstellung benötigte Metadaten überschreiben. Halten Sie wiederhergestellte Daten vom betroffenen Server fern und überprüfen Sie sie vor destruktiven Arbeiten.
lsblk --fs
ip -brief address
ip route show
ip -6 route showErwartetes Ergebnis und Eskalationspaket
Eine erfolgreiche Wiederherstellung stellt einen verifizierten Administrationspfad ohne unnötigen Datenverlust wieder her oder erzeugt einen kontrollierten Plan zur Wiederherstellung auf einem sauberen System. Da in der Warteschlange befindliche Aktionen keinen clientseitig sichtbaren Abschlussstatus haben, führen Sie eine einzige Zeitleiste, die jedes Aktionssuffix und die Bestätigung des Operators enthält.
Geben Sie bei einer Eskalation Server und Region, den letzten bekannten guten Zeitpunkt in UTC, den sichtbaren Zustand, das Quellnetzwerk, den genauen SSH- oder Konsolenfehler, kürzliche Änderungen, Aktionsreferenzen und an, ob ein externes Backup getestet wurde. Schließen Sie Passwörter, private Schlüssel, Wiederherstellungscodes und Live-Konsolen-URLs aus. Wenn der Betreiber den sicheren Zugriff nicht wiederherstellen kann, vereinbaren Sie vor der Neuinstallation die Grenzen für Datenerfassung und Löschung.