Operazioni sul server
Recupera un server irraggiungibile
Classifica la perdita di accesso, proteggi i dati recuperabili e scegli il percorso di ripristino assistito dall'operatore meno distruttivo.
In questa pagina
Prima di iniziare
- Il nome del server, la regione, lo stato corrente, l'indirizzo primario e l'ora dell'ultimo accesso riuscito.
- Un backup indipendente recente e la comprensione di quali dati sono cambiati da quel backup.
- La chiave privata locale SSH e qualsiasi materiale di recupero per la crittografia del disco; non inviare mai chiavi private al supporto.
- Un registro di manutenzione per le recenti modifiche a firewall, rete, avvio, storage o sistema operativo.
Classifica il guasto prima di agire
Distinguere innanzitutto un problema di stato dell'account da un problema di connettività. Uno stato PROVISIONING o SUSPENDED, un indirizzo Pending o un server oltre il tempo pagato richiede una risposta diversa da un server raggiungibile che rifiuta SSH. Registrare il messaggio esatto invece di riassumerlo come non funzionante.
Controlla da una seconda rete attendibile se possibile, ma non eseguire scansioni aggressive. Se l'indirizzo è raggiungibile ma l'autenticazione fallisce, conferma il nome di accesso e la chiave privata corrispondente. Se la chiave host è cambiata senza una reinstallazione approvata, fermati e trattalo come un problema di identità.
| Sintomo | Possibile confine | Prossimo passo meno distruttivo |
|---|---|---|
| Server ancora in provisioning | Consegna non completata | Chiedi all'operatore lo stato del provisioning. |
| Timeout SSH | Servizio di alimentazione, routing, firewall o SSH | Richiedi l'accesso KVM prima di reinstallare. |
| Permesso negato | Discrepanza di login o chiave | Verifica il nome dell'account e l'abbinamento chiave pubblica/privata. |
| Chiave host cambiata | Reinstallazione, riassegnazione o intercettazione | Verifica la nuova impronta fuori banda. |
| Errore del filesystem o di avvio | Guasto di disco, RAID o sistema operativo | Usa prima il ripristino in sola lettura e preserva le prove. |
Scegliere l'azione più piccola
Non selezionare Spegnimento a meno che l'operatore non abbia concordato come la macchina verrà riaccesa. L'attuale client API non espone un'azione di accensione. Anche la rotazione della password di root è solo una richiesta in coda e il API non restituisce una password generata, quindi oggi non è un percorso di ripristino self-service.
- Cattura lo stato attuale del server e tutti gli identificatori visibili prima di mettere in coda qualsiasi cosa.
- Se il sistema operativo potrebbe essere semplicemente bloccato, metti in coda una richiesta di riavvio e annota il suffisso dell'azione.
- Se la configurazione di rete o di avvio è sospetta, metti in coda KVM e chiedi all'operatore di fornire l'accesso alla console.
- Se è necessario un supporto di ripristino, prepara una ISO personalizzata affidabile e il relativo checksum, quindi coordina il suo mount con l'operatore.
- Usa la reinstallazione solo quando il recupero dei dati è completo o un backup indipendente è stato verificato.
Proteggi i dati durante il ripristino
Preferisci l'ispezione in sola lettura prima della riparazione. Identifica dischi, partizioni, filesystem e punti di mount prima di selezionare un dispositivo. I nomi possono differire dopo l'avvio da supporti alternativi, specialmente su NVMe e sistemi di storage multi-disco. Se il guasto potrebbe coinvolgere RAID o danni al filesystem, acquisisci la diagnostica e consulta un operatore qualificato prima di assemblare array o eseguire strumenti di riparazione.
Non inizializzare mai un disco, creare un nuovo filesystem, ricostruire un array o reinstallare solo per vedere se aiuta. Queste operazioni possono sovrascrivere i metadati necessari per il ripristino. Mantieni i dati recuperati fuori dal server interessato e verificali prima di lavori distruttivi.
lsblk --fs
ip -brief address
ip route show
ip -6 route showRisultato atteso e pacchetto di escalation
Un recupero riuscito ripristina un percorso di amministrazione verificato senza perdita di dati non necessaria, oppure produce un piano controllato per ripristinare su un sistema pulito. Poiché le azioni in coda non hanno uno stato di completamento visibile al client, mantieni una sequenza temporale contenente ogni suffisso di azione e la conferma dell'operatore.
Quando si effettua l'escalation, includere server e regione, ultimo orario noto di funzionamento in UTC, stato visibile, rete di origine, errore esatto SSH o della console, modifiche recenti, riferimenti alle azioni e se è stato testato un backup esterno al server. Escludere password, chiavi private, codici di ripristino e URL live della console. Se l'operatore non può ripristinare l'accesso sicuro, concordare i limiti di acquisizione e cancellazione dei dati prima di reinstallare.