Stato del servizio e disponibilità Fatturazione solo cripto · Registrazione senza KYC

Guida per l'operatore · 4 min di lettura

Quale livello RAID per un server?

Scegli un livello RAID in base a numero di unità, capacità utilizzabile, carico di lavoro e guasti tollerati. Il layout deve anche adattarsi al piano di monitoraggio e ripristino: la ridondanza all'interno di un singolo server non è un backup.

Iniziare con il modello di guasto

RAID modifica la disponibilità e la capacità utilizzabile; non è un backup. Decidi quanti guasti simultanei dei dischi l'array deve tollerare, quanto contano le prestazioni di scrittura e quanto può durare una ricostruzione prima di selezionare un livello.

LivelloCapacità utilizzabile con N unità uguali di dimensione SCompromesso tipico
RAID 0N × SNessuna ridondanza
RAID 1SMirror semplice
RAID 5(N − 1) × SUn'unità di parità; penalità di scrittura
RAID 6(N − 2) × STolleranza a due unità
RAID 10(N ÷ 2) × SCoppie in mirroring e I/O casuale intenso

Il rischio di ricostruzione è importante

Grandi array HDD possono richiedere molte ore per la ricostruzione. Durante tale intervallo ogni dispositivo rimanente è occupato, il che aumenta l'esposizione a un secondo guasto e a errori di lettura latenti. RAID 6 è spesso un layout di capacità conservativo per grandi set di backup; RAID 10 è spesso scelto per database con scritture intensive. Valida rispetto a controller, filesystem e obiettivo di ripristino.

Mantenere una copia indipendente

Un array non può proteggere da cancellazione, ransomware, corruzione del filesystem, errori del controller o un evento a livello di sito. Mantieni dati di backup versionati in un altro dominio di guasto e testa i ripristini.

Approfondisci

Costruisci una decisione che puoi verificare.

Guida minima 4

Scrivi prima il requisito di ripristino

Definisci il modello di guasto in linguaggio semplice: un dispositivo, due dispositivi, un controller, cancellazione accidentale o l'intero server. RAID affronta solo alcuni guasti dei dispositivi. Imposta un obiettivo di tempo di ripristino per il ripristino del servizio e un obiettivo di punto di ripristino per la perdita di dati, quindi identifica quale requisito l'array locale può soddisfare e quale richiede replica o backup altrove.

Registra anche se il sistema deve continuare ad accettare scritture mentre è degradato. Un archivio prevalentemente in lettura, un database con molte scritture e spazio scratch usa e getta possono usare lo stesso numero di dischi ma richiedere layout diversi. L'efficienza della capacità è quindi un vincolo, non il verdetto.

Abbina il layout al carico di lavoro e al numero di dispositivi

I mirror sono semplici per un set di avvio o dati a due dispositivi e possono adattarsi a I/O casuali dove gruppi mirror indipendenti sono utili. I layout a parità scambiano lavoro di scrittura e complessità di ricostruzione con più capacità. La doppia parità può preservare un margine di guasto aggiuntivo in un ampio set HDD, mentre RAID 10 scambia metà della capacità grezza con coppie mirror. Queste sono tendenze di progettazione, non garanzie di prestazioni; controller, filesystem, profondità di coda, dimensione dei record e pattern applicativo contano tutti.

Usa la topologia effettiva del catalogo. I server di storage con 12 dischi e 24 dischi consentono scelte non disponibili su un server di calcolo con due NVMe. Non unire la coppia di avvio separata NVMe al calcolo dell'array dati e non presumere che un gruppo molto ampio sia preferibile a più gruppi senza modellare i domini di guasto e il comportamento I/O.

Abbina il layout al carico di lavoro e al numero di dispositivi
Domanda sul carico di lavoroLayout da valutareMotivo per validare
Due dispositivi locali e continuità richiestiMirrorCapacità di un dispositivo e uno stato degradato semplice
Ampio pool HDD con requisito di due guastiRAID 6 o RAIDZ2Larghezza di parità, carico di ricostruzione e guida del filesystem
Scritture casuali e più coppie di unità pariRAID 10 o vdev in mirroringCompromesso di capacità e latenza del carico di lavoro reale
Dati usa e getta con una fonte riproducibileRAID 0 può essere consideratoLa perdita di qualsiasi membro comporta la perdita dell'array

Scegli un livello per gestire la ridondanza

Decidi se un controller hardware, Linux MD o un filesystem come ZFS gestisce il layout. Evita di sovrapporre livelli RAID indipendenti senza un motivo documentato perché lo stato di salute e sostituzione può diventare ambiguo. La ridondanza ZFS è espressa tramite mirror o vdev RAIDZ e si basa sui checksum; un vdev di livello superiore perso può far perdere il pool, quindi aggiungere un singolo dispositivo non ridondante a un pool altrimenti ridondante cambia il modello di guasto.

Conferma l'identità dell'unità, la procedura di sostituzione, il comportamento di avvio e ciò che il sistema operativo può osservare prima di creare l'array. Cambiare la topologia in seguito può essere limitato o dirompente, in particolare per i layout di parità.

Pianifica la finestra di degrado e ricostruzione

Il monitoraggio deve distinguere stati sani, degradati, di ricostruzione e di controllo di coerenza. Linux MD espone azioni come resync, recover, check e repair; raccogli progressi e discrepanze invece di segnalare solo che il volume è montato. Un RAID 5 o 6 sporco e degradato può presentare un rischio di corruzione, motivo per cui l'assemblaggio forzato non deve mai essere una scorciatoia di ripristino di routine.

Documenta l'instradamento degli avvisi, l'acquisizione di ricambi, l'identificazione della sostituzione, la limitazione del carico di lavoro e il punto in cui un ripristino è più sicuro che continuare. Non promettere mai una durata di ricostruzione senza misurare i dispositivi consegnati, il carico dell'array e il controller.

Registra la scelta e i suoi limiti

Il design completato dovrebbe nominare il layout, le ipotesi di unità uguali, la stima della capacità utilizzabile, i guasti tollerati, la fonte di monitoraggio e la posizione di ripristino. Mantieni i dati versionati in un altro dominio di guasto e testa un ripristino. Il risultato atteso non è un'affermazione che RAID prevenga la perdita; è un array il cui comportamento in caso di guasto e la responsabilità di ripristino sono compresi prima che arrivino i dati di produzione.

Risposte dirette

Domande su questa guida

RAID 6 è sempre la scelta migliore per un server HDD di grandi dimensioni?

No. Offre tolleranza a doppia parità, ma l'I/O del carico di lavoro, la larghezza del vdev o dell'array, la guida del controller o del filesystem, le operazioni di rebuild e l'obiettivo di ripristino determinano comunque il layout.

Un hot spare può sostituire un backup esterno?

No. Uno spare può ridurre il tempo prima dell'inizio della ricostruzione, ma rimane nello stesso server e non protegge da cancellazione, compromissione, corruzione propagata attraverso lo stack o perdita del sito.