État du service et disponibilité Facturation crypto uniquement · Inscription sans KYC

Guide de l'opérateur · 4 min de lecture

Quel niveau RAID pour un serveur ?

Choisissez un niveau RAID en fonction du nombre de disques, de la capacité utilisable, de la charge de travail et des pannes tolérées. La disposition doit également correspondre à votre plan de surveillance et de restauration : la redondance à l'intérieur d'un serveur n'est pas une sauvegarde.

Commencez par le modèle de défaillance

RAID modifie la disponibilité et la capacité utilisable ; ce n'est pas une sauvegarde. Décidez combien de pannes de disques simultanées la matrice doit tolérer, quelle importance a la performance en écriture et combien de temps une reconstruction peut durer avant de sélectionner un niveau.

NiveauCapacité utilisable avec N disques égaux de taille SCompromis typique
RAID 0N × SAucune redondance
RAID 1SMiroir simple
RAID 5(N − 1) × SUn disque de parité ; pénalité d'écriture
RAID 6(N − 2) × STolérance à deux disques
RAID 10(N ÷ 2) × SPaires en miroir et E/S aléatoires fortes

Le risque de reconstruction compte

Les grandes matrices HDD peuvent se reconstruire pendant de nombreuses heures. Pendant cet intervalle, chaque périphérique restant est occupé, ce qui augmente l'exposition à une seconde panne et aux erreurs de lecture latentes. RAID 6 est souvent une disposition de capacité prudente pour les grands ensembles de sauvegarde ; RAID 10 est souvent choisi pour les bases de données à forte écriture. Validez par rapport au contrôleur, au système de fichiers et à l'objectif de récupération.

Gardez une copie indépendante

Une matrice ne peut pas protéger contre la suppression, les ransomwares, la corruption du système de fichiers, les erreurs de contrôleur ou un événement au niveau du site. Conservez des données de sauvegarde versionnées dans un autre domaine de défaillance et testez les restaurations.

Aller plus loin

Construisez une décision que vous pouvez vérifier.

Guide minimal 4

Écrivez d'abord l'exigence de récupération

Définissez le modèle de défaillance en langage clair : un périphérique, deux périphériques, un contrôleur, une suppression accidentelle ou le serveur entier. RAID ne traite que certaines défaillances de périphériques. Fixez un objectif de temps de récupération pour la restauration du service et un objectif de point de récupération pour la perte de données, puis identifiez quelle exigence la matrice locale peut satisfaire et laquelle nécessite une réplication ou une sauvegarde ailleurs.

Notez également si le système doit continuer à accepter des écritures en mode dégradé. Une archive principalement en lecture, une base de données à forte écriture et un espace de travail jetable peuvent tous utiliser le même nombre de disques mais nécessiter des agencements différents. L'efficacité de la capacité est donc une contrainte, pas le verdict.

Adaptez la disposition à la charge de travail et au nombre de périphériques

Les miroirs sont simples pour un ensemble de démarrage ou de données à deux périphériques et peuvent convenir aux E/S aléatoires où des groupes miroirs indépendants sont utiles. Les dispositions en parité échangent le travail d'écriture et la complexité de reconstruction contre plus de capacité. La double parité peut préserver une marge de défaillance supplémentaire dans un large ensemble HDD, tandis que RAID 10 échange la moitié de la capacité brute contre des paires miroirs. Ce sont des tendances de conception, pas des garanties de performance ; le contrôleur, le système de fichiers, la profondeur de file d'attente, la taille des enregistrements et le modèle applicatif comptent tous.

Utilisez la topologie réelle du catalogue. Les serveurs de stockage à 12 disques et à 24 disques permettent des choix indisponibles sur un serveur de calcul à deux NVMe. N'incluez pas la paire de démarrage NVMe séparée dans le calcul du tableau de données, et ne supposez pas qu'un groupe très large est préférable à plusieurs groupes sans modéliser les domaines de défaillance et le comportement des E/S.

Adaptez la disposition à la charge de travail et au nombre de périphériques
Question sur la charge de travailDisposition à évaluerRaison de valider
Deux appareils locaux et continuité requisMiroirCapacité d'un appareil et état dégradé simple
Large pool HDD avec exigence de double défaillanceRAID 6 ou RAIDZ2Largeur de parité, charge de reconstruction et conseils sur le système de fichiers
Écritures aléatoires et plusieurs paires de disques égalesRAID 10 ou vdevs en miroirCompromis de capacité et latence réelle de la charge de travail
Données jetables avec une source reproductibleRAID 0 peut être envisagéLa perte d'un membre entraîne la perte de la matrice

Choisissez une couche pour posséder la redondance

Décidez si un contrôleur matériel, Linux MD ou un système de fichiers tel que ZFS possède la disposition. Évitez d'empiler des couches RAID indépendantes sans raison documentée car l'état de santé et de remplacement peut devenir ambigu. La redondance ZFS est exprimée par des miroirs ou des vdevs RAIDZ et repose sur des sommes de contrôle ; un vdev de niveau supérieur perdu peut entraîner la perte du pool, donc l'ajout d'un périphérique non redondant seul à un pool autrement redondant modifie le modèle de défaillance.

Confirmez l'identité du disque, la procédure de remplacement, le comportement de démarrage et ce que le système d'exploitation peut observer avant de créer la matrice. Modifier la topologie ultérieurement peut être contraignant ou perturbateur, en particulier pour les configurations à parité.

Planifier la fenêtre de dégradation et de reconstruction

La surveillance doit distinguer les états sain, dégradé, reconstruction et vérification de cohérence. Linux MD expose des actions telles que resync, recover, check et repair ; collectez la progression et les incohérences plutôt que de signaler uniquement que le volume est monté. Un RAID 5 ou 6 sale et dégradé peut présenter un risque de corruption, c'est pourquoi l'assemblage forcé ne doit jamais être un raccourci de récupération de routine.

Documentez le routage des alertes, l'acquisition de pièces de rechange, l'identification des remplacements, la limitation de la charge de travail et le point à partir duquel une restauration est plus sûre que de continuer. Ne promettez jamais une durée de reconstruction sans mesurer les appareils livrés, la charge de la baie et le contrôleur.

Enregistrez le choix et ses limites

La conception terminée doit nommer la disposition, les hypothèses de disques égaux, l'estimation de la capacité utilisable, les pannes tolérées, la source de surveillance et l'emplacement de restauration. Conservez les données versionnées dans un autre domaine de défaillance et testez une restauration. Le résultat attendu n'est pas une affirmation selon laquelle RAID empêche la perte ; c'est un tableau dont le comportement en cas de panne et la responsabilité de récupération sont compris avant l'arrivée des données de production.

Réponses directes

Questions sur ce guide

Est-ce que RAID 6 est toujours le meilleur choix pour un grand serveur HDD ?

Non. Il offre une tolérance à deux parités, mais les E/S de la charge de travail, la largeur du vdev ou de la matrice, les conseils du contrôleur ou du système de fichiers, les opérations de reconstruction et l'objectif de récupération déterminent toujours la disposition.

Un disque de secours à chaud peut-il remplacer une sauvegarde externe ?

Non. Un disque de secours peut raccourcir le délai avant le début de la reconstruction, mais il reste dans le même serveur et ne protège pas contre la suppression, la compromission, la corruption propagée à travers la pile ou la perte du site.