Lire les valeurs SMART avant que ça cliquette
Presque tous les supports tiennent un journal sur eux-mêmes. Ces valeurs peuvent être lues, et dans bien des cas une panne s'y annonce des semaines à l'avance — encore faut-il savoir où regarder.
Ce qu'est SMART et ce qu'il n'est pas
SMART est une autosurveillance que les disques embarquent depuis des décennies. Elle compte des événements : combien de fois un secteur a dû être réalloué, combien de fois une lecture a échoué, combien d'heures de fonctionnement se sont écoulées, quelle température a été atteinte.
Ce que SMART ne sait pas faire : prédire. Un disque aux valeurs irréprochables peut tomber en panne demain, et un disque aux valeurs suspectes peut fonctionner encore des années. L'évaluation globale « état : OK » qu'affichent beaucoup de programmes vaut donc peu — elle ne se déclenche souvent que lorsqu'il est largement trop tard. Ce sont les valeurs individuelles qui parlent.
Les valeurs qui comptent sur les disques durs
Secteurs réalloués
Le disque a identifié un emplacement comme inutilisable et l'a remplacé par une réserve. La valeur individuelle la plus importante de toutes. Une poignée sur plusieurs années n'a rien d'alarmant — mais si le nombre grimpe en quelques semaines, le support est en déclin.
Secteurs en attente
Des emplacements qui se sont révélés problématiques à la lecture mais qui n'ont pas encore été remplacés. Ils sont les précurseurs de la première catégorie et un signe très sérieux, car des données peuvent se trouver précisément là.
Secteurs non corrigibles
Des emplacements définitivement illisibles. Des données y sont déjà perdues.
Taux d’erreurs de lecture et de positionnement
Prudence à l'interprétation : certains fabricants inscrivent dans ces champs des valeurs brutes qui paraissent d'emblée énormes et ne signifient rien. Seule l'évolution dans le temps est parlante.
Heures de fonctionnement et cycles de démarrage
Pas un signal d'alerte en soi, mais un contexte. Un disque affichant un nombre d'heures à cinq chiffres dans un RAID est un candidat à la prochaine panne — et à la question de savoir si la sauvegarde est à jour.
Température
Des températures durablement élevées raccourcissent la durée de vie. Moins intéressante que la valeur instantanée : le maximum jamais atteint par le disque.
Sur les SSD, autre chose compte
Degré d'usure
Indique quelle part de l'endurance d'écriture prévue a été consommée. En usage normal, cette valeur reste discrète pendant des années ; sur des serveurs et avec des applications qui écrivent en continu, elle peut devenir un sujet.
Quantité de données écrites
Comparez la quantité réellement écrite à ce que le fabricant indique pour la durée de vie. C'est l'indicateur d'usure le plus honnête.
Blocs de réserve
Les SSD tiennent des cellules de remplacement en réserve. Quand ce stock diminue, il est temps — avec la mémoire flash, les choses vont ensuite souvent très vite.
Coupures de courant inattendues
Un compteur élevé indique une alimentation coupée brutalement. C'est la cause la plus fréquente de tables de traduction endommagées et donc de SSD qui apparaissent soudain avec une capacité erronée.
Quand agir
Dès que des secteurs réalloués ou en attente apparaissent et que leur nombre augmente, la règle est : sauvegarder, maintenant, et avant d'entreprendre quoi que ce soit d'autre. Pas de clonage avec les outils du bord, pas de programme de test, pas de défragmentation — tout cela crée de la charge sur un disque qui est justement en train de montrer qu'il ne supporte plus la charge.
Et la phrase la plus importante sur le sujet : si le disque fait déjà du bruit, SMART n'est plus la question. Il est alors temps de débrancher.
Un conseil pratique
Réponses en bref.
Mon programme dit « état : bon ». Puis-je m’y fier ?
De façon limitée seulement. L'évaluation globale ne se déclenche souvent qu'une fois les seuils dépassés — et ceux-ci sont fixés généreusement par le fabricant. Regardez les valeurs individuelles, surtout les secteurs réalloués et en attente.
Peut-on réparer des secteurs défectueux ?
Non. Le disque les remplace en interne par des emplacements de réserve — rien n'est réparé, et les données qui s'y trouvaient sont en règle générale perdues. Les programmes qui promettent autre chose ne font que déplacer le problème.
Mon disque cliquette mais affiche de bonnes valeurs SMART. Comment est-ce possible ?
Parce que l'autosurveillance doit être lue — et un disque présentant un dommage mécanique ne fournit souvent plus aucune valeur, ou des valeurs périmées. Dans ce cas, le bruit est l'information la plus fiable.
Nous examinons votre support.
Le diagnostic Economy est gratuit. Vous savez ce qui est possible avant que quoi que ce soit ne coûte — et ce que cela coûterait est fixé par écrit à l'avance.
Wasserweg 8–10 · 60594 Frankfurt am Main

