Câteva informații despre SMART și utilitarele de monitorizare

Există multe informații online despre SMART și semnificațiile atributelor. Totuși, nu am întâlnit mențiuni despre câteva aspecte importante, pe care le știu de la oameni care se ocupă de cercetarea suporturilor de date.

Când povesteam din nou unui cunoscut de ce nu ar trebui să avem încredere necondiționată în valorile SMART și de ce ar fi mai bine să nu folosim constant «monitorerele SMART», mi-a venit ideea să consemnez ceea ce am spus sub formă de teze cu explicații. Pentru a oferi linkuri, în loc să repet mereu aceleași detalii. Și pentru a informa o audiență mai largă.

1) Programele de monitorizare automată a atributelor SMART ar trebui utilizate cu mare precauție.

Ceea ce cunoști sub numele de atribute SMART nu este stocat în formă gata, ci este generat în momentul în care îl soliciți. Acestea sunt calculate pe baza statisticilor interne, acumulate și utilizate de firmware-ul unității în timpul funcționării.

O parte din aceste date nu sunt necesare dispozitivului pentru a asigura funcționalitatea de bază. Ele nu sunt stocate, ci sunt generate de fiecare dată când este nevoie. Prin urmare, atunci când se solicită atributele SMART, firmware-ul inițiază multe procese necesare pentru a obține datele lipsă.

Dar aceste procese sunt slab compatibile cu procedurile efectuate în timpul încărcării unității cu operații de citire-scriere.

Într-o lume ideală, asta nu ar trebui să cauzeze probleme. Dar, în realitate, firmware-urile hard disk-urilor sunt scrise de oameni obișnuiți. Care pot greși și greșesc. Prin urmare, dacă soliciți atributele SMART în timpul desfășurării active a operațiunilor de citire-scriere de către dispozitiv, șansele ca ceva să meargă prost cresc semnificativ. De exemplu, datele din buffer-ul de citire sau scriere a utilizatorului pot fi corupte.

Afirmația despre creșterea riscurilor nu este o concluzie teoretică, ci o observație practică. De exemplu, este cunoscut un bug care a avut loc în firmware-ul HDD Samsung 103UI, unde, în timpul solicitării atributelor SMART, datele utilizatorului erau corupte.

Prin urmare, nu activați verificarea automată a atributelor SMART. Decât dacă știți exact că înaintea asta se dă comanda de resetare a cache-ului (Flush Cache). Sau, dacă nu aveți altă opțiune, setați efectuarea verificării cât mai rar posibil. În multe programe de monitorizare, intervalul de timp setat implicit între verificări este de aproximativ 10 minute. Aceasta este mult prea frecvent. Aceste verificări nu sunt o panacee împotriva defectării neașteptate a discurilor (panaceea este doar rezervarea). O dată pe zi - consider că este suficient.

Cererea de temperatură pentru inițierea proceselor de calculare a atributelor nu are impact și poate fi efectuată frecvent. Deoarece, atunci când este implementată corect, aceasta se realizează prin protocolul SCT. Prin SCT se transmite doar ceea ce este deja cunoscut. Aceste date sunt actualizate automat în fundal.

2) Datele atributelor SMART sunt adesea inexacte.

Firmware-ul hard disk-ului vă arată ceea ce consideră că trebuie să arate, nu ceea ce se întâmplă cu adevărat. Cel mai evident exemplu este al cincilea atribut, numărul de sectoare reallocuite. Specialiștii în recuperarea datelor știu bine că un hard disk poate arăta în al cincilea atribut un număr zero de sectoare reallocuite, chiar dacă acestea există și continuă să apară.

Am pus o întrebare unui specialist care studiază hard disk-urile și cercetează firmware-urile acestora. L-am întrebat care este principiul pe care firmware-ul dispozitivului decide când trebuie să ascundă faptul reallocării sectoarelor și când poate vorbi despre acest lucru prin intermediul atributelor SMART.

El a răspuns că nu există o regulă generală conform căreia dispozitivele arată sau ascund realitatea. Logica programatorilor care scriu firmware-uri pentru hard disk-uri este uneori foarte ciudată. Studiind firmware-urile diferitelor modele, el a observat că, adesea, decizia „a ascunde sau a arăta” este luată pe baza unui set de parametri care nu par să fie într-o legătură clară între ei și cu resursa rămasă a hard disk-ului.

3) Interpretarea indicatorilor SMART este specifică pentru fiecare furnizor.

De exemplu, la SiGate nu trebuie să ne îngrijorăm de valorile „rele” raw ale atributelor 1 și 7, atâta timp cât celelalte valori sunt în limite normale. Pe discurile acestui producător, valorile absolute pot crește în timpul utilizării normale.

Câteva informații despre SMART și utilitarele de monitorizare

Pentru evaluarea stării și a resursei rămase a hard disk-ului, este recomandat, în primul rând, să ne concentrăm asupra parametrelor 5, 196, 197, 198. De asemenea, este sensat să ne orientăm precis pe valorile absolute, raw, și nu pe cele efective. Normalizarea atributelor poate fi realizată în moduri mai puțin evidente, diferite în funcție de algoritmi și firmware-uri.

În general, în cadrul specialiștilor în stocare de informații, când se discută despre valoarea unui atribut, se referă, de obicei, la valoarea absolută.

Sursa: habr.com

Cumpără un hosting fiabil pentru site-uri cu protecție DDoS, servere VPS VDS 🔥 Cumpără un hosting fiabil pentru site-uri cu protecție DDoS, servere VPS VDS | ProHoster