Aproape la toate harddisk-urile veti gasi data sheet, pe linga viteza, asa valori ca Mean Time Between Failures (MTBF) (hours) si Reliability Rating at Full 24×7 Operation (AFR). Exemplu. Mean Time Between Failures (MTBF) (hours): 1.2 million Reliability Rating at Full 24×7 Operation (AFR): 0.73% Daca ne uităm la definiţia AFR, AFR 0.73% inseamnă “0.73 procente din intreaga populaţie a acestor harddisk-uri se vor defecta intr-un timp anual de lucru”. Adica in 136.895 ani, daca lucreaza 24/24, toate hdd-urile vor muri ;o) Asta in teorie.. Totusi după statistici “din practica”, AFR-ul e cu mult mai mare.. [1] [2] Si deci cum putem afla daca hdd-ul nostru se va defecta miine ? Discurile dure toate au suportul la SMART (Self-Monitoring, Analysis, and Reporting Technology), vine intrebarea, ce de facut si cum de interpretat datele care le ofera acest sistem ? La ajutor ne vine experienţa de la oceanul gigant de date Google, care are in cache tot internetul de pe pamint, si pentru asta le trebuie un munte de servere si hdd-uri ;o) Pe baza analizilor efecutate a 100,000 de harddisk-uri in peste 5 ani, au incercat faca niste concluzii.. Analiza a fost publicata anul trecut. Pentru ce-i ce nu stiu ce asta SMART: Self-Monitoring, Analysis, and Reporting Technology, or S.M.A.R.T., is a monitoring system for computer hard disks to detect and report on various indicators of reliability, in the hope of anticipating failures. Care sunt semnele ca hdd-ul degraba se va defecta ? Contrary to previously reported results, we found very little correlation between failure rates and either elevated temperature or activity levels. Some SMART parameters (scan errors, reallocation counts, offline reallocation counts, and robational counts) have a large impact on failure probability. Given the lack of occurrence of predictive SMART signals on a large fraction of failed drives, it is unlikely that an accurate predictive failure model can be built based on these signals alone. Adica dupa indicatiile sistemului SMART, nu intotdeauna se poate de inteles ca se apropie eşecul harddisk-ului, iar parametrii care prezic cel mai des ca degraba harddisk-ul se poate defecta sunt: “scan errors, reallocation counts, offline reallocation counts, and robational counts”, iar temperatura si nivelul de activitate nu au un factor decisiv asupra probabilităţii de defectare. După datele google, 56% din toate hdd-urile s-au defectat fara nici un semnal de la cele 4 valori “prevestitoare” de la SMART (care le-am scris mai sus). Si cel mai interesant ca moartea hdd-ului vine cel mai des in primele 3 luni de utilizare si dupa 3 ani de utilizare. Si din cite observam, cum am mai spus mai sus, nivelul de utilizare a hdd-urilor nu le face cu mult mai vulnerabile de cit cele care se utilizeaza mai putin intens.. Dupa graficele de temperatura, hdd-urile care au avut o temp. de lucru intre 35-40C s-au defectat cel mai putin.. Iata aici cineva a digerat documentul de la google in mai multe detalii, drept ca in rusa, daca nu aveti rabdarea sa intepretati singuri analiza furnizata de google. Răspunsul la intrebarea “Si deci cum putem afla daca hdd-ul nostru se va defecta miine ?” - nicicum :) Asa deci riscul ca harddisk-ul cu date importante sa se defecteze persista in orice moment, faceti mai des backup-uri la date importante..