Masz alert w CrystalDiskInfo, smartctl pokazuje “PASSED”, a komputer i tak przycina? Albo odwrotnie: S.M.A.R.T. wygląda “ładnie”, ale dysk zaczyna się dziwnie zachowywać. W takich sytuacjach ludzie zadają bardzo konkretne pytania, zwykle pod presją czasu, bo stawką są dane.
Najczęstsze pytania przed decyzją (i na nich opiera się ten poradnik):
- Czy ten dysk faktycznie umiera, czy to fałszywy alarm?
- Na co patrzeć w S.M.A.R.T.: RAW czy VALUE/WORST/THRESH?
- Które atrybuty HDD naprawdę grożą utratą danych, a które tylko straszą?
- Dlaczego “Ultra DMA CRC Error Count” to często kabel/port SATA, a nie bad sektory?
- SSD: czy “Percent Used” rosnący to powód do paniki, czy normalna eksploatacja?
- Kiedy test długi S.M.A.R.T. pomaga, a kiedy potrafi dobić słaby dysk?
- Co zrobić w pierwsze 10 minut, żeby nie pogorszyć sytuacji i nie stracić plików?
Najważniejsza reguła gry: S.M.A.R.T. to narzędzie do zarządzania ryzykiem. Najlepiej działa, gdy łączysz atrybuty + objawy + trend (czy wartości rosną). Wtedy odczyt przestaje być zbiorem liczb, a staje się decyzją: obserwować, klonować, wymienić dysk, a czasem przerwać działania i od razu myśleć o odzysku danych.
Frazy pomocnicze: atrybuty SMART jak czytać, RAW VALUE WORST THRESH różnice, reallocated sectors count interpretacja, current pending sector count co robić, uncorrectable sector count znaczenie, ultra dma crc error count kabel SATA, smartctl test krótki długi, CrystalDiskInfo żółty czerwony, SSD percent used media wearout, NVMe critical warning SMART
S.M.A.R.T. jako narzędzie do decyzji, nie do wróżenia
Co S.M.A.R.T. mierzy, a czego nie potrafi obiecać
S.M.A.R.T. (Self-Monitoring, Analysis and Reporting Technology) zbiera w firmware dysku liczniki i wskaźniki dotyczące pracy nośnika: błędy odczytu/zapisu, sektory problematyczne, zdarzenia transmisji, czas pracy, temperaturę, a w SSD także zużycie komórek i zapasowe bloki. To nie jest jednak “skaner prawdy” o dysku – to telemetria.
Największa korzyść: S.M.A.R.T. często pokazuje narastające problemy zanim dojdzie do pełnej awarii. Najczęściej dotyczy to degradacji powierzchni w HDD (sektory niestabilne) i pogarszającej się korekcji błędów w SSD.
Największe ograniczenie: część awarii jest nagła – kontroler, elektronika, firmware, zasilanie, uszkodzenie po przepięciu, błąd wewnętrzny NVMe. W takich przypadkach S.M.A.R.T. może wyglądać dobrze do samego końca. Dlatego “SMART OK” nie jest gwarancją bezpieczeństwa danych – jest tylko informacją, że dysk nie przekroczył progów alarmowych według własnej logiki producenta.
Dwa typy awarii: narastające vs nagłe i gdzie S.M.A.R.T. ma największą moc
W praktyce warto myśleć o awariach w dwóch kategoriach:
1) Narastające (często dają sygnały w S.M.A.R.T.): rosnące Pending/Uncorrectable, pojawiające się realokacje, problemy z zapisem, spadek rezerwy SSD, błędy w testach offline. Tu S.M.A.R.T. bywa bardzo użyteczny, bo pozwala zareagować zanim system zacznie gubić pliki.
2) Nagłe (S.M.A.R.T. może nie zdążyć ostrzec): padnięty kontroler, zwarcie, uszkodzenie elektroniki, awaria firmware, przypadkowe uszkodzenia mechaniczne. Tu liczy się głównie backup i szybka reakcja po objawach (dysk niewidoczny, “0 GB”, losowe rozłączanie, brak identyfikacji modelu).
Jeśli zauważasz “dziwne” zachowanie komputera, S.M.A.R.T. to tylko jedna warstwa diagnostyki. Wartość ma dopiero zestaw sygnałów: atrybuty + logi systemowe + objawy użytkowe.
Jak czytać S.M.A.R.T. w kontekście: systemowy vs magazyn, dom vs firma
To samo wskazanie może oznaczać zupełnie inną decyzję w zależności od kontekstu. Dysk systemowy, na którym codziennie pracujesz, przy pierwszych czerwonych flagach jest zwykle kandydatem do szybkiej wymiany i klonu, bo awaria paraliżuje komputer. Z kolei magazyn z filmami może “pożyć” dłużej, choć nadal nie powinien być jedyną kopią ważnych danych.
Inaczej też podchodzi się do nośnika w małej firmie: jeśli na dysku jest księgowość, projekty klientów, dokumenty – nawet pojedynczy niepokojący trend jest sygnałem, by działać szybciej. S.M.A.R.T. ma Ci dać przewagę: czas na bezpieczną migrację, a nie powód do obserwowania katastrofy.
Najkrótsza zasada: najpierw zabezpieczenie danych, potem dociekania. Brzmi banalnie, ale to dokładnie ten punkt, w którym ludzie najczęściej popełniają kosztowny błąd.
Ruch, który daje najwięcej spokoju: jeśli cokolwiek wygląda podejrzanie, zrób zrzut raportu S.M.A.R.T. z datą (albo zapisz wynik smartctl do pliku). Trend to połowa diagnozy.
Raport S.M.A.R.T. bez pułapek: VALUE/WORST/THRESH/RAW i różnice między programami
Co oznaczają pola i dlaczego RAW potrafi kłamać “na oko”
W raportach S.M.A.R.T. najczęściej widzisz cztery kolumny:
- VALUE – wartość znormalizowana (skala producenta, np. 100/200/253 w zależności od marki i modelu).
- WORST – najgorsza historyczna wartość znormalizowana.
- THRESH – próg producenta; jeśli VALUE spadnie do THRESH lub poniżej, atrybut uznaje się za krytyczny.
- RAW – surowa liczba, zwykle licznik zdarzeń, ale czasem zakodowane bity, czas, suma, albo wartość w jednostkach specyficznych dla producenta.
Najczęstsza pułapka: ktoś patrzy wyłącznie na RAW i interpretuje go “wprost”. Problem w tym, że RAW nie ma uniwersalnego standardu. Dla jednego atrybutu RAW to liczba sektorów, dla innego – licznik prób, a dla kolejnego – wartość złożona z kilku pól (np. “wysoki bajt to jedno, niski bajt to drugie”).
Dlatego w praktyce warto czytać S.M.A.R.T. tak:
1) Czy atrybut jest z kategorii “prawdziwe czerwone flagi”? (np. Pending/Uncorrectable/Reallocated w HDD).
2) Czy RAW rośnie? (trend).
3) Czy narzędzie pokazuje FAIL / BAD? (przekroczony próg) – ale pamiętaj, że brak FAIL nie oznacza braku ryzyka.
Dlaczego te same liczby wyglądają inaczej w CrystalDiskInfo i smartctl
CrystalDiskInfo jest wygodne, bo koloruje stan na “dobry/ostrzegawczy/zły”. smartctl (smartmontools) jest bardziej techniczne, ale daje większą kontrolę: testy short/long, szczegóły logów błędów, łatwiejsze zapisywanie wyników do pliku.
Różnice w odczycie wynikają z kilku rzeczy:
- Mapowanie nazw atrybutów: programy czasem inaczej nazywają to samo ID lub różnie interpretują producenta.
- Prezentacja RAW: jedne narzędzia wyświetlają RAW jako dziesiętne, inne jako szesnastkowe, czasem z “prefiksem” lub rozbiciem.
- Progi ostrzeżeń: CrystalDiskInfo potrafi ostrzegać wcześniej niż THRESH producenta (to często dobrze), ale bywa też źródłem paniki, jeśli atrybut jest “informacyjny”.
Kluczowe: nie przywiązuj się do samego koloru. Kolor nie wie, czy dysk jest w serwerze z wibracjami, czy w laptopie, czy kabel SATA jest luźny, ani czy pending sectors rosną od tygodnia. To Ty łączysz kropki.
HDD vs SSD vs NVMe: inne zestawy atrybutów, inne reguły
W HDD dużą wagę mają atrybuty sektorowe i mechaniczne. W SSD typowe są liczniki zużycia i błędy związane z blokami flash. NVMe ma jeszcze własny zestaw pól (np. Critical Warning), często czytelniejszych niż klasyczne ID z ATA.
Jeśli porównujesz odczyt S.M.A.R.T. między dwoma dyskami różnych marek – ostrożnie. Dwa modele mogą mieć ten sam atrybut ID, a inny sens RAW. Dlatego najlepsze porównanie to ten sam dysk w czasie: zrzut dzisiaj vs zrzut za tydzień.
Najprostszy nawyk diagnostyczny: zrób dwa odczyty w odstępie (np. kilka dni) i sprawdź, czy “złe” liczniki rosną. Jeśli rosną – działaj szybciej.
Szybka ścieżka decyzji: co robisz w pierwsze 10 minut po alarmie
Najpierw dane, potem diagnoza: kiedy testy mogą zaszkodzić
Jeśli dysk ma problemy z odczytem, każda próba “sprawdźmy co jest nie tak” może oznaczać tysiące ponowień, długie zwisy systemu i dodatkowe obciążenie. Dla HDD z degradowaną powierzchnią to czasem prosta droga do pogorszenia stanu. Dla SSD z problemami kontrolera – ryzyko nagłego przejścia w tryb tylko-do-odczytu albo utraty dostępności.
Najbezpieczniejsza filozofia: zabezpiecz najważniejsze dane (albo zrób obraz/klon), a dopiero potem uruchamiaj długie testy. To szczególnie ważne, gdy widzisz Pending/Uncorrectable lub system loguje błędy I/O.
Mini-checklista: 10 minut po ostrzeżeniu S.M.A.R.T.
Poniższa kolejność jest celowo prosta – ma działać, gdy jesteś w stresie i chcesz ograniczyć ryzyko.
- Przestań obciążać dysk: zamknij zbędne programy, zatrzymaj torrenty, indeksowanie, kopie w tle.
- Jeśli to możliwe, skopiuj najcenniejsze pliki na inny nośnik (najlepiej zewnętrzny SSD/HDD) – priorytet: dokumenty, zdjęcia, projekty.
- Zrób odczyt S.M.A.R.T. i zapisz go do pliku (data). W Windows możesz zrobić zrzut ekranu z CrystalDiskInfo; w Linux/macOS: zapis wyniku smartctl.
- Sprawdź “czerwone flagi”: Reallocated/Pending/Uncorrectable (HDD), ostrzeżenia NVMe, spadek Available Spare (SSD), błędy CRC (połączenie).
- Jeśli są czerwone flagi sektorowe lub objawy zwisów – zamiast “kopiowania na żywo” rozważ obraz/klon (mniej chaotyczny, łatwiej wznawiać, lepszy do odzysku).
- Gdy dysk klika, znika z systemu lub nie daje się odczytać – przerwij testy i rozważ pomoc odzysku danych; dalsze “męczenie” może pogorszyć sprawę.
Ta checklista ma jeden cel: zmienić sytuację z “ryzykuję” na “mam kopię i mogę analizować spokojnie”. To najlepszy krok, jaki da się wykonać szybko.
Kiedy nie ma czasu: sygnały alarmowe poza S.M.A.R.T.
S.M.A.R.T. to nie wszystko. Bywa, że atrybuty jeszcze nie wyglądają dramatycznie, a system już cierpi. Sygnały, że należy działać natychmiast:
- zawieszanie podczas otwierania folderów lub kopiowania,
- błędy I/O w Podglądzie zdarzeń Windows / logach systemowych,
- znikanie dysku z systemu, komunikaty o odłączeniu/ponownym podłączeniu,
- HDD: nietypowe dźwięki (cykliczne klikanie, wielokrotne próby rozruchu),
- system plików “nagle” się sypie, pojawiają się komunikaty o konieczności skanowania i naprawy.
W takiej sytuacji zysk jest prosty: szybkie zabezpieczenie danych oszczędza godziny nerwów. Zrób to od razu.
HDD — atrybuty, które najczęściej mówią „zaraz stracisz dane”
Reallocated, Pending, Uncorrectable — trio, które trzeba rozumieć razem
W dyskach talerzowych najbardziej “decyzyjne” są atrybuty związane z sektorami. Trzy z nich wracają w diagnostyce ciągle, bo wprost dotyczą tego, czy dysk potrafi stabilnie czytać i pisać dane:
Reallocated Sectors Count – liczba sektorów przeniesionych do puli zapasowej. Dysk wykrył sektor, który nie spełniał kryteriów, i “podmienił” go na zapasowy. To oznacza: dysk ma za sobą incydent lub proces degradacji. Sama wartość większa od zera nie musi oznaczać, że dysk padnie jutro, ale jest śladem, że powierzchnia nie jest już idealna.
Current Pending Sector Count – sektory “podejrzane”, których nie dało się poprawnie odczytać i czekają na weryfikację. Jeśli przy następnym zapisie/odczycie sektor okaże się OK, licznik może spaść. Jeśli nie – sektor trafi do Reallocated. W praktyce Pending to często “tu i teraz” problem z dostępem do danych, więc rosnący RAW jest dużo bardziej niepokojący niż wysoki, ale stabilny Reallocated.
Offline Uncorrectable / Uncorrectable Sector Count – błędy niekorygowalne wykryte w tle lub podczas testu. To jest informacja: “w tym miejscu dane były nie do uratowania bez wyższej warstwy (np. kopii, RAID, aplikacji)”. Gdy widzisz Uncorrectable razem z Pending, zwykle masz już realne ryzyko utraty plików lub sypiącego się systemu plików, nawet jeśli komputer jeszcze “działa”.
Jak to czytać jako decyzję, a nie ciekawostkę? Jeśli Pending rośnie albo Uncorrectable jest > 0, priorytetem jest zabezpieczenie danych, a dopiero potem testy. Długi test S.M.A.R.T. (long/extended) bywa pomocny, bo wymusza czytanie całej powierzchni, ale na słabnącym HDD może też wywołać lawinę kolejnych błędów i zwisów. Lepiej najpierw zrobić kopię tego, co najważniejsze, a dopiero potem “dociskać” diagnostyką.
Typowy scenariusz z praktyki: dysk ma 1–2 realokowane sektory od dawna i nic się nie dzieje, ale nagle pojawia się Pending po twardym restarcie lub po przeniesieniu komputera. Jeśli po skopiowaniu danych Pending spada do zera i nie wraca – mogło się udać. Jeśli rośnie z dnia na dzień, to nie jest temat do obserwacji “jeszcze tydzień”, tylko do wymiany nośnika. Zrób zrzut S.M.A.R.T. dziś, drugi jutro i porównaj trend – to daje jasną odpowiedź, co się dzieje.
Masz te trzy atrybuty pod kontrolą? Super – wtedy kolejne kroki (kabel, zasilanie, testy, plan wymiany) podejmujesz na chłodno, a nie na ślepo.
Najbardziej opłacalna rutyna jest prosta: trzymasz kopię, patrzysz na trendy w S.M.A.R.T., a gdy pojawiają się czerwone flagi, reagujesz szybko – to zamienia awarię z katastrofy w zwykłą logistykę.
Read Error Rate, Seek Error Rate i Hardware ECC: kiedy te liczby straszą bez powodu
W raportach wielu HDD zobaczysz atrybuty typu Read Error Rate, Seek Error Rate albo Hardware ECC Recovered. I często ich RAW wygląda „kosmicznie”. To jeden z najczęstszych powodów niepotrzebnej paniki.
Dlaczego? Bo u części producentów RAW nie jest „liczbą błędów”, które trafiają do systemu, tylko wewnętrznym licznikiem zdarzeń na niskim poziomie (czasem nawet w formacie złożonym). Dysk potrafi korygować błędy ECC w locie i to jest normalne. Wnioski wyciągaj nie z samego RAW, tylko z trendów oraz z tego, czy obok pojawiają się błędy sektorowe (Pending/Uncorrectable/Reallocated) i objawy w systemie.
Reguła praktyczna: jeśli „straszny” jest tylko Read/Seek/ECC, a sektory są czyste i nie ma zwisów – to zwykle temat do monitoringu, nie do natychmiastowej wymiany. Zrób zrzut S.M.A.R.T. dziś i porównaj za kilka dni.
Spin Retry Count i Start/Stop Count: mechanika mówi „coś jest nie tak”
HDD ma ruchome części, więc S.M.A.R.T. potrafi dać sygnał, że problem leży w rozruchu lub zasilaniu. Dwa atrybuty pojawiają się tu regularnie:
Spin Retry Count (ponowne próby rozkręcenia talerzy) – jeśli RAW jest > 0 i rośnie, dysk miewa trudności z wystartowaniem. To bywa związane z wiekiem, ale też z kiepskim zasilaniem albo obudową USB, która nie wyrabia prądowo.
Start/Stop Count i Power Cycle Count – wysokie wartości same w sobie nie są „awarią”, ale są kontekstem. Dysk, który był setki razy usypiany i wybudzany (np. w NAS-ie albo laptopie), ma prawo mieć większe zużycie mechaniczne.
Jeśli widzisz rosnący Spin Retry oraz słyszysz, że HDD „mieli” przy starcie lub startuje za którymś razem – nie przeciągaj tematu. Kopia danych i plan wymiany oszczędzają nerwy.
Temperatura i wibracje: małe liczby, duże konsekwencje
Temperature wygląda banalnie, ale to atrybut, który potrafi wyjaśnić „dziwne” zachowanie dysku. Przegrzewanie nie zawsze zabija od razu, ale pogarsza stabilność i przyspiesza zużycie. W praktyce dysk w ciasnej obudowie, bez przepływu powietrza, potrafi łapać błędy przy długich kopiowaniach, a potem „magicznie” uspokaja się po otwarciu obudowy albo po czyszczeniu kurzu.
Jeśli narzędzie pokazuje skoki temperatury lub długie utrzymywanie się wysokich wartości, potraktuj to jako łatwy, szybki punkt naprawy: popraw chłodzenie i dopiero potem oceniaj, czy błędy wracają.
HDD — gdy alarm pochodzi z kabla, a nie z talerzy
UltraDMA CRC Error Count: czerwony alarm, który często ratuje dysk
UltraDMA CRC Error Count (czasem „Interface CRC Error”) to klasyk: atrybut potrafi rosnąć, gdy komunikacja po SATA jest zakłócana. Najczęstsze przyczyny to luźny kabel, zagięty/zużyty przewód, słabe gniazdo, kurz w złączu, a czasem niestabilne zasilanie. Ważny detal: te błędy dotyczą transmisji, nie powierzchni dysku.
Jak to czytać decyzyjnie?
- Jeśli rośnie głównie CRC, a Pending/Reallocated/Uncorrectable są równe zero, podejrzany numer 1 to kabel/port.
- CRC, które nie rośnie po wymianie kabla, często oznacza „problem był i został usunięty”, ale licznik zwykle nie wraca do zera.
- CRC rosnące dalej mimo nowego kabla i innego portu SATA – wtedy patrz na zasilacz, kontroler, a w PC też na wibracje/naprężenia przewodów.
To jest jeden z tych momentów, gdzie szybka, tania czynność (wymiana kabla, przepięcie do innego portu) daje natychmiastową odpowiedź. Zrób to, zanim zaczniesz „grillować” dysk długimi testami.
Gdy dysk znika z systemu: logi i zasilanie jako drugi trop
Znikanie dysku, resetowanie połączenia lub komunikaty typu „odłączono urządzenie” mogą wyglądać jak śmierć HDD, ale czasem winny jest zasilacz albo przejściówka. W obudowach USB szczególnie często problemem jest:
kiepski mostek SATA-USB, zbyt długi kabel USB, port bez stabilnego zasilania lub „Y-kabel”, który w praktyce i tak nie domaga. Wtedy S.M.A.R.T. bywa czysty, a komputer i tak traci dysk przy obciążeniu.
Jeśli masz taką sytuację, najpierw zapewnij stabilne warunki: inne zasilanie, inny port, najlepiej bezpośrednio po SATA (jeśli się da). Dopiero potem oceniaj, czy pojawiają się atrybuty sektorowe. Zyskasz jasność, czy walczysz z dyskiem, czy z otoczeniem.
SSD i NVMe — zużycie jest normalne, a prawdziwe alarmy wyglądają inaczej
Percent Used / Media Wearout Indicator: licznik życia, nie wyrok
W SSD kluczowe jest zrozumienie, że „zużycie” jest wbudowane w technologię. Atrybuty typu Percent Used (NVMe) albo Media Wearout Indicator (różnie nazywane w SATA SSD) mówią, jak dużo z przewidywanego budżetu cykli zapisu zostało wykorzystane. To normalne, że wartość z czasem się zmienia.
Co z tego wynika praktycznie:
Jeśli nie ma błędów i dysk działa stabilnie, samo rosnące zużycie nie jest powodem do paniki. Jest za to świetnym pretekstem, żeby upewnić się, że kopie zapasowe działają i że masz plan wymiany zanim nośnik dojedzie do końca „budżetu”. To daje komfort, a nie stres.
Available Spare i ostrzeżenia krytyczne NVMe: tu reagujesz szybko
SSD ma mechanizmy zastępowania zużytych bloków zapasowymi. Dlatego atrybuty typu Available Spare (NVMe) albo liczniki związane z rezerwą bloków są tak ważne: pokazują, czy dysk jeszcze ma z czego „ratować się” wewnętrznie.
W NVMe dodatkowo dochodzi pole Critical Warning. Jeśli pojawia się ostrzeżenie krytyczne, traktuj je jak sygnał do działania: kopia/klon i przygotowanie wymiany. W odróżnieniu od „kolorków” w aplikacji, to jest informacja, którą sam kontroler NVMe uznał za istotną.
Jeśli zobaczysz spadek Available Spare albo Critical Warning, nie baw się w wielogodzinne benchmarki i „sprawdzanie prędkości”. Lepiej wykorzystać czas na zabezpieczenie danych.
Błędy odczytu/zapisu i „Unsafe Shutdowns”: kiedy to tylko incydent, a kiedy trend
W raportach SSD/NVMe często widać liczniki błędów oraz Unsafe Shutdowns (nieprawidłowe wyłączenia). Te drugie potrafią rosnąć, gdy komputer traci zasilanie, zawiesza się lub jest twardo resetowany. Pojedyncze incydenty się zdarzają; nie każdy oznacza uszkodzenie.
Decyzję podejmuj tak samo jak w HDD: szukaj trendu i korelacji z objawami. Jeśli rosną błędy odczytu/zapisu, pojawiają się przycinki, a system zgłasza błędy I/O, to nie jest „statystyka” – to realne ryzyko. Jeśli licznik Unsafe Shutdowns rośnie, bo masz niestabilne zasilanie, najpierw napraw przyczynę (zasilacz/UPS), bo inaczej nawet nowy SSD dostanie po kościach.
Krótki scenariusz decyzyjny dla SSD: wymieniać czy obserwować?
Praktyczna heurystyka bez magii:
Obserwuj, gdy widzisz głównie zużycie (Percent Used) i brak krytycznych ostrzeżeń, a komputer działa normalnie. Wtedy największa korzyść to ustawienie monitoringu i regularna kopia.
Działaj natychmiast (kopia/klon + plan wymiany), gdy pojawia się Critical Warning, spada Available Spare, rosną błędy odczytu/zapisu lub dysk przechodzi w tryb tylko-do-odczytu. Tu czas jest ważniejszy niż dociekliwość.
Zrób jeden konkretny krok: zapisz raport S.M.A.R.T. i porównaj go po 24–72 godzinach normalnego użycia. Trend jest najlepszym doradcą.
Testy S.M.A.R.T. bez ryzyka: short, long i co robić z wynikiem
Short vs Long: który test uruchomić i kiedy przerwać
Testy wbudowane w S.M.A.R.T. są przydatne, ale nie zawsze są „bezpieczne dla chorego dysku”. W uproszczeniu:
Short test trwa krótko i sprawdza podstawowe funkcje oraz wybrane obszary. Nadaje się jako szybkie potwierdzenie, czy dysk zgłasza natychmiastowe problemy.
Long/Extended test próbuje czytać całą powierzchnię (HDD) lub wykonać szeroki test logiczny (SSD). To potrafi ujawnić ukryte błędy, ale też mocno obciążyć nośnik, zwłaszcza gdy są problemy z odczytem.
Jeśli w trakcie long testu komputer zaczyna się wieszać, słychać niepokojące dźwięki (HDD) albo dysk znika z systemu – przerwij i przejdź na tryb „ratowania danych”. Test nie jest celem, dane są celem.
Jak interpretować „PASSED”, gdy atrybuty krzyczą coś innego
Najbardziej mylący komunikat w diagnostyce to: Self-test: PASSED przy jednocześnie rosnącym Pending/Uncorrectable albo błędach w logach systemu. To się zdarza, bo test może nie trafić w problematyczne obszary (short) albo dysk zdąży „zamaskować” część problemów, zanim system je odczuje.
W praktyce większą wagę ma zestaw sygnałów:
trend atrybutów + logi błędów + objawy w pracy. Jeśli te trzy rzeczy układają się w jedną historię („z dnia na dzień gorzej”), to zielony wynik testu nie powinien uspokajać.
Najbardziej opłacalny ruch: potraktuj test jako dodatkową wskazówkę, a nie jako wyrocznię, i podejmij decyzję tak, żeby jutro nadal mieć dostęp do danych.
Gdy S.M.A.R.T. mówi „ryzyko”: klonować czy robić kopię plików?
To jest moment, w którym decyzja ma większe znaczenie niż sama diagnoza. Jeśli atrybuty sektorowe rosną (Pending/Uncorrectable/Reallocated w HDD) albo SSD zaczyna sypać błędami I/O, masz dwa główne podejścia: kopiowanie plików (logiczne) albo klonowanie całego dysku (bit po bicie / sektor po sektorze). Każde ma sens w innym scenariuszu.
Kopia plików jest bezpieczna, gdy system działa względnie stabilnie, a problem wygląda na „incydent” lub dotyczy pojedynczych obszarów. Wybierasz najważniejsze foldery, priorytetyzujesz dane i minimalizujesz czas pracy na wadliwym nośniku.

Klonowanie wygrywa, gdy dysk jest systemowy (chcesz uruchomić system na nowym nośniku), masz dużo małych plików lub obawiasz się, że klasyczne kopiowanie utknie na błędach. Klon tworzy „fotografię” stanu dysku i często pozwala przenieść się na nowy nośnik bez reinstalacji.
Prosta zasada: minimalizuj liczbę prób odczytu z chorych miejsc
Gdy dysk ma sektory problematyczne, każda kolejna próba odczytu może trwać długo, generować timeouty i dokładać stresu mechanice (HDD) albo kontrolerowi (SSD). Dlatego:
Jeśli komputer zaczyna się zawieszać przy kopiowaniu, transfer spada do zera, a system „mieli” dyskiem bez końca, nie dociskaj gazu. Zmień strategię: kopiuj od najważniejszych danych, a resztę zostaw na później albo odpuść.
Dobrze działa podejście „od góry”: najpierw dokumenty/zdjęcia/projekty, potem archiwa, a dopiero na końcu rzeczy odtwarzalne (gry, cache, pobrane instalatory). Zrób ten ruch od razu – zyskasz kontrolę.
Kiedy przerwać samodzielne działania i myśleć o odzysku danych
S.M.A.R.T. nie powie wprost „jutro nie wstaniesz”, ale są sygnały, przy których dalsze testy i kopiowania mogą pogorszyć sytuację. Dla HDD szczególnie niepokojące są głośne, powtarzalne cykle klikania, długie „rozpędzanie” talerzy oraz znikanie dysku z BIOS/UEFI. Dla SSD/NVMe – przechodzenie w tryb tylko-do-odczytu, losowe rozłączanie urządzenia i rosnące błędy wejścia/wyjścia w logach.
Jeśli na dysku są dane, których nie da się stracić (firmowa księgowość, jedyne zdjęcia, projekty bez backupu), rozsądniej jest ograniczyć eksperymenty. W takiej sytuacji każda dodatkowa godzina obciążenia może kosztować więcej niż oszczędność na usłudze odzysku. Zatrzymaj się, odłącz nośnik i podejmij decyzję na chłodno.
Logi systemowe: szybki sposób na potwierdzenie, że to nie „widzimisię” programu
Atrybuty S.M.A.R.T. są ważne, ale świetnie się uzupełniają z logami systemu. Jeśli narzędzie pokazuje „żółto”, a system jednocześnie raportuje błędy dysku, ryzyko przestaje być teoretyczne.
Windows: na co patrzeć, gdy są przycinki i błędy I/O
W Podglądzie zdarzeń najczęściej interesują Cię komunikaty z kategorii dysku i systemu plików. Jeśli pojawiają się błędy typu „device reset”, „bad block” lub ostrzeżenia o opóźnieniach zapisu/odczytu, to zwykle koreluje z:
niestabilną komunikacją (CRC/kabel), problemami sektorowymi albo zanikami zasilania. Praktycznie: jeżeli w tym samym czasie rośnie Pending/Uncorrectable – szykuj kopię i plan wymiany. Jeśli rośnie głównie CRC – zacznij od kabla i portu.
Dobra praktyka: zrób zrzut logów z momentu, gdy komputer „zamulił”. Będziesz mieć twardy punkt odniesienia przy porównaniu po zmianie kabla lub po migracji na nowy dysk.
Linux/macOS: dmesg i komunikaty o resetach magistrali
W Linuksie szybkie rozpoznanie dają komunikaty z dmesg lub logów systemowych: timeouty, reset linku SATA, błędy I/O przy konkretnych sektorach. W macOS podobną rolę pełnią logi systemowe i informacje o błędach urządzeń masowych. Wniosek jest ten sam: jeśli system krzyczy o błędach odczytu/zapisu, atrybuty S.M.A.R.T. przestają być „ciekawostką”.
Połącz te dwa światy: raport S.M.A.R.T. + logi z tej samej doby. Ta para daje najbardziej praktyczną odpowiedź, czy problem żyje i rośnie.
Monitoring, który naprawdę działa: alarmy od trendu, nie od „koloru”
Największy zysk z S.M.A.R.T. jest wtedy, gdy dowiadujesz się o problemie zanim system zacznie wariować. Kluczem nie jest idealny próg dla każdego modelu, tylko prosty rytuał: zbierasz dane i łapiesz zmianę.
Jak ustawić sensowne progi bez udawania wróżki
Zamiast próbować zgadywać „ile to już źle”, oprzyj się o to, co jest jednoznaczne:
liczniki, które nie powinny rosnąć (Pending/Uncorrectable, błędy krytyczne NVMe), oraz liczniki, które mogą rosnąć, ale nie powinny przyspieszać (CRC, Unsafe Shutdowns, błędy odczytu/zapisu). Najlepszy alarm to nie „masz 1”, tylko „w ostatnich dniach przybyło”.
W praktyce pomaga prosta zasada: jeśli któryś z kluczowych liczników zmienia się pomiędzy dwoma odczytami przy normalnym użyciu, to jest moment na kopię i decyzję „czy migruję teraz”. Ustaw monitoring tak, żebyś widział różnicę, a nie tylko stan „na dziś”.
Krótki rytuał tygodniowy, który oszczędza nerwy
Nie trzeba rozbudowanych systemów. Wystarczy stały nawyk: raz w tygodniu (albo raz w miesiącu, jeśli to komputer domowy) zapisujesz raport S.M.A.R.T. i patrzysz, czy kluczowe RAW-y stoją w miejscu. Do tego jedna rzecz, która daje największą ochronę: test przywracania kopii na losowym pliku, żeby backup nie był tylko „ładną ikoną”.
Zrób to teraz: zapisz bieżący raport (z datą w nazwie pliku). Następne porównanie będzie banalne.
Najczęstsze pułapki interpretacji: gdy jeden parametr robi zamieszanie
S.M.A.R.T. bywa bezlitosny dla osób, które czytają go „literalnie”. Najwięcej błędów bierze się z traktowania pojedynczego pola jako wyroku.
RAW rośnie, ale VALUE wygląda dobrze — i co wtedy?
To klasyczny dysonans: narzędzie pokazuje „dobry” stan (bo VALUE jest wysoko), a RAW ma coraz większą liczbę. W takiej sytuacji liczy się znaczenie atrybutu i to, czy jest to licznik „incydentów”, czy „stanu”.
Dla atrybutów sektorowych w HDD RAW jest często najważniejszy, bo mówi, że dysk już napotkał realny problem z odczytem/zapisem. Dla temperatury RAW to po prostu temperatura (albo złożony zapis producenta). Dla CRC RAW bywa „historią problemów z kablem”. Jedno podejście nie pasuje do wszystkiego.
Jeśli masz wątpliwość: porównaj odczyt z dwóch narzędzi (np. firmware/CLI i aplikacja GUI) i sprawdź, czy interpretują ten sam atrybut tak samo. Ten szybki test usuwa masę fałszywych alarmów.
„100% zdrowia” w aplikacji kontra realne ryzyko
Ocena w procentach jest wygodna, ale potrafi uśpić czujność. Niektóre programy opierają „health” głównie o przekroczenie THRESH, a to bywa ustawione tak, że dysk będzie „OK” prawie do końca.
Jeśli widzisz przycinki, błędy w logach albo nagłe zwiechy przy kopiowaniu, nie daj się uspokoić zielonemu napisowi. Lepiej oprzeć decyzję o to, co mierzalne: czy rosną liczniki błędów, czy zmienia się zachowanie dysku, czy problem się powtarza po poprawie otoczenia (kabel/zasilanie/chłodzenie).
Najbardziej opłacalny krok: przestań patrzeć na „procent”, a zacznij patrzeć na trend dwóch–trzech kluczowych liczb.
Najważniejsze atrybuty HDD: które liczby naprawdę powinny Cię postawić na nogi
W HDD większość „poważnych” problemów zaczyna się od powierzchni talerzy albo głowic. S.M.A.R.T. zwykle nie mówi tego wprost, ale zdradza to przez kilka liczników, które są jak kontrolki w aucie: nie wszystkie oznaczają lawetę, ale niektórych nie ignoruje się ani dnia.
Reallocated Sector Count: dysk już przenosi dane z uszkodzonych miejsc
Reallocated Sector Count (realokowane sektory) rośnie, gdy dysk uzna fragment powierzchni za niepewny i przeniesie dane do obszaru zapasowego. To nie musi oznaczać natychmiastowej śmierci, ale oznacza coś bardzo konkretnego: nośnik już ma fizyczny problem, z którym musiał sobie poradzić.
Praktyczna interpretacja jest prosta: pojedyncza realokacja, która przez miesiące stoi w miejscu, bywa „historią z przeszłości”. Realokacje, które przybywają (zwłaszcza w połączeniu z przycinkami i błędami I/O), to powód do migracji. Zrób kopię i zaplanuj wymianę, zanim zacznie brakować puli zapasowej.
Jeśli widzisz realokacje, przestań odkładać backup „na weekend” i zrób go dziś.
Current Pending Sector: sektor w kolejce, czyli najbardziej „czasowy” alarm
Current Pending Sector to sektory, których dysk nie potrafił poprawnie odczytać i czeka, aż spróbuje je zweryfikować (zwykle przy kolejnym zapisie/odczycie). To atrybut, który świetnie pasuje do pytania: „czy mogę jeszcze normalnie używać dysku, czy tylko ratować dane?”.
Jeżeli Pending jest > 0, to typowy scenariusz jest taki: komputer raz działa, raz się dusi; kopiowanie potrafi stać w miejscu, bo system w kółko próbuje odczytać ten sam problematyczny fragment. Czasem Pending spada do zera po udanym remapowaniu (albo po tym, jak okazało się, że to był jednorazowy błąd odczytu), ale nie traktuj tego jak „uzdrowienia” bez sprawdzenia trendu.
Masz Pending? Najpierw kopiuj dane, dopiero potem baw się w diagnozę.
Uncorrectable Sector Count: błąd, którego nie dało się naprawić
Uncorrectable (czasem jako „Offline Uncorrectable”) oznacza, że dysk natrafił na błąd, którego nie umiał skorygować kodami ECC. W praktyce to często idzie w parze z komunikatami „bad block” w systemie i realnymi uszkodzeniami plików.
Tu nie ma co filozofować: jeśli rośnie Uncorrectable, a pliki zaczynają się nie otwierać lub archiwa zgłaszają błędy, to jest tryb „ratuj, co się da”. Najpierw rzeczy unikalne, potem reszta.
Gdy Uncorrectable rośnie, odpuść długie testy na systemie produkcyjnym i przenieś pracę na inny nośnik.
Spin Retry Count / Start/Stop Count: gdy mechanika zaczyna mieć humory
Atrybuty rozruchu talerzy (np. Spin Retry Count) i cykli uruchomień/zatrzymań (Start/Stop Count) łatwo źle odczytać. Same liczniki cykli nie są wyrokiem — dysk może mieć ich dużo i nadal działać. Natomiast Spin Retry albo nietypowo długi czas startu w połączeniu z objawami (zawieszki na starcie, „czekanie na dysk”, czasem metaliczne dźwięki) to sygnał mechaniczny, nie „programowy”.
Jeśli HDD czasem nie wstaje po restarcie lub BIOS raz go widzi, raz nie — to już nie jest temat do obserwowania tygodniami. Zabezpiecz dane, zanim problem stanie się stały.
Przy podejrzeniu problemów z rozruchem nie rób serii restartów „na sprawdzenie” — oszczędzaj cykle i rób kopię.
Gdy straszy tylko komunikacja: atrybuty od kabla, portu i zasilania
Nie każdy alarm S.M.A.R.T. oznacza, że talerze się sypią. Czasem dysk jest zdrowy, a problem leży po drodze: kabel SATA, luźna wtyczka, słaby port, przejściówka USB–SATA albo zasilacz, który przy obciążeniu „siada”. Dobra wiadomość: to zwykle da się szybko odsiać.
UltraDMA CRC Error Count: klasyk „kabelowy”
UltraDMA CRC Error Count to licznik błędów transmisji między dyskiem a kontrolerem. Gdy rośnie, bardzo często winny jest kabel SATA, port albo zakłócenia/styki. Sam dysk może być wtedy OK, a system i tak potrafi się przycinać, bo kontroler ponawia transmisję.
Jak to rozegrać praktycznie:
- Wyłącz komputer i podepnij dysk innym kablem SATA (krótkim, pewnym), najlepiej do innego portu.
- Jeśli to dysk w kieszeni/przejściówce USB – spróbuj innej obudowy lub podłącz bezpośrednio do SATA.
- Zrób nowy odczyt S.M.A.R.T. i obserwuj, czy CRC nadal przybywa w trakcie normalnej pracy.
Kluczowa rzecz: CRC zwykle nie „cofa się”. Liczy się to, czy przestaje rosnąć po poprawieniu okablowania. Jeśli tak — świetnie, właśnie kupiłeś sobie spokój minimalnym kosztem.
Masz rosnący CRC? Zmień kabel i port zanim uznasz dysk za skazany.
Command Timeout i resety: kiedy zasilanie robi bałagan
Niektóre raporty pokazują atrybuty związane z timeoutami komend lub resetami interfejsu. W parze z logami systemowymi („reset link”, „device reset”) bywa to ślad po zasilaniu: luźna wtyczka, rozgałęźnik SATA, zasilacz na granicy albo niestabilne USB w przypadku dysków zewnętrznych.
Jeśli problem pojawia się głównie podczas obciążenia (kopiowanie dużych plików, skan antywirusa, backup), podejrzewaj zasilanie. W praktyce wygrywa prosta diagnostyka: podłącz dysk do innej gałęzi zasilacza / innego portu USB, unikaj przedłużaczy, sprawdź, czy wtyczki siedzą „na klik”.
Zanim zrobisz ciężkie testy powierzchni, upewnij się, że dysk ma stabilne zasilanie i czystą komunikację.
SSD i NVMe: co jest normalnym zużyciem, a co czerwonym światłem
SSD rzadko „umiera” jak HDD z dnia na dzień przez sektory na talerzach, ale potrafi zrobić coś równie bolesnego: zacząć sypać błędami kontrolera, wejść w tryb tylko-do-odczytu albo znikać z systemu. Dlatego w SSD patrzysz mniej na „sektory”, a bardziej na zużycie, rezerwę i ostrzeżenia krytyczne.
Percent Used / Media Wearout: zużycie to licznik czasu, nie wyrok
W NVMe często spotkasz Percent Used, a w SATA SSD różne warianty typu Media Wearout Indicator. To wskaźnik zużycia komórek pamięci. Jego wzrost jest normalny — w końcu po to SSD jest używany.
Co z tego wynika decyzyjnie? Jeśli system działa stabilnie, nie ma błędów I/O i nie ma ostrzeżeń krytycznych, samo „zużycie” jest bardziej informacją planistyczną: kiedy przygotować budżet na wymianę, a nie kiedy panikować. W małej firmie to świetny argument, żeby wymienić dysk zanim zacznie być ryzykownie, a nie po awarii.
Sprawdź wskaźnik zużycia i wpisz sobie w kalendarz kontrolę za miesiąc — złapiesz tempo, a nie tylko stan.
Available Spare i „rezerwa”: kiedy SSD traci margines bezpieczeństwa
Available Spare (lub podobny atrybut) mówi, ile zapasowych bloków ma jeszcze SSD do zastępowania zużytych/uszkodzonych. Dopóki rezerwa jest zdrowa, SSD ma „poduszkę”. Gdy zaczyna jej ubywać albo pojawia się próg ostrzegawczy, ryzyko rośnie szybciej, niż wygląda to na wykresie.
Tu dobrze działa zasada praktyka: jeśli rezerwa spada albo dysk zaczyna raportować problemy z blokami, migracja jest tańsza niż nerwy. Zwykle to moment, w którym chcesz już mieć nowy nośnik na biurku, nie w koszyku sklepu.
Zobaczyłeś spadek rezerwy? Zrób klon lub backup i potraktuj to jako start procedury wymiany.
NVMe Critical Warning: jeden bit, który ma większą wagę niż „100% health”
W NVMe istnieje pole typu Critical Warning. To nie jest „opinie programu”, tylko flaga z kontrolera: może oznaczać m.in. problemy z rezerwą, przegrzewanie, degradację niezawodności lub wejście w stan awaryjny. Jeśli ta flaga jest ustawiona, nie negocjujesz z dyskiem — działasz.
W praktyce wygląda to tak: system raz działa normalnie, a potem nagle wywala błędy zapisu, aplikacje się zamykają, a S.M.A.R.T. niby jeszcze „zielony”. Critical Warning przebija te kolory. Najpierw zabezpiecz dane, potem dopiero dochodź przyczyny (temperatura, firmware, kontroler).
Jeżeli NVMe pokazuje ostrzeżenie krytyczne, przestań traktować komputer jak stabilny i przenieś ważne rzeczy od razu.
Bezpieczne testy S.M.A.R.T.: jak sprawdzać, żeby nie dobić dysku
Testy diagnostyczne są kuszące, bo dają poczucie kontroli. Przy dysku, który już ma problemy, źle dobrany test potrafi jednak zamienić „dało się skopiować” w „już się nie da”. Chodzi o to, by testował mądrze i w dobrej kolejności.
Kolejność działań: najpierw dane, potem długi test
Jeśli w S.M.A.R.T. widać niepokojące liczniki sektorowe (HDD) albo pojawiają się błędy I/O (SSD), najbardziej rozsądna kolejność to:
backup/klon → odczyt S.M.A.R.T. → krótki test → decyzja, czy długi test ma sens. Długi test potrafi wywołać lawinę odczytów z trudnych miejsc, a to dokładnie to, czego chcesz uniknąć przed zabezpieczeniem danych.
Gdy dane są już bezpieczne, długi test jest świetny do potwierdzenia: „czy dysk nadaje się jeszcze do mniej ważnych zadań, czy do kosza”.
Najpierw zabezpiecz to, czego nie odtworzysz, dopiero potem szukaj pełnej diagnozy.
Krótki test vs długi test: co realnie sprawdzają
Krótki test zwykle wykrywa oczywiste problemy elektroniki i podstawowe błędy. Jest szybki i rzadziej „męczy” dysk, więc nadaje się jako pierwszy krok po zrobieniu kopii najważniejszych plików.
Długi test (extended) przechodzi przez większą część powierzchni/obszarów i ma większą szansę natrafić na słabe sektory (HDD) albo wymusić korekcję/relokacje. To bywa użyteczne, ale na dysku z objawami może oznaczać wielogodzinne katowanie miejsc, które i tak są problematyczne.
Jeśli długi test zatrzymuje się, trwa „w nieskończoność” albo system zaczyna się wieszać — przerwij i wróć do trybu ratowania danych.
Zrób krótki test dla szybkiej odpowiedzi, a długi uruchamiaj dopiero, gdy masz plan B i zabezpieczone pliki.
Monitoring zamiast paniki: jak ustawić sensowne alerty i złapać trend
Jednorazowy odczyt S.M.A.R.T. odpowiada na pytanie „co jest dziś”. Najwięcej zyskujesz, gdy potrafisz odpowiedzieć na „czy to się pogarsza”. Trend jest bezlitosny: stabilne RAW przez tygodnie to często „incydent”, a rosnące liczniki (zwłaszcza sektorowe) to już proces.
Najprostsza taktyka: sprawdź S.M.A.R.T. dziś, potem jutro po normalnym użytkowaniu, potem za tydzień. Interesuje Cię kierunek, nie idealne „zdrowie 100%”. Zrób sobie nawyk: kiedy komputer zaczyna przymulać albo wyrzuca błędy, pierwsza rzecz to szybki odczyt S.M.A.R.T. i porównanie z poprzednim.
Jakie progi mają sens w domu i w małej firmie
Nie musisz budować systemu jak w serwerowni. Chodzi o alert, który uruchomi kopię i decyzję, a nie o kolejną aplikację, którą będziesz ignorować. Dobrze działają proste zasady:
- HDD: każdy wzrost Reallocated, Pending albo Uncorrectable = alarm do wykonania kopii i oceny, czy dysk nie idzie do wymiany.
- HDD: rosnący CRC = alarm „sprawdź kabel/port/zasilanie”, zanim zaczniesz oskarżać dysk.
- SSD/NVMe: ustawione Critical Warning lub spadające Available Spare = nie dyskutujesz, zabezpieczasz dane i planujesz wymianę.
Największa korzyść z progów jest psychologiczna: wiesz, kiedy reagować, a kiedy nie tracić czasu na obsesyjne odświeżanie CrystalDiskInfo. Ustal zasady raz i jedź nimi konsekwentnie.
Dodaj alert choćby dla jednego kluczowego parametru — lepiej dostać jeden sensowny sygnał niż dziesięć „żółtych” ostrzeżeń.
Narzędzia i automatyzacja: prosto, ale regularnie
W Windows wiele osób kończy na CrystalDiskInfo (autostart + powiadomienia), w Linuxie naturalnym wyborem bywa smartd (pakiet smartmontools) z mailami/logami, a w NAS-ach zwykle masz monitoring w panelu. Nie chodzi o to, by mieć „najlepsze” narzędzie, tylko by odczyt powtarzał się bez Twojej pamięci.
Jeżeli dysk jest w obudowie USB, miej z tyłu głowy, że część mostków USB–SATA nie przekazuje pełnego S.M.A.R.T. albo przekłamuje pola. Wtedy najlepszym testem porównawczym jest krótkie podłączenie dysku bezpośrednio do SATA lub do pewnej obudowy, która obsługuje S.M.A.R.T. poprawnie.
Ustaw monitoring na „sam się robi” — ręczne sprawdzanie kończy się tym, że sprawdzasz dopiero po problemie.
Co łączyć z S.M.A.R.T.: objawy systemu, które podbijają ryzyko
S.M.A.R.T. sam w sobie nie jest wróżbą, ale w połączeniu z objawami daje bardzo mocne wskazówki. Ten sam atrybut znaczy więcej, jeśli obok masz freezy, błędy wejścia/wyjścia albo znikający dysk. Wtedy decyzja „monitorować czy migrować” staje się dużo prostsza.
Windows: błędy w Podglądzie zdarzeń i „100% dysku”
Jeśli system nagle ma „100% użycia dysku” przy niskim transferze, a komputer reaguje z opóźnieniem, to często jest mieszanka: ponawiane operacje I/O, time-outy, korekcje błędów. W Podglądzie zdarzeń szukaj wpisów o błędach dysku, kontrolera, resetach urządzenia czy problemach ze sterownikiem magazynu.
Połączenie typu: przycięcia + błędy dysku w logach + rosnące Pending/Uncorrectable to sygnał, żeby przestać „testować z ciekawości” i przejść w tryb zabezpieczania danych.
Gdy system zaczyna się dławić na operacjach dyskowych, sprawdź logi i S.M.A.R.T. w tej samej godzinie — korelacja jest tu ważniejsza niż pojedyncza liczba.
Linux/macOS: I/O error i reset link jako czerwone lampki
W Linuxie typowe są komunikaty w dmesg o I/O error, reset link, device offline albo błędach systemu plików po twardym zawieszeniu. Na macOS podobnie — pojawiają się komunikaty o problemach z nośnikiem, a aplikacje potrafią „zamierać” na zapisie.
Jeśli widzisz resety linku i jednocześnie rośnie CRC, najpierw ogarnij warstwę połączenia. Jeśli jednak pojawiają się I/O error, a do tego rosną liczniki sektorowe lub NVMe pokazuje ostrzeżenia — szybka decyzja o migracji oszczędza mnóstwo czasu.
Zestaw S.M.A.R.T. + logi systemu daje Ci prawdziwy obraz sytuacji — sprawdzaj je razem.
Decyzja „wymieniać czy obserwować”: trzy szybkie scenariusze
Najtrudniejsze nie jest odczytanie S.M.A.R.T., tylko decyzja: działać od razu czy jeszcze dać dyskowi szansę. Pomaga podejście scenariuszowe: patrzysz na typ sygnału i na to, czy licznik rośnie.
Scenariusz 1: jeden incydent i cisza — obserwacja z planem
Bywa tak: pojawił się pojedynczy błąd, system raz się przyciął, a S.M.A.R.T. pokazuje coś niepokojącego, ale licznik stoi w miejscu przez kolejne dni. To nie znaczy „zapomnij”, tylko „ustaw kontrolę”.
Praktyczna decyzja: robisz porządną kopię (jeśli jej nie ma), zapisujesz stan S.M.A.R.T. i wracasz do tematu po tygodniu lub po pierwszym kolejnym objawie. Dysk może jeszcze długo działać, ale Ty już nie jesteś zaskoczony.
Ustal termin ponownej kontroli i trzymaj się go — trend pokaże prawdę szybciej niż przeczucia.
Scenariusz 2: liczniki rosną — migracja zanim zrobi się gorąco
Rosnące Pending/Uncorrectable/Reallocated w HDD albo spadek Available Spare w SSD to sytuacja, w której każda godzina pracy to dodatkowe ryzyko. Tu nie ma sensu prowadzić długich eksperymentów „czy test przejdzie”. Lepiej wykonać klon na nowy dysk albo pełny backup i dopiero potem bawić się w diagnostykę.
To typowy moment, kiedy ludzie tracą czas na „jeszcze jeden skan”, a potem zostaje już tylko odzysk danych. Szybciej (i taniej) jest przenieść system i zamknąć temat.
Jeśli coś rośnie, działaj tak, jakby dysk miał się wysypać jutro — bo czasem dokładnie tak się kończy.
Scenariusz 3: dysk znika albo sypie błędami zapisu — stop testom, myśl o odzysku
Najbardziej podstępna sytuacja to niestabilność: dysk raz jest widoczny, raz nie, system gubi partycje, pojawiają się błędy zapisu, a NVMe potrafi wejść w tryb tylko-do-odczytu. Wtedy intensywne testy i wielokrotne restarty często pogarszają sprawę.
Jeśli dane są krytyczne, rozsądny ruch to minimalizować pracę dysku: nie instalować niczego, nie uruchamiać „napraw” systemu plików w ciemno, nie katować benchmarkami. Najpierw kopia tego, co najważniejsze (zaczynając od niepowtarzalnych plików), a gdy nie idzie — rozważenie specjalistycznego odzysku.
Gdy nośnik jest niestabilny, ogranicz operacje do minimum i skup się na ratowaniu tego, czego nie da się odtworzyć.
Kluczowe Wnioski
- S.M.A.R.T. to narzędzie do zarządzania ryzykiem, nie wyrocznia: sens ma dopiero połączenie atrybutów z objawami (przycięcia, rozłączanie, błędy systemu) i trendem, czyli tym, czy wartości rosną w czasie.
- „PASSED” w smartctl albo „SMART OK” nie daje gwarancji bezpieczeństwa danych — część awarii jest nagła (kontroler, elektronika, firmware, przepięcie) i potrafi nadejść bez wcześniejszych czerwonych flag.
- Najwięcej przewagi S.M.A.R.T. daje przy awariach narastających: rosnące Pending/Uncorrectable, pojawiające się realokacje w HDD, spadek rezerwy i pogarszająca się korekcja błędów w SSD — to sygnał, że masz czas na klon/migrację, zanim polecą pliki.
- Nie wpadaj w pułapkę samego RAW: surowe wartości nie mają jednego standardu, czasem są kodowane lub „zlepione” z kilku pól; patrz też na VALUE/WORST/THRESH i przede wszystkim na kierunek zmian.
- Kontekst decyduje o reakcji: dysk systemowy przy pierwszych poważnych symptomach zwykle kwalifikuje się do szybkiej wymiany i klonowania, a dysk „magazynowy” może działać dłużej — ale nie powinien być jedyną kopią ważnych danych.
- Najbezpieczniejsza kolejność działań jest prosta: najpierw zabezpieczenie danych, potem dociekania — w praktyce to różnica między spokojnym przeniesieniem systemu a nerwowym odzyskiem.
Źródła informacji
- SMART Attribute Annex (S.M.A.R.T. Attribute List). T13 Technical Committee (INCITS ATA/ATAPI) – Definicje i znaczenie atrybutów S.M.A.R.T. dla dysków ATA/SATA.
- smartctl Manual Page (smartmontools). smartmontools Project – Opis pól raportu, testów short/long i interpretacji wyników smartctl.
- NVM Express Base Specification. NVM Express, Inc. – SMART/Health Information Log i pola ostrzeżeń krytycznych dla NVMe.
- CrystalDiskInfo User Manual / Help. Crystal Dew World – Zasady kolorów ostrzeżeń i prezentacji atrybutów S.M.A.R.T. w CrystalDiskInfo.
- Failure Trends in a Large Disk Drive Population. USENIX Association (2007) – Badanie korelacji atrybutów SMART z awariami w dużej populacji dysków.






