NAS svítí červeně, píská a vy nejste schopní se dostat k firemním datům. V návalu adrenalinu vás napadne kliknout na „Opravit“ nebo vyměnit disk a spustit rebuild. V tu chvíli se z běžného výpadku hardwaru může stát trvalá ztráta dat. My v servisu vidíme, že největší škody nepáchá původní selhání disku, ale ukvapená svépomoc. Pojďme si říct, co dělat a čemu se za každou cenu vyhnout.
Rychlý verdikt
- STOP signály: disk klepe, skřípe, píská nebo cítíte spáleninu → okamžitě vypněte a dál netestujte. Každý další pokus může stav zhoršit.
- Nedělejte slepý rebuild: když nevíte, co přesně se stalo (např. vypadly dva disky z RAID 5), rebuild může přepsat metadata a paritu.
- Nejdřív kopie: bitová kopie každého disku na zdravé médium. Pracujte vždy nad kopiemi, nikdy ne nad originály.
- Kdy je šance dobrá: disky jsou čitelné a jen se rozpadla konfigurace, nebo je pole
degradeda data jsou pořád dostupná.
U RAID/NAS rozhoduje pořadí disků a práce nad kopiemi. Čím méně pokusů před diagnostikou, tím lepší šance na obnovu.
Rychlá odpověď: co udělat teď
Když NAS hlásí Degraded, Crashed, Missing volume, Not Initialized nebo server najednou nevidí sdílená data, největší hodnota je zachovat původní stav. RAID se často dá složit zpět, ale jen pokud se do něj mezitím zbytečně nezapisovalo.
První minuty rozhodují. Zastavit pokusy, označit disky, neformátovat a pracovat až nad kopiemi.
Prakticky:
- Pokud disk klepe, píská, škrábe nebo je cítit spálenina, zařízení vypněte.
- Neklikejte na
repair,rebuild,initializeanicreate new volume. - Označte si pořadí disků podle šachet a vyfoťte aktuální stav administrace.
- Pokud jsou data pořád dostupná, kopírujte jen nejdůležitější soubory a nic dalšího na NAS nezapisujte.
- U nejasného selhání řešte záchranu dat dřív než další pokusy.
Pořadí disků je pro rekonstrukci často stejně důležité jako samotné disky. Vyndat, pomíchat a zkoušet je nejhorší varianta.
Jak poznáte problém s RAID/NAS
Ne vždy musí jít o totální kolaps. Problém se často hlásí postupně a je dobré tyto signály neignorovat.
Degraded stav není konec světa, ale je to stav bez rezervy. Další chyba disku nebo špatný rebuild může rozhodnout.
- Světelná signalizace: Oranžová nebo červená LED na NASu (Synology, QNAP) nebo serveru. Může svítit trvale nebo blikat.
- Zvuková výstraha: Pravidelné pípání, které upozorňuje na degradaci pole.
- Stav pole: V administraci vidíte status
Degraded,Crashed,Read-Only,Missing volumeneboNot Initialized. - Snížený výkon: Extrémně pomalé kopírování, záseky systému, soubory nejdou otevřít.
- SMART chyby: Výstrahy v administraci na vadné sektory, vysokou teplotu nebo chyby čtení.
- Neobvyklý zvuk: Cvakání, klepání, škrábání nebo pískání. To už je kritický stav mechaniky.
Co NEdělat
Tady v servisu vidíme opakující se scénáře chyb, které z řešitelného problému udělají složitou a někdy nemožnou záchranu.
Když vidíte některý z těchto stavů, nepokračujte metodou pokus-omyl. U RAID/NAS je důležité zachovat původní stav disků.
- Slepý rebuild/repair: Pokud vypadne více disků, než je tolerance pole, nebo je jeden z disků mechanicky poškozený, rebuild zatíží zbylé disky čtením a může přepsat metadata. Je to častý důvod, proč k nám pole dorazí ve výrazně horším stavu.
- Inicializace disků: Když systém hlásí „nezinicializovaný disk“, nikdy neklikejte na inicializaci. Přepíšete tím začátek disku s klíčovými metadaty RAIDu.
- Přehazování pořadí: Vyndáte disky z NASu, očistíte je, a pak je vrátíte v jiném pořadí. Pro řadič je to chaos, který může vést k rozpadu pole.
- Další zápis: Pokud se na pole ještě dostanete, okamžitě přestaňte cokoliv zapisovat. Každý nový soubor nebo změna může přepsat bloky, které potřebujete zachránit.
- Opakované zapínání: Disk klepe? Vypnout a už nezapínat. Každý pokus o roztočení může hlavičkou nenávratně zničit datovou vrstvu.
- Recovery software nad originály: Spouštět skenování souborového systému přímo na nemocných discích je hazard. Pokud disk umírá, skenování ho dorazí.
RAID 0/1/5/6/10: co která úroveň přežije
Každá úroveň RAIDu má jinou toleranci k výpadku disků. Tady je přehled, se kterým v servisu denně pracujeme.
Kolik výpadků disků která úroveň RAID přežije — a kde už nezbývá rezerva.
| RAID | Co vydrží | Praktický komentář |
|---|---|---|
| RAID 0 | 0 disků | Žádná redundance. Selhání jediného disku rozbije celé pole. Data jsou rozprostřena (striping), bez všech členů je to skládačka bez půlky dílků. |
| RAID 1 | 1 disk (zrcadlo) | Přežije výpadek jednoho disku. Pozor, smazání souboru nebo napadení ransomwarem se okamžitě zrcadlí i na druhý disk. RAID 1 chrání jen proti selhání HW, ne proti chybě uživatele. |
| RAID 5 | 1 disk | V degraded režimu už nemáte žádnou rezervu. Při selhání druhého disku nebo chybě čtení při rebuildu je pole kriticky ohrožené a data mohou být nedostupná. U velkých dnešních disků je rebuild dlouhý a rizikový. |
| RAID 6 | 2 disky | Odolnější varianta. I při výpadku jednoho disku stále máte paritu na druhém. Rebuild je ale extrémně dlouhý a náročný, chyby čtení na zbylých discích ho mohou zhatit. |
| RAID 10 | Záleží na páru | Kombinace zrcadlení a stripu. Přežije výpadek více disků, pokud nejsou ze stejného zrcadleného páru. Pokud odejdou oba disky z jednoho páru, pole je mrtvé. |
Kdy jde data zachránit a kdy už je šance malá
Následující tabulka ukazuje typické scénáře, se kterými se setkáváme. Neslibujeme zázraky, ale ukazuje, co hraje roli.
| Scénář | Šance na obnovu | Co je potřeba |
|---|---|---|
| Rozpadlá konfigurace (disky OK, pole se nenašlo) | Velmi vysoká | Správně určit parametry pole (pořadí, stripe size, offset) a složit ho softwarově nad kopiemi. |
| Degraded pole, disky čitelné | Vysoká | Udělat kopie všech disků, ověřit jejich zdraví, a teprve pak řešit výměnu a rebuild. |
| Vadný NAS/řadič, disky OK | Vysoká | Data jdou často vyčíst na běžném Linuxu. Ale vždy až z kopií, ne z originálů. |
| Přeformátování bez velkého přepisu | Střední až vysoká | Záleží na typu formátu a souborovém systému. Metadata jsou přepsaná, ale data často zůstávají. |
| Opakované výpadky, vadné sektory | Střední až nízká | Nutná práce v laboratoři. Čtení přes vadné sektory je pomalé a rizikové, vyžaduje specializovaný hardware. |
| Nedokončený nebo špatně spuštěný rebuild | Nízká až velmi nízká | Došlo k přepisu metadat a části dat. Často jsou data fragmentovaná a bez logické struktury. |
| Klepání/klikání mechaniky | Nízká (záleží na rozsahu poškození) | Nutný zásah v čistých prostorách, výměna čtecích hlaviček. Každé další zapnutí šanci snižuje. |
Reálné scénáře, které často řešíme
Ne každý pád NASu je stejný. Dva případy mohou na obrazovce vypadat podobně, ale technicky se řeší úplně jinak.
Synology SHR nebo RAID 5 po výpadku jednoho disku Pokud je pole jen degraded, data jsou čitelná a ostatní disky jsou zdravé, může dávat smysl standardní výměna vadného disku. Jakmile se ale objevují SMART chyby i na dalším disku, přestává to být běžný servisní repair a začíná záchrana dat.
QNAP po neúspěšném rebuildu Tohle je horší situace. Rebuild zatížil zbývající disky, mohl přepsat část parity a metadata už nemusí odpovídat původnímu stavu. Tady je zásadní nezkoušet další repair, ale udělat obrazy disků a analyzovat, co se přesně přepsalo.
RAID 0 v externím boxu RAID 0 nemá žádnou redundanci. Když chybí jeden disk, chybí část dat. Šance závisí na tom, jestli disk jde ještě aspoň částečně číst a jestli známe parametry pole. U důležitých dat je RAID 0 špatná volba.
NAS po ransomwaru RAID nepomůže, pokud ransomware zašifruje sdílené soubory. Pole zůstane technicky zdravé, ale data jsou logicky poškozená. V takovém případě řešíme snapshoty, zálohy, stínové kopie nebo částečnou obnovu podle typu útoku.
Diagnostika ukáže, jestli je disk vhodný pro další čtení, nebo jestli je nutné postupovat pomaleji a šetřit každý pokus.
Bezpečný postup obnovy
Když k nám do servisu přivezete pole, držíme se přesně daného postupu, abychom nic nepokazili. Níže je princip, podle kterého se bezpečná obnova dělá. U vadných disků nebo nejasného rozpadu pole ho ale doma nedoporučujeme zkoušet naslepo.
Bitová kopie je základ bezpečné práce. Skenování a rekonstrukce běží nad kopií, ne nad původním diskem.
Bezpečný postup: nejdřív bitové kopie všech disků, rekonstrukce a export až nad nimi — originály se nedotýkáme.
- Evidence a dokumentace: Zapište si přesné pořadí disků (šachta 1, 2, 3…), jejich sériová čísla a co se dělo – časová osa událostí. To je pro rekonstrukci často zásadní.
- Bitová kopie (imaging): Každý disk připojíme přes hardwarový write-blocker (ochrana proti zápisu) a vytvoříme jeho kompletní bitovou kopii na zdravé, prázdné médium. U vadných disků používáme specializované nástroje, které umí číst přes vadné sektory.
- Kontrola čitelnosti kopií: Ověříme, že kopie jsou kompletní a bez chyb. Pracujeme výhradně s nimi.
- Rekonstrukce parametrů: Analyzujeme metadata a hledáme správné parametry – pořadí disků, velikost stripu (stripe size), offset, typ parity a rotaci, typ metadat (např. mdadm, LVM, Intel Matrix).
- Složení pole a export dat: Virtuálně složíme pole jen pro čtení (read-only), ověříme strukturu souborového systému a data exportujeme na cílové médium, které si přinesete.
Cílem není „rozchodit NAS za každou cenu“. Cílem je dostat data bezpečně ven na jiné médium a teprve potom řešit nové úložiště.
Synology/QNAP specifika
Každý výrobce má svá specifika, která musíme při záchraně znát.
- Synology: Většinou používá Linuxový softwarový RAID (
mdadm) v kombinaci s LVM (Logical Volume Manager) a souborovým systémemext4nebobtrfs. Jejich vlastní technologie SHR (Synology Hybrid RAID) je také postavená nad tímto stackem. Výhodou je, že data jdou často připojit a číst i na běžném Linuxovém PC, ale opakujeme – vždy až z kopií. - QNAP: Používá vlastní vrstvy v rámci QTS nebo QuTS (ZFS) systému. Můžete narazit na storage pooly, RAID groupy a specifické konfigurace. I zde platí, že vendor repair je legitimní servisní postup jen v případě, že jste si naprosto jisti, že zbývající disky jsou fyzicky zdravé a jde jen o standardní výměnu vadného kusu v degraded poli. V jakékoliv jiné, krizové situaci je bezpečnější vše zastavit a řešit to přes kopie.
Cena, čas a co ovlivní úspěšnost
U RAID a NAS záchrany dat nejde dopředu férově slíbit pevnou cenu bez diagnostiky. Rozdíl je obrovský: jinak se řeší rozpadlá konfigurace se zdravými disky a jinak pole po neúspěšném rebuildu, vadných sektorech nebo mechanicky poškozeném disku.
Úspěšnost nejvíc ovlivní:
- kolik disků fyzicky selhalo,
- jestli někdo spustil rebuild nebo inicializaci,
- zda existuje aktuální záloha,
- zda jsou známé šachty a pořadí disků,
- typ RAIDu, souborového systému a NAS platformy,
- jestli se po havárii na pole dál zapisovalo.
První posouzení začíná tím, že zjistíme stav disků a konfigurace. Teprve potom dává smysl říct, jestli půjde o běžnou obnovu, složitější rekonstrukci RAIDu, nebo laboratorní zásah.
Proč neopravujeme původní pole jako první
U běžného servisu dává smysl opravit zařízení. U záchrany dat je pořadí opačné: nejdřív zachránit data, potom řešit zařízení. Původní pole může být v nestabilním stavu a každá operace, která do něj zapisuje, může zhoršit výsledek.
Proto se vyhýbáme těmto krokům, dokud nejsou data v bezpečí:
- rebuild nad originálními disky,
- oprava souborového systému přímo na poli,
- inicializace nebo vytvoření nového volume,
- sken recovery softwarem nad vadným originálem,
- opakované zapínání disku s mechanickou závadou.
Jakmile jsou data exportovaná, je čas rozhodnout, jestli původní NAS opravit, postavit nové úložiště, vyměnit disky, změnit RAID úroveň nebo nastavit lepší zálohování.
Co nám přivézt nebo poslat
Čím lepší informace dostaneme na začátku, tím méně času ztratíme rekonstrukcí. Ideální je přivézt celý NAS nebo server v původním stavu. Pokud to nejde, pomůže aspoň přesná dokumentace.
Připravte si:
- model NASu nebo serveru,
- počet disků a jejich původní pořadí ve slotech,
- fotku administrace se stavem pole,
- časovou osu: co se stalo jako první, co jste zkusili potom,
- informaci, jestli proběhl rebuild, repair, inicializace nebo výměna disku,
- cílové médium pro zachráněná data.
Po obnově dat má smysl hned nastavit zálohování dat, protože RAID sám o sobě záloha není.
Časté dotazy
Mám vyměnit vadný disk a kliknout repair? Pouze pokud jste si na 100 % jisti, že selhal právě jeden disk a všechny ostatní jsou v perfektním stavu (bez SMART chyb, vadných sektorů). V opačném případě je to riskantní operace, která může pole zničit. Když si nejste jistí, nedělejte to.
Můžu disky připojit k Windows? Ne. Windows nativně nerozumí souborovým systémům jako ext4, btrfs, ani softwarovému RAIDu z Linuxu (mdadm). Pokus o připojení může vést k výzvě k inicializaci disku, což by mělo fatální následky.
NAS ukazuje data, ale hlásí degraded — co teď? Okamžitě zálohujte nejdůležitější data na externí disk, pokud je to možné. Pak řešte výměnu disku. Nezapomínejte, že v degraded stavu nemáte žádnou ochranu proti selhání dalšího disku.
Musím přivézt celý NAS, nebo jen disky? Ideálně přivezte celý NAS. Pro nás je důležitá znalost modelu a verze systému. Pokud vezete jen disky, je kriticky důležité mít přesně označené jejich pořadí (šachta 1, 2, 3…). Bez toho se rekonstrukce extrémně komplikuje.
Pomůže RAID, když jsem něco omylem smazal? Ne. RAID chrání proti výpadku hardwaru, ale není to záloha. Před smazáním souborů, chybou uživatele nebo ransomwarem vás neochrání. I pro NAS a servery platí pravidlo zálohování 3-2-1.
Oficiální návody výrobců vs. záchrana dat
Synology i QNAP mají oficiální postupy pro opravu degraded pole. Ty dávají smysl, pokud je jasné, že selhal právě jeden disk, ostatní disky jsou zdravé a máte aktuální zálohu. Pokud si tím jistí nejste, je bezpečnější zastavit a nejdřív udělat kopie. Pro orientaci: Synology popisuje repair storage pool, QNAP popisuje obnovu RAID group ve stavu degraded. Tyto návody nejsou totéž jako záchrana dat po nejasné havárii.
Pokud váš NAS nebo server hlásí chybu, zachovejte klid a hlavně nic nezkoušejte naslepo. Zavolejte nám dřív, než spustíte rebuild. Správně popsané pořadí disků a časová osa událostí je půlka úspěchu. O zbytek se postaráme v rámci záchrany dat v Brně. A až budete mít data v bezpečí, mrkněte na naše tipy pro správné zálohování, protože RAID sám o sobě záloha opravdu není.
Nechce se vám to řešit svépomocí?
Objednejte diagnostiku v Brně — cenu řekneme předem, bez vašeho souhlasu se do ničeho nepouštíme.