NAS світиться червоним, пищить, і ви не можете дістатися до корпоративних даних. У пориві адреналіну вам спадає на думку натиснути «Виправити» або замінити диск і запустити rebuild. У цей момент звичайний апаратний збій може перетворитися на незворотну втрату даних. У нашому сервісі ми бачимо, що найбільшої шкоди завдає не початкова відмова диска, а поспішні самостійні дії. Давайте розберемося, що робити і чого за будь-яку ціну уникати.
Швидкий вердикт
- СТОП-сигнали: диск стукає, скрегоче, пищить або відчувається запах горілого → негайно вимкніть і більше не тестуйте. Кожна наступна спроба може погіршити стан.
- Не робіть сліпий rebuild: коли ви не знаєте, що саме сталося (наприклад, випали два диски з RAID 5), rebuild може перезаписати метадані та парність.
- Спочатку копії: бітова копія кожного диска на здоровий носій. Завжди працюйте над копіями, ніколи над оригіналами.
- Коли шанс хороший: диски читаються, і лише розпалася конфігурація, або масив перебуває в стані
degraded, а дані все ще доступні.
Для RAID/NAS вирішальними є порядок дисків і робота над копіями. Чим менше спроб перед діагностикою, тим кращі шанси на відновлення.
Швидка відповідь: що зробити зараз
Коли NAS повідомляє Degraded, Crashed, Missing volume, Not Initialized або сервер раптово не бачить спільні дані, найцінніше — зберегти початковий стан. RAID часто можна зібрати назад, але лише якщо на нього не було зайвого запису.
Перші хвилини вирішальні. Припинити спроби, позначити диски, не форматувати і працювати лише над копіями.
Практично:
- Якщо диск стукає, пищить, скрегоче або відчувається запах горілого, вимкніть пристрій.
- Не натискайте
repair,rebuild,initializeабоcreate new volume. - Позначте порядок дисків за слотами та сфотографуйте поточний стан адміністрування.
- Якщо дані все ще доступні, копіюйте лише найважливіші файли і більше нічого не записуйте на NAS.
- У разі незрозумілого збою зверніться за відновленням даних раніше, ніж робити нові спроби.
Порядок дисків для реконструкції часто так само важливий, як і самі диски. Вийняти, перемішати і пробувати — найгірший варіант.
Як розпізнати проблему з RAID/NAS
Не завжди йдеться про повний колапс. Проблема часто проявляється поступово, тому важливо не ігнорувати ці сигнали.
Стан degraded — це не кінець світу, але це стан без резерву. Наступна помилка диска або невдалий rebuild можуть стати вирішальними.
- Світлова індикація: Помаранчевий або червоний світлодіод на NAS (Synology, QNAP) або сервері. Може світитися постійно або блимати.
- Звуковий сигнал: Регулярне пищання, яке попереджає про деградацію масиву.
- Стан масиву: В адмініструванні ви бачите статус
Degraded,Crashed,Read-Only,Missing volumeабоNot Initialized. - Знижена продуктивність: Надзвичайно повільне копіювання, зависання системи, файли не відкриваються.
- Помилки SMART: Попередження в адмініструванні про пошкоджені сектори, високу температуру або помилки читання.
- Незвичний звук: Клацання, стукіт, скрегіт або свист. Це вже критичний стан механіки.
Чого НЕ робити
Тут, у сервісі, ми бачимо повторювані сценарії помилок, які перетворюють вирішувану проблему на складне, а іноді й неможливе відновлення.
Коли ви бачите один із цих станів, не продовжуйте методом спроб і помилок. Для RAID/NAS важливо зберегти початковий стан дисків.
- Сліпий rebuild/repair: Якщо випало більше дисків, ніж допускає масив, або один із дисків механічно пошкоджений, rebuild навантажує решту дисків читанням і може перезаписати метадані. Це часта причина, через яку масив потрапляє до нас у значно гіршому стані.
- Ініціалізація дисків: Коли система повідомляє «неініціалізований диск», ніколи не натискайте ініціалізацію. Це перезапише початок диска з ключовими метаданими RAID.
- Перестановка порядку: Виймаєте диски з NAS, чистите їх, а потім повертаєте в іншому порядку. Для контролера це хаос, який може призвести до розпаду масиву.
- Подальший запис: Якщо ви ще можете отримати доступ до масиву, негайно припиніть будь-який запис. Кожен новий файл або зміна може перезаписати блоки, які вам потрібно врятувати.
- Повторне ввімкнення: Диск стукає? Вимкнути і більше не вмикати. Кожна спроба розкручування може головкою незворотно знищити шар даних.
- Recovery-софт над оригіналами: Запускати сканування файлової системи безпосередньо на хворих дисках — це авантюра. Якщо диск вмирає, сканування його доб’є.
RAID 0/1/5/6/10: що який рівень переживе
Кожен рівень RAID має різну стійкість до відмови дисків. Ось огляд, з яким ми щодня працюємо в сервісі.
Скільки відмов дисків переживає кожен рівень RAID — і де вже не залишається резерву.
| RAID | Що витримує | Практичний коментар |
|---|---|---|
| RAID 0 | 0 дисків | Жодної надлишковості. Відмова єдиного диска руйнує весь масив. Дані розподілені (striping), без усіх членів це пазл без половини частин. |
| RAID 1 | 1 диск (дзеркало) | Переживає відмову одного диска. Увага: видалення файлу або атака програми-вимагача негайно дзеркалюється на другий диск. RAID 1 захищає лише від апаратного збою, а не від помилки користувача. |
| RAID 5 | 1 диск | У режимі degraded у вас уже немає жодного резерву. При відмові другого диска або помилці читання під час rebuild масив перебуває під критичною загрозою, і дані можуть стати недоступними. Для сучасних великих дисків rebuild тривалий і ризикований. |
| RAID 6 | 2 диски | Більш стійкий варіант. Навіть при відмові одного диска у вас все ще є парність на другому. Але rebuild надзвичайно довгий і вимогливий, помилки читання на решті дисків можуть його зірвати. |
| RAID 10 | Залежить від пари | Комбінація дзеркалювання та striping. Переживає відмову кількох дисків, якщо вони не з однієї дзеркальної пари. Якщо виходять з ладу обидва диски з однієї пари, масив мертвий. |
Коли дані можна врятувати, а коли шанс малий
Наступна таблиця показує типові сценарії, з якими ми стикаємося. Ми не обіцяємо чудес, але показуємо, що відіграє роль.
| Сценарій | Шанс на відновлення | Що потрібно |
|---|---|---|
| Розпад конфігурації (диски OK, масив не знайдено) | Дуже високий | Правильно визначити параметри масиву (порядок, stripe size, offset) і зібрати його програмно над копіями. |
| Degraded масив, диски читаються | Високий | Зробити копії всіх дисків, перевірити їхнє здоров’я, і лише потім вирішувати заміну та rebuild. |
| Несправний NAS/контролер, диски OK | Високий | Дані часто можна прочитати на звичайному Linux. Але завжди з копій, а не з оригіналів. |
| Переформатування без значного перезапису | Середній до високого | Залежить від типу формату та файлової системи. Метадані перезаписані, але дані часто залишаються. |
| Повторні збої, пошкоджені сектори | Середній до низького | Необхідна робота в лабораторії. Читання через пошкоджені сектори повільне та ризиковане, потребує спеціалізованого обладнання. |
| Незавершений або неправильно запущений rebuild | Низький до дуже низького | Відбувся перезапис метаданих і частини даних. Часто дані фрагментовані та без логічної структури. |
| Стукіт/клацання механіки | Низький (залежить від ступеня пошкодження) | Необхідне втручання в чистих приміщеннях, заміна читаючих головок. Кожне наступне ввімкнення знижує шанс. |
Реальні сценарії, які ми часто вирішуємо
Не кожне падіння NAS однакове. Два випадки можуть виглядати на екрані схоже, але технічно вирішуються зовсім по-різному.
Synology SHR або RAID 5 після відмови одного диска Якщо масив лише degraded, дані читаються, а решта дисків здорові, може мати сенс стандартна заміна несправного диска. Але якщо з’являються помилки SMART на іншому диску, це перестає бути звичайним сервісним repair і стає відновленням даних.
QNAP після невдалого rebuild Це гірша ситуація. Rebuild навантажив решту дисків, міг перезаписати частину парності, і метадані вже можуть не відповідати початковому стану. Тут критично важливо не пробувати ще один repair, а зробити образи дисків і проаналізувати, що саме було перезаписано.
RAID 0 у зовнішньому боксі RAID 0 не має жодної надлишковості. Якщо відсутній один диск, відсутня частина даних. Шанс залежить від того, чи можна диск хоча б частково прочитати і чи відомі нам параметри масиву. Для важливих даних RAID 0 — поганий вибір.
NAS після атаки програми-вимагача RAID не допоможе, якщо програма-вимагач зашифрує спільні файли. Масив залишиться технічно здоровим, але дані логічно пошкоджені. У такому випадку ми вирішуємо питання снепшотів, резервних копій, тіньових копій або часткового відновлення залежно від типу атаки.
Діагностика покаже, чи придатний диск для подальшого читання, чи потрібно діяти повільніше та берегти кожну спробу.
Безпечна процедура відновлення
Коли ви привозите масив до нашого сервісу, ми дотримуємося чітко визначеної процедури, щоб нічого не зіпсувати. Нижче наведено принцип, за яким виконується безпечне відновлення. Однак для пошкоджених дисків або незрозумілого розпаду масиву ми не рекомендуємо пробувати це вдома наосліп.
Бітова копія — основа безпечної роботи. Сканування та реконструкція виконуються над копією, а не над оригінальним диском.
Безпечна процедура: спочатку бітові копії всіх дисків, реконструкція та експорт лише над ними — оригінали не чіпаємо.
- Облік і документація: Запишіть точний порядок дисків (слот 1, 2, 3…), їхні серійні номери та що сталося – хронологію подій. Це часто є критичним для реконструкції.
- Бітова копія (imaging): Кожен диск підключаємо через апаратний write-blocker (захист від запису) і створюємо його повну бітову копію на здоровий, порожній носій. Для пошкоджених дисків використовуємо спеціалізовані інструменти, які вміють читати через пошкоджені сектори.
- Перевірка читаності копій: Перевіряємо, що копії повні та без помилок. Працюємо виключно з ними.
- Реконструкція параметрів: Аналізуємо метадані та шукаємо правильні параметри – порядок дисків, розмір страйпу (stripe size), offset, тип парності та ротацію, тип метаданих (наприклад, mdadm, LVM, Intel Matrix).
- Складання масиву та експорт даних: Віртуально збираємо масив лише для читання (read-only), перевіряємо структуру файлової системи та експортуємо дані на цільовий носій, який ви приносите.
Мета не «запустити NAS за будь-яку ціну». Мета — безпечно витягти дані на інший носій, і лише потім вирішувати питання нового сховища.
Специфіка Synology/QNAP
Кожен виробник має свою специфіку, яку ми повинні знати під час відновлення.
- Synology: Зазвичай використовує Linux software RAID (
mdadm) у поєднанні з LVM (Logical Volume Manager) та файловою системоюext4абоbtrfs. Їхня власна технологія SHR (Synology Hybrid RAID) також побудована на цьому стеку. Перевага в тому, що дані часто можна підключити та читати навіть на звичайному Linux-ПК, але повторюємо — завжди з копій. - QNAP: Використовує власні шари в рамках системи QTS або QuTS (ZFS). Ви можете зіткнутися зі storage pools, RAID groups і специфічними конфігураціями. І тут діє правило: vendor repair є легітимною сервісною процедурою лише тоді, коли ви абсолютно впевнені, що решта дисків фізично здорові, і йдеться лише про стандартну заміну несправного екземпляра в degraded-масиві. У будь-якій іншій, кризовій ситуації безпечніше все зупинити та вирішувати через копії.
Ціна, час і що впливає на успішність
Для відновлення даних з RAID і NAS неможливо заздалегідь чесно назвати фіксовану ціну без діагностики. Різниця величезна: по-іншому вирішується розпад конфігурації зі здоровими дисками, і по-іншому — масив після невдалого rebuild, з пошкодженими секторами або механічно пошкодженим диском.
На успішність найбільше впливають:
- скільки дисків фізично вийшло з ладу,
- чи запускав хтось rebuild або ініціалізацію,
- чи існує актуальна резервна копія,
- чи відомі слоти та порядок дисків,
- тип RAID, файлової системи та платформи NAS,
- чи здійснювався подальший запис на масив після аварії.
Перша оцінка починається зі з’ясування стану дисків і конфігурації. Лише після цього має сенс говорити, чи йтиметься про звичайне відновлення, складнішу реконструкцію RAID чи лабораторне втручання.
Чому ми не ремонтуємо оригінальний масив насамперед
При звичайному сервісі має сенс ремонтувати пристрій. При відновленні даних порядок зворотний: спочатку врятувати дані, потім вирішувати питання з пристроєм. Оригінальний масив може бути в нестабільному стані, і будь-яка операція, яка на нього записує, може погіршити результат.
Тому ми уникаємо таких кроків, доки дані не в безпеці:
- rebuild над оригінальними дисками,
- ремонт файлової системи безпосередньо на масиві,
- ініціалізація або створення нового volume,
- сканування recovery-софтом над пошкодженим оригіналом,
- повторне ввімкнення диска з механічною несправністю.
Як тільки дані експортовано, настає час вирішувати, чи ремонтувати оригінальний NAS, побудувати нове сховище, замінити диски, змінити рівень RAID або налаштувати краще резервне копіювання.
Що нам привезти або надіслати
Чим кращу інформацію ми отримаємо на початку, тим менше часу втратимо на реконструкцію. Ідеально привезти весь NAS або сервер у початковому стані. Якщо це неможливо, допоможе хоча б точна документація.
Підготуйте:
- модель NAS або сервера,
- кількість дисків та їхній початковий порядок у слотах,
- фото адміністрування зі станом масиву,
- хронологію: що сталося спочатку, що ви пробували потім,
- інформацію, чи відбувався rebuild, repair, ініціалізація або заміна диска,
- цільовий носій для врятованих даних.
Після відновлення даних має сенс одразу налаштувати резервне копіювання даних, оскільки RAID сам по собі не є резервною копією.
Часті запитання
Чи замінити несправний диск і натиснути repair? Лише якщо ви на 100% впевнені, що вийшов з ладу саме один диск, а всі інші в ідеальному стані (без помилок SMART, пошкоджених секторів). В іншому випадку це ризикована операція, яка може знищити масив. Якщо не впевнені, не робіть цього.
Чи можна підключити диски до Windows? Ні. Windows не розуміє файлові системи, такі як ext4, btrfs, а також software RAID з Linux (mdadm). Спроба підключення може призвести до запиту на ініціалізацію диска, що матиме фатальні наслідки.
NAS показує дані, але повідомляє degraded — що тепер? Негайно створіть резервну копію найважливіших даних на зовнішній диск, якщо це можливо. Потім вирішуйте питання заміни диска. Не забувайте, що в стані degraded у вас немає жодного захисту від відмови наступного диска.
Чи потрібно привозити весь NAS, чи тільки диски? В ідеалі привезіть весь NAS. Для нас важливо знати модель і версію системи. Якщо везете лише диски, критично важливо мати точно позначений їхній порядок (слот 1, 2, 3…). Без цього реконструкція надзвичайно ускладнюється.
Чи допоможе RAID, якщо я щось випадково видалив? Ні. RAID захищає від апаратного збою, але це не резервна копія. Він не захистить вас від видалення файлів, помилки користувача або програми-вимагача. Навіть для NAS і серверів діє правило резервного копіювання 3-2-1.
Офіційні інструкції виробників vs. відновлення даних
Synology та QNAP мають офіційні процедури для ремонту degraded-масиву. Вони мають сенс, якщо зрозуміло, що вийшов з ладу саме один диск, решта дисків здорові, і у вас є актуальна резервна копія. Якщо ви в цьому не впевнені, безпечніше зупинитися і спочатку зробити копії. Для орієнтації: Synology описує repair storage pool, QNAP описує відновлення RAID group у стані degraded. Ці інструкції не є тим самим, що відновлення даних після незрозумілої аварії.
Якщо ваш NAS або сервер повідомляє про помилку, зберігайте спокій і головне — нічого не пробуйте наосліп. Зателефонуйте нам раніше, ніж запустите rebuild. Правильно описаний порядок дисків і хронологія подій — це половина успіху. Про решту ми подбаємо в рамках відновлення даних у Брно. А коли ваші дані будуть у безпеці, подивіться на наші поради щодо правильного резервного копіювання, тому що RAID сам по собі справді не є резервною копією.