Ana Sayfa  /  Blog  /  Donanım

RAID bozuldu: rebuild başlatmadan önce okuyun

En sık yaşanan kayıp, arızanın kendisinden değil, aceleci rebuild'den geliyor.

RAID'in amacı disk arızasına dayanmaktır. Bir disk düşer, dizi çalışmaya devam eder, diski değiştirirsiniz. Teoride böyledir. Pratikte en büyük veri kayıpları tam bu anda yaşanır.

Neden rebuild riskli?

Rebuild sırasında dizideki bütün diskler baştan sona okunur. Bu, disklerin görebileceği en ağır yüktür.

Diziniz muhtemelen aynı anda alınmış, aynı yaşta, aynı koşullarda çalışmış disklerden oluşuyor. Biri yorulduysa diğerleri de yorulmuştur. Rebuild'in ağır yükü altında ikinci bir disk düşerse — RAID 5'te dizi tamamen gider.

Büyük kapasiteli disklerde rebuild günlerce sürebilir. Bu, riskin açık kaldığı süredir.

Rebuild başlatmadan önce

  • Durumu okuyun. Kaç disk düştü? Dizi "degraded" mi yoksa "failed" mi? Failed ise rebuild zaten çözüm değildir.
  • Yedeğiniz güncel mi? Rebuild'e girmeden önce cevabını bilin. Değilse önce yedek alın.
  • Diğer disklerin sağlığına bakın. SMART değerlerinde uyarı veren başka disk var mı?
  • Mümkünse önce imaj alın. Kritik veri varsa, rebuild'den önce disklerin birebir kopyasını almak en güvenli yoldur.
  • Doğru diski çıkardığınızdan emin olun. Yanlış diski çıkarmak, çalışan diziyi anında bitirir.

Kesinlikle yapmayın

  • Dizinin kurgusunu sıfırlayıp yeniden oluşturmayın. "Initialize", "create new array" gibi seçenekler meta verileri siler; veri hâlâ diskte olsa bile hangi parçanın nereye ait olduğu bilgisi gider.
  • Diskleri karıştırmayın. Sıra önemlidir. Çıkarmadan önce hangi disk hangi yuvada, not edin.
  • Rastgele disk değiştirip denemeyin. Her deneme durumu karmaşıklaştırır.
  • Denetleyiciyi değiştirip devam etmeyin. Farklı denetleyici, meta veriyi farklı yazabilir.

Dizi zaten gittiyse

Veri kurtarılamaz demek değildir. Diskler fiziksel olarak sağlamsa, dizinin nasıl kurgulandığı çözümlenip veri çıkarılabilir — şerit boyutu, disk sırası, eşlik düzeni gibi parametreler yeniden bulunur.

Ama bu, disklere daha fazla yazılmadıysa mümkündür. Her ek deneme şansı azaltır. Bu noktada en doğru hareket durmak ve durumu anlatmaktır.

RAID yedek değildir

Sık tekrarlanan ama sık unutulan cümle. RAID disk arızasına karşı korur. Şunlara karşı korumaz:

  • Yanlışlıkla silme
  • Fidye yazılımı — şifreleme bütün disklere birden yazılır
  • Dosya bozulması
  • Denetleyici arızası
  • Yangın, su, hırsızlık

RAID çalışma süresini korur, veriyi değil. Veriyi yedek korur.

RAID seviyeleri ve dayanıklılık

Hangi seviyede olduğunuzu bilmek, ne kadar riskte olduğunuzu söyler.

  • RAID 0 — dayanıklılık yok. Tek disk giderse her şey gider. Hız için kullanılır, veri için asla
  • RAID 1 — ayna. Bir disk gidebilir
  • RAID 5 — bir disk gidebilir. İkinci disk giderse dizi çöker
  • RAID 6 — iki disk gidebilir. Büyük disklerde RAID 5'e tercih edilir
  • RAID 10 — ayna çiftlerinin birleşimi. Hem hız hem dayanıklılık, kapasite maliyeti yüksek

Büyük kapasiteli disklerde RAID 5 riskli hale geldi. Sebebi bir sonraki bölümde.

Neden yeniden yapılandırma sırasında ikinci disk gidiyor?

Bu, sahada en çok karşılaşılan senaryolardan biri ve mantığı şu:

Bir disk arızalanır, yenisi takılır ve dizi yeniden yapılandırılmaya başlar. Bu işlem sırasında kalan tüm diskler baştan sona okunur — normalden çok daha ağır bir yük.

Diskler genellikle aynı partiden, aynı tarihte alınmış ve aynı süre çalışmıştır. Yani biri yorulmuşsa diğerleri de yorulmuştur.

Yeniden yapılandırma saatler, büyük disklerde günler sürer. Bu ağır yük altında ikinci bir diskin de pes etme ihtimali ciddi düzeydedir.

Bu yüzden: yedeğiniz yoksa ve dizi hâlâ okunabiliyorsa, önce veriyi kopyalayın, sonra yeniden yapılandırmayı başlatın.

Uyarıları kurmak — asıl önlem bu

İki disk aynı anda bozulmaz. Olan şudur: biri aylar önce arızalanmıştır, kimse fark etmemiştir.

Cihaz çalışmaya devam ettiği için sorun görünmez. Sonra ikinci disk de gider ve dizi çöker.

  • RAID denetleyicisinin ya da NAS'ın e-posta uyarısını kurun
  • Uyarının gerçekten geldiğini test edin — bir diski simüle olarak arızalı işaretleyip deneyin
  • Uyarı tek kişiye değil, bir gruba gitsin
  • Disk sağlık durumunu aylık kontrol listenize ekleyin

Bu ayar çoğu kurulumda hiç açılmaz. Beş dakikalık iştir ve dizinin çökmesini önler.

Yedek disk (hot spare) bulundurun

Dizide boş yer varsa bir diski yedek olarak tanımlayın. Bir disk arızalandığında sistem beklemeden yeniden yapılandırmaya başlar.

Yoksa en azından rafta aynı model bir disk bulundurun. Arıza anında tedarik beklemek, dizinin savunmasız kaldığı süreyi uzatır.

Aynı modeli bulmak zamanla zorlaşır. Sistemi kurarken bir yedek disk almak, iki yıl sonra uyumlu disk aramaktan kolaydır.

Kurtarma süreci nasıl işliyor?

Dizi çöktüyse ve yedeğiniz yoksa süreç şöyle ilerler:

  1. Her diskin ayrı ayrı sağlık durumu değerlendirilir
  2. Fiziksel sorunu olanlar önce stabil hale getirilir
  3. Disklerin birebir kopyaları alınır — çalışma orijinaller üzerinde yapılmaz
  4. RAID parametreleri (düzen, blok boyutu, disk sırası) kopyalardan çözümlenir
  5. Dizi sanal olarak kurulur, dosya sistemi okunur
  6. Veriler ayrı bir ortama çıkarılır

Orijinal disklere yazmamak bu işin temel kuralıdır. Bir deneme başarısız olursa kopyadan tekrar başlanır — orijinaller bozulmadan durur.

Daha önce yeniden yapılandırma denenmiş bir dizide iş belirgin şekilde zorlaşır.

Bu konuda yardıma mı ihtiyacınız var?

Veri kurtarma hizmeti hakkında bilgi alın ya da doğrudan ücretsiz keşif talep edin.

Veri kurtarma hizmeti
Blog

Diğer yazılar

Donanım

UPS seçimi: kaç VA yeterli, nasıl hesaplanır?

Kutunun üstündeki VA rakamı, cihazınızın kaç dakika çalışacağını söylemez.

Donanım

Küçük işletme için NAS mı yeter, sunucu mu gerekir?

"Dosya paylaşacağız" diyorsanız cevap farklı, "program çalıştıracağız" diyorsanız farklı.

Güvenlik

5651 loglama kimler için zorunlu, nasıl yapılır?

Kafeye, otele, iş yerine misafir Wi-Fi'si koyduysanız bu yazı sizi ilgilendiriyor.