Sunucu & Depolama

Hard Disk SMART Takibi ile Arıza Öngörüsü

4 dk okuma 27 Temmuz 2025

SMART Nedir?

SMART (Self-Monitoring, Analysis and Reporting Technology), hard disk ve SSD'lerin kendi sağlık durumunu sürekli olarak izleyip raporlamasını sağlayan standarttır. 1990'lı yıllardan bu yana neredeyse tüm depolama birimlerinde yerleşik olarak bulunur.

SMART, diskin yaklaşan arızasını önceden tespit ederek veri kaybından önce müdahale imkânı tanır. Arızaların büyük çoğunluğu önce SMART uyarısıyla kendini gösterir.

Kritik SMART Parametreleri

Her SMART parametresinin bir değeri (raw value) ve eşiği (threshold) vardır. Değer eşiğin altına düştüğünde uyarı üretilir.

ParametreIDAnlamıKritiklik
Reallocated Sectors Count5Yeniden konumlandırılan bozuk sektörlerÇok Yüksek
Uncorrectable Sector Count187Düzeltilemez okuma hatasıÇok Yüksek
Current Pending Sectors197Okuma hatası nedeniyle bekleyen sektörlerYüksek
Spin Retry Count10Döndürme yeniden deneme sayısı (HDD)Orta
Reallocated Event Count196Toplam yeniden konumlandırma olayıYüksek
Temperature194Disk sıcaklığıOrta
Power-On Hours9Toplam çalışma saatiBilgi

Sıfır'dan büyük herhangi bir "Reallocated Sectors Count" veya "Uncorrectable Sector Count" değeri, diskin yakında değiştirilmesi gerektiğinin güçlü işaretidir.

HDD ve SSD Farkı

HDD (Mekanik Disk): Fiziksel plaka ve okuma kafasına dayalı mekanik arıza belirtileri ön plandadır.

  • Kötü sektör artışı
  • Tıkırdama veya vızıltı sesi
  • Yavaşlayan erişim süreleri

SSD (Katı Hal Diski): Yazma döngüsü tükenmesi ve hücre bozulması.

  • Wear Leveling Count ve Media Wearout Indicator kritik parametreler
  • SSD'ler sessizce ve ani olarak bozulabilir — SMART takibi daha da önemli

SMART İzleme Araçları

Windows

  • CrystalDiskInfo — Ücretsiz, kullanımı kolay, görsel uyarı
  • HWiNFO — Detaylı sistem izleme, SMART dahil
  • Windows Event Viewer — Disk hatalarını loglar

Linux

  • smartmontools (smartctl) — Komut satırı, otomasyon için ideal
# Disk SMART durumu
smartctl -a /dev/sda

# Kısa test
smartctl -t short /dev/sda

# Test sonucu
smartctl -l selftest /dev/sda

Kurumsal İzleme

PRTG, Zabbix, Nagios gibi ağ izleme platformları SMART verilerini toplayarak merkezi alarm oluşturabilir.

Proaktif Disk Yönetimi

Düzenli SMART taraması: Sunucularda haftalık otomatik SMART testi yapılandırılmalıdır.

Sıcaklık takibi: Diskler için ideal çalışma sıcaklığı 0–60°C arasıdır. Sunucu odası soğutması yeterliyse sıcaklık genellikle sorun olmaz; yüksek sıcaklık disk ömrünü kısaltır.

RAID üyelerini izle: RAID dizisindeki her diskin SMART durumu ayrı ayrı takip edilmelidir. RAID 5'te bir disk arızalanınca ikinci disk üzerindeki yük artar ve SMART değerleri bozulabilir.

Disk yaşını takip et: Kurumsal HDD'lerde 5 yıl sonra, SSD'lerde yazma yoğunluğuna göre erken değişim planlaması yapılmalıdır.

Sonuç

SMART takibi, sunucu bakımında en yüksek ROI sağlayan uygulamalardan biridir. Birkaç dakikalık periyodik kontrol, beklenmedik disk arızasından kaynaklanacak veri kaybını ve acil müdahale maliyetini önleyebilir. NRC Sistem olarak sunucu sağlık izleme, periyodik bakım ve proaktif donanım yönetimi hizmetleri sunuyoruz.

Tüm yazılar