SMART Nedir?
SMART (Self-Monitoring, Analysis and Reporting Technology), hard disk ve SSD'lerin kendi sağlık durumunu sürekli olarak izleyip raporlamasını sağlayan standarttır. 1990'lı yıllardan bu yana neredeyse tüm depolama birimlerinde yerleşik olarak bulunur.
SMART, diskin yaklaşan arızasını önceden tespit ederek veri kaybından önce müdahale imkânı tanır. Arızaların büyük çoğunluğu önce SMART uyarısıyla kendini gösterir.
Kritik SMART Parametreleri
Her SMART parametresinin bir değeri (raw value) ve eşiği (threshold) vardır. Değer eşiğin altına düştüğünde uyarı üretilir.
| Parametre | ID | Anlamı | Kritiklik |
|---|---|---|---|
| Reallocated Sectors Count | 5 | Yeniden konumlandırılan bozuk sektörler | Çok Yüksek |
| Uncorrectable Sector Count | 187 | Düzeltilemez okuma hatası | Çok Yüksek |
| Current Pending Sectors | 197 | Okuma hatası nedeniyle bekleyen sektörler | Yüksek |
| Spin Retry Count | 10 | Döndürme yeniden deneme sayısı (HDD) | Orta |
| Reallocated Event Count | 196 | Toplam yeniden konumlandırma olayı | Yüksek |
| Temperature | 194 | Disk sıcaklığı | Orta |
| Power-On Hours | 9 | Toplam çalışma saati | Bilgi |
Sıfır'dan büyük herhangi bir "Reallocated Sectors Count" veya "Uncorrectable Sector Count" değeri, diskin yakında değiştirilmesi gerektiğinin güçlü işaretidir.
HDD ve SSD Farkı
HDD (Mekanik Disk): Fiziksel plaka ve okuma kafasına dayalı mekanik arıza belirtileri ön plandadır.
- Kötü sektör artışı
- Tıkırdama veya vızıltı sesi
- Yavaşlayan erişim süreleri
SSD (Katı Hal Diski): Yazma döngüsü tükenmesi ve hücre bozulması.
- Wear Leveling Count ve Media Wearout Indicator kritik parametreler
- SSD'ler sessizce ve ani olarak bozulabilir — SMART takibi daha da önemli
SMART İzleme Araçları
Windows
- CrystalDiskInfo — Ücretsiz, kullanımı kolay, görsel uyarı
- HWiNFO — Detaylı sistem izleme, SMART dahil
- Windows Event Viewer — Disk hatalarını loglar
Linux
- smartmontools (smartctl) — Komut satırı, otomasyon için ideal
# Disk SMART durumu
smartctl -a /dev/sda
# Kısa test
smartctl -t short /dev/sda
# Test sonucu
smartctl -l selftest /dev/sda
Kurumsal İzleme
PRTG, Zabbix, Nagios gibi ağ izleme platformları SMART verilerini toplayarak merkezi alarm oluşturabilir.
Proaktif Disk Yönetimi
Düzenli SMART taraması: Sunucularda haftalık otomatik SMART testi yapılandırılmalıdır.
Sıcaklık takibi: Diskler için ideal çalışma sıcaklığı 0–60°C arasıdır. Sunucu odası soğutması yeterliyse sıcaklık genellikle sorun olmaz; yüksek sıcaklık disk ömrünü kısaltır.
RAID üyelerini izle: RAID dizisindeki her diskin SMART durumu ayrı ayrı takip edilmelidir. RAID 5'te bir disk arızalanınca ikinci disk üzerindeki yük artar ve SMART değerleri bozulabilir.
Disk yaşını takip et: Kurumsal HDD'lerde 5 yıl sonra, SSD'lerde yazma yoğunluğuna göre erken değişim planlaması yapılmalıdır.
Sonuç
SMART takibi, sunucu bakımında en yüksek ROI sağlayan uygulamalardan biridir. Birkaç dakikalık periyodik kontrol, beklenmedik disk arızasından kaynaklanacak veri kaybını ve acil müdahale maliyetini önleyebilir. NRC Sistem olarak sunucu sağlık izleme, periyodik bakım ve proaktif donanım yönetimi hizmetleri sunuyoruz.