Hızlı Özet (TL;DR)
Sistem yöneticileri için en büyük kabus, bir sunucunun diski dolduğunda, CPU’su kilitlendiğinde veya veritabanı servisi çöktüğünde bunu kullanıcılardan veya fabrika müdüründen telefonla öğrenmektir. Proaktif IT yönetiminin temeli, sunucu ve ağ altyapısının Zabbix, Prometheus ve Grafana gibi kurumsal açık kaynaklı izleme araçlarıyla 7/24 takip edilmesi, eşik değerler aşıldığında henüz bir kesinti yaşanmadan sistem yöneticisine otomatik bildirim gönderilmesidir.
Zabbix ve Prometheus/Grafana Karşılaştırması
| Kriter | Zabbix | Prometheus + Grafana |
|---|---|---|
| Odak Alanı | Geleneksel sunucu donanımı, ağ anahtarları, SNMP | Konteynerler (Docker/K8s), mikroservisler ve metrikler |
| Ajan Yapısı | Zabbix Agent (Hafif C istemcisi) ve SNMP desteği | Exporter modelleri (Node-exporter vb.) |
| Görselleştirme | Dahili kontrol panelleri (Temel düzey) | Grafana ile modern, interaktif ve estetik paneller |
| Alarm Mekanizması | Dahili esnek tetikleyiciler (SMS, Telegram, Mail) | Alertmanager üzerinden bildirim yönlendirme |
Takip Edilmesi Zorunlu 5 Kritik Metrik
- Disk Doluluk Oranı: Disk boş alanı %15’in altına düştüğünde uyarı, %5’in altına düştüğünde acil alarm verilmelidir.
- RAM ve Takas (Swap) Kullanımı: Bellek sızıntıları erken tespit edilerek sunucunun Out-of-Memory (OOM) nedeniyle kilitlenmesi önlenmelidir.
- CPU Yükü ve Sıcaklık Değerleri: Fan arızaları veya döngüye giren hatalı süreçler anında yakalanmalıdır.
- Kritik Servis Durumları: MSSQL, PostgreSQL, Nginx, Docker servislerinin çalışır durumda olduğu saniyelik kontrollerle izlenmelidir.
- Yedekleme Görev Çıktıları: Gece çalışan yedekleme betiklerinin başarıyla sonlanıp sonlanmadığı otomatik teyit edilmelidir.
Sunucu altyapınızı kesintisiz izlemek için Sunucu ve Yedekleme sayfamızdan destek alabilirsiniz.