Altyapı İzleme Standartları

Denomas altyapı izleme standartları — izlenmesi gereken metrikler, eşik değerleri, alarm politikaları

Altyapı İzleme Standartları

Tüm Denomas altyapı bileşenlerinde aşağıdaki izleme standartları uygulanır.

Zorunlu Metrikler

Sunucu Metrikleri

MetrikEşik (Uyarı)Eşik (Kritik)Kontrol Sıklığı
CPU kullanımı> %80> %9530 saniye
Memory kullanımı> %80> %9530 saniye
Disk kullanımı> %80> %905 dakika
Disk I/O wait> %20> %4030 saniye
Network throughputBaseline + %50Baseline + %10030 saniye
Uptime-Restart tespit30 saniye

Servis Metrikleri

MetrikEşik (Uyarı)Eşik (Kritik)
HTTP 5xx oranı> %1> %5
Yanıt süresi (p95)> 1s> 5s
Kuyruk derinliği> 1000> 5000
Bağlantı havuzu> %80> %95

Veritabanı Metrikleri

MetrikEşik (Uyarı)Eşik (Kritik)
Sorgu süresi (p95)> 500ms> 2s
Bağlantı sayısı> %80 max> %95 max
Replikasyon gecikmesi> 5s> 30s
Deadlock sayısı> 0> 5/dakika

Alarm Politikası

  1. Flapping önleme — En az 3 ardışık kontrol başarısız olmalı
  2. Eskalasyon — P1 15 dk içinde yanıtlanmazsa yöneticiye eskalasyon
  3. Susturma — Planlanan bakım penceresinde alarmlar susturulur
  4. Korelasyon — İlişkili alarmlar gruplama ile tek bildirim

İzleme Araçları

KatmanAraç
AltyapıDenomas Denetim Otomasyon (Zabbix)
UygulamaPrometheus + Grafana
LogLoki
APMOpenTelemetry + Jaeger

İlgili Sayfalar