İzleme ve Gözlemlenebilirlik

Denomas izleme ve gözlemlenebilirlik stratejisi — Prometheus, Grafana, Sentry, Apdex metrikleri

İzleme ve Gözlemlenebilirlik

Denomas'ta her sistem gözlemlenebilir olmalıdır. Üç temel sinyal üzerinden izleme yaparız: metrikler, loglar ve tracing.

İzleme Yığını

KatmanAraçAmaç
MetriklerPrometheus + VictoriaMetricsZaman serisi metrik toplama
GörselleştirmeGrafanaDashboard ve alerting
LoglamaLokiMerkezi log toplama
TracingOpenTelemetry + JaegerDağıtık izleme
Hata İzlemeSentryUygulama hata yakalama
Altyapı İzlemeDenomas Denetim Otomasyon (Zabbix)IT/OT izleme

Apdex Skoru

Apdex (Application Performance Index), kullanıcı memnuniyetini ölçen standart bir metriktir.

Apdex = (Satisfied + Tolerating/2) / Total
KategoriEşikAçıklama
Satisfied< 500msKullanıcı memnun
Tolerating500ms - 2sKullanıcı sabır gösteriyor
Frustrated> 2sKullanıcı hayal kırıklığına uğruyor

Hedef Apdex: >= 0.9 tüm üretim servisleri için

Zorunlu Metrikler

Her servis şu metrikleri expose etmelidir:

  • http_requests_total — Toplam HTTP istek sayısı
  • http_request_duration_seconds — İstek süresi histogram
  • http_requests_in_flight — Anlık istek sayısı
  • app_errors_total — Uygulama hata sayısı
  • app_info — Versiyon ve build bilgisi

Alerting Stratejisi

SeviyeKanalYanıt SüresiÖrnek
P1 — KritikPagerDuty + Telefon15 dakikaServis tamamen çöktü
P2 — YüksekNextcloud Talk + E-posta1 saatApdex < 0.8
P3 — OrtaNextcloud Talk4 saatDisk %85 dolu
P4 — DüşükTicketSonraki iş günüMinör metrik anomalisi

Grafana Dashboard Standartları

Her ürün için standart dashboard seti:

  1. Overview — Genel sağlık durumu, Apdex, hata oranı
  2. Performance — Yanıt süreleri, throughput, kuyruk derinliği
  3. Resources — CPU, memory, disk, network
  4. Business — İş metrikleri (kullanıcı sayısı, işlem adedi)

İlgili Sayfalar