SLA Standartları

Denomas SLA standartları — Basic, Standard, Premium ve Enterprise katmanları, yanıt süreleri, uptime garantileri

SLA Standartları

Bu sayfa, Denomas destek hizmetlerinin SLA (Service Level Agreement) standartlarını tanımlar. Tüm destek paketleri net taahhütler ve ölçülebilir metriklerle desteklenir. ISO 20000 Madde 7.2 (Servis seviyesi yönetimi) ve 6.1 (Servis raporlama gereksinimleri) ile uyumludur.

Servis Tanımları

ServisTanımSLA Metni
API GatewayTüm dış ve iç isteklerin yönlendirildiği, kimlik doğrulama ve throttling yapılan gateway%99.9 uptime ve ≤ 200 ms yanıt süresi
Video Render EngineEdge-Node üzerinde gerçekleşen görsel-ses-kurgu üretim süreci%99.9 uptime ve ortalama ≤ 5 ms gecikme
VR/AR Tam Yetkili Yönetici Modu UITek yönetici tarafından kullanılan 3-D kontrol ortamı%99.9 uptime, ≥ 90 Hz FPS ve ≤ 10 ms haptik gecikme
Message Bus (NATS)Olay-tabanlı veri akışı, asenkron görev dağıtımı%99.9 uptime, pending mesaj ≤ 10k
Veri SaklamaPostgreSQL (metadata) ve S3 (video assetleri)%99.9 uptime, günlük yedekleme %100 başarı
Monitoring & AlertingSistem izleme, alarm yönetimi, raporlama%99.9 uptime, alarm gecikmesi ≤ 30 sn

SLA Hedef Metrikleri

KPIHedefÖlçüm PeriyoduAraçCeza
Uptime (Availability)%99.94 haftalık ortalamaPrometheus up metric%5 fatura indirimi
API Yanıt Süresi≤ 200 ms (%95 istek)5 dakikaPrometheus http_request_duration_seconds%3 fatura indirimi
Edge-Render Gecikmesi≤ 5 ms (ort.)5 dakikaPrometheus edge_render_latency%2 fatura indirimi
GPU Kullanım≤ %80 (ortalama)5 dakikaDCGM exporter gpu_utilization%2 fatura indirimi
Message-Bus Pending≤ 10k mesaj5 dakikaNATS exporter nats_msg_pending%3 fatura indirimi
Error Rate (5xx)< %0.55 dakikaPrometheus http_requests_total{status=~"5.."}%5 fatura indirimi
Backup Başarı%100 (günlük)GünlükCloudWatch backup_success%1 fatura indirimi
Security Scan0 kritik CVERelease öncesiTrivy, Snyk%5 fatura indirimi
VR/AR FPS≥ 90 Hz (ortalama)5 dakikaWebXR telemetry fps%2 fatura indirimi

SLA Katmanları

Basic (Community)

MetrikDeğer
Destek KanalıForum + dokümantasyon
ErişilebilirlikBest-effort
Uptime Garantisi
Yanıt Süresi P1Best-effort
Yanıt Süresi P2Best-effort
Yanıt Süresi P3Best-effort

Standard

MetrikDeğer
Destek KanalıE-posta
Erişilebilirlik8x5 (iş günleri)
Uptime Garantisi%99.5
Yanıt Süresi P14 saat
Yanıt Süresi P28 saat
Yanıt Süresi P32 iş günü

Premium

MetrikDeğer
Destek KanalıTelefon + e-posta
Erişilebilirlik7/24
Uptime Garantisi%99.9
Yanıt Süresi P11 saat
Yanıt Süresi P24 saat
Yanıt Süresi P31 iş günü

Enterprise

MetrikDeğer
Destek KanalıÖzel TAM + 7/24
Erişilebilirlik7/24 + özel kanal
Uptime Garantisi%99.95
Yanıt Süresi P115 dakika
Yanıt Süresi P21 saat
Yanıt Süresi P34 saat

Öncelik Seviyeleri

SeviyeTanımÖrnek
P1 — KritikÜretim ortamı tamamen durmuşSistem çöktü, veri kaybı riski
P2 — YüksekÜretim ortamı ciddi etkilenmişAna özellik çalışmıyor, geçici çözüm var
P3 — Normalİş etkisi sınırlıMinor hata, geliştirme talebi
P4 — DüşükBilgi talebiDokümantasyon, nasıl yapılır sorusu

Olay Yönetimi ve SLA İhlali

Olay TürüTespitYanıt SüresiÇözüm Süresi (MTTR)Sorumlu
Critical (Uptime < %99.9)Alertmanager → Nextcloud Talk webhook5 dakika30 dakikaOps-Lead / SRE
Warning (Latency > 200 ms)Prometheus alert30 dakika2 saatSRE
Security BreachFalco / OPA5 dakika1 saatSecurity Engineer
Backup FailureCloudWatch alarm15 dakika1 saatDBA
VR/AR FPS DüşüşüWebXR telemetry30 dakika2 saatUI-Team

Uptime Hesaplama

Uptime garantisi aşağıdaki formüle göre hesaplanır:

Uptime (%) = ((Toplam Dakika - Plansız Kesinti Dakikası) / Toplam Dakika) x 100
GarantiAylık İzin Verilen Kesinti
%99.5~3 saat 39 dakika
%99.9~43 dakika
%99.95~21 dakika

Ceza (Penalty) Mekanizması

İhlal Seviyesiİndirim OranıUygulama Şekli
Minor (Uptime = %99.9-%99.95)%2Bir sonraki fatura %2 indirim
Major (Uptime < %99.9)%5İki sonraki fatura %5 indirim
Critical (Uptime < %99.5)%10Üçüncü fatura %10 indirim + ek destek saatleri

SLA İhlali Prosedürü

SLA taahhütlerinin karşılanamaması durumunda:

  1. Tespit — Alertmanager → Nextcloud Talk webhook
  2. Bildirim — 24 saat içinde müşteriye resmi e-posta
  3. Kök Neden Analizi — SRE Lead, 48 saat içinde rapor
  4. Düzeltme Planı — Aksiyon maddeleri, sorumlu kişi, zaman çizelgesi
  5. Ceza Uygulama — Fatura indirimi, ek destek saatleri
  6. Kapatış — GitLab Issues sla-incident ticket'i "Closed" durumu

Eskalasyon Matrisi

EskalasyonKoşulHedef
Seviye 1İlk temasDestek mühendisi
Seviye 2SLA süresi aşıldı veya teknik karmaşıklıkKıdemli mühendis
Seviye 3Çözüm bulunamadı veya ürün hatasıMühendislik ekibi
YönetimMüşteri memnuniyetsizliğiDestek müdürü

Ölçüm ve Raporlama

ÖlçümAraçSıklıkRapor FormatıDağıtım
Uptime & LatencyPrometheus + GrafanaGünlükPDF + Grafana snapshotEmail → Operasyon Yöneticisi
Error-Rate & Alert CountAlertmanagerSaatlikCSVNextcloud Talk #ops-alerts
GPU & Render MetricsDCGM + Prometheus5 dakikaJSONGitLab Wiki "Performance Dashboard"
Backup & DRCloudWatchGünlükPDFEmail → Security & Compliance
Security ScanTrivy / SnykRelease öncesiHTMLGitLab Issues security-report ticket

SLA İzleme Süreci

  1. Metric Scrape — Prometheus her 15 saniyede veri çeker
  2. SLA Calculationsla-calc (Python) scripti, 4 haftalık ortalama hesaplar
  3. Threshold Evaluationalertmanager kuralları, SLA-violation tespit eder
  4. Report Generationsla-report (Jinja2) PDF oluşturur, GitLab Wiki'ye yükler
  5. Stakeholder Notification — Alertmanager → Nextcloud Talk → Email

SLA Revizyon ve Güncelleme

PeriyotAktiviteSorumlu
Çeyrek-dönemKPI gözden geçirme, hedef güncellemeSRE Lead
YıllıkSLA dokümantasyonu revizyonu, yeni hizmet eklemeleriLegal + Product Owner
AcilYeni özellik (Major Release) sonrası SLA eklemesiRelease Manager

İlgili Sayfalar