AĄBCĆDEĘFGHIJKLŁMNŃOÓPQRSŚTUVWXYZŹŻ
Monitoring

Uptime i SLA

Opublikowano: · Aktualizacja:

Uptime (dostępność) to procent czasu, w którym usługa działa i odpowiada poprawnie. SLA (Service Level Agreement) to umowa, w której dostawca gwarantuje określony poziom dostępności i zobowiązuje się do rekompensat (np. kredytów), gdy go nie dotrzyma.

W praktyce inżynierskiej, spopularyzowanej przez Google SRE, rozróżnia się trzy pojęcia: SLI (wskaźnik, np. odsetek udanych żądań), SLO (wewnętrzny cel dla wskaźnika) i SLA (zewnętrzna umowa z konsekwencjami). SLO powinno być ostrzejsze niż SLA, a różnica między 100% a SLO tworzy budżet błędów (error budget).

Ile znaczą „dziewiątki”

  • 99% (dwie dziewiątki) — do ~3,65 dnia niedostępności rocznie.
  • 99,9% (trzy dziewiątki) — do ~8,77 godziny rocznie.
  • 99,95% — do ~4,38 godziny rocznie.
  • 99,99% (cztery dziewiątki) — do ~52,6 minuty rocznie.

Jak mierzyć uczciwie

Dostępność mierzona pingiem z jednej lokalizacji zawyża wynik: usługa może odpowiadać, ale błędami lub tylko w części regionów. Rzetelny pomiar opiera się na sondach z wielu lokalizacji, weryfikacji treści odpowiedzi (nie tylko kodu 200) i uzupełnieniu monitoringu syntetycznego danymi od realnych użytkowników.

Przykład

SLA 99,9% daje budżet ~8,77 h przestoju rocznie. Po 4 h awarii w Q1 zostaje ~4,77 h na resztę roku — to error budget w praktyce.

Budżet błędów dla SLA 99,9%
Przykład
Roczny budżet przestoju:     ~8 h 46 min (99,9%)
Przestój w Q1:               4 h 00 min
Pozostały budżet (Q2–Q4):    ~4 h 46 min

Źródła i dalsza lektura

Sprawdź jakość swojej strony w Insight

Zobacz publiczne sygnały, priorytety i źródła danych w jednym raporcie.

Bez karty kredytowej Raport z datą i źródłami Bez zakładania konta