Zastosowanie DevOps

Gdy serwer padnie, zadzwoń na właściwy telefon

E-maile i zwykłe powiadomienia push zbyt łatwo przeoczyć podczas snu albo pracy w skupieniu. Echobell zamienia awarie serwera w połączenia telefoniczne na iPhonie, więc ktoś zauważy przestój natychmiast.

Główna idea

Zostaw swój dotychczasowy stack monitoringu. Zmień warstwę dostarczania. Grafana, Prometheus, UptimeRobot, Upptime i każda usługa potrafiąca wysłać webhooka mogą zasilać Echobell i eskalować tylko te incydenty, które zasługują na prawdziwy telefon.

Główna idea
Grafana

Rekomendowany stack

Większość zespołów nie potrzebuje nowego narzędzia do monitoringu. Potrzebuje krótszej drogi od wykrycia incydentu do uwagi człowieka.

Prometheus + Alertmanager

Kieruj alerty o wysokiej wadze do webhooka Echobell, a połączenia zarezerwuj dla incydentów wpływających na produkcję.

Grafana Alerting

Użyj punktu kontaktowego typu webhook, dołącz do payloadu kontekst usługi i metryki, a krytyczne polityki kieruj do kanału z włączonymi połączeniami.

UptimeRobot lub Upptime

Zamień proste powiadomienia e-mail lub webhook o niedostępnej stronie w pilne połączenia na iPhonie, gdy publiczny endpoint przestaje odpowiadać.

Jak skonfigurować alert telefoniczny o awarii serwera

Konfiguracja jest prosta: jeden kanał, jeden webhook i jedna reguła eskalacji.

  1. 1

    Utwórz dedykowany kanał incydentów

    Załóż osobny kanał na awarie produkcji, aby typ powiadomienia, szablon i subskrybenci byli dopasowani do pracy na dyżurze.

  2. 2

    Podłącz swoje narzędzie monitoringu

    Skieruj do kanału payload z narzędzi Grafana, Prometheus, UptimeRobot, Upptime lub ze zwykłego webhooka — z nazwą usługi, wagą incydentu i linkiem do zgłoszenia.

  3. 3

    Połączenia włączaj tylko przy właściwych warunkach

    Połącz dostarczanie przez telefon z warunkami opartymi na wadze incydentu, aby dzwoniły tylko prawdziwe awarie, a ostrzeżenia zostawały alertami standardowymi lub czasowo krytycznymi.

  4. Gotowe!

Dlaczego połączenie działa lepiej niż kolejny push

Przebijają się przez sen i tryb Skupienia

To ma znaczenie, gdy serwer pada o 3 w nocy albo w trakcie ważnej premiery.

Dają czytelniejszy sygnał na dyżurze

Gdy połączenia wywołują tylko incydenty najwyższej wagi, zespół od razu wie, że sprawa wymaga uwagi teraz, a nie później.

Zachowują Twoje obecne narzędzia

Nie musisz wymieniać narzędzi takich jak Grafana, Alertmanager czy monitory dostępności. Poprawiasz tylko ostatni odcinek dostarczania.

FAQ: alerty o awarii serwera

Najczęstsze pytania o kierowanie incydentów z monitoringu dostępności do alertów telefonicznych.

Tak. Echobell działa najlepiej, gdy do połączenia eskalują tylko awarie o najwyższej wadze, a ostrzeżenia i zdarzenia informacyjne zostają na niższych poziomach pilności.

Grafana, Prometheus Alertmanager, UptimeRobot, Upptime, Uptime Kuma, GitHub Actions i każdy system, który potrafi wysłać webhooka lub e-mail, mogą zasilać ten sam proces.

Tak. Udostępnij subskrypcję kanału zespołowi, aby kilka osób dostało kontekst incydentu bez budowania osobnej integracji dla każdej z nich.

Niech następna awaria będzie telefonem, a nie zagubionym pushem

Pobierz Echobell i przetestuj jeden produkcyjny scenariusz incydentu ze swoim obecnym narzędziem monitoringu.