Daftar Isi
- Mengapa notifikasi push gagal untuk layanan kritis
- Cara kerja peringatan panggilan telepon dengan Echobell
- Menyiapkan peringatan panggilan dari alat pemantauan Anda
- Memakai health check yang sudah ada
- Apa yang perlu disertakan dalam peringatan
- Memilih tingkat urgensi yang tepat
- Meningkatkan skala ke banyak layanan
- Manfaat sesungguhnya
- Terkait
API Anda mati pukul 3 pagi bukanlah masalahnya. Masalahnya adalah baru mengetahuinya pukul 9 pagi ketika pengguna Anda sudah membanjiri kotak masuk dukungan.
Kebanyakan alat pemantauan hebat dalam mendeteksi kegagalan. Mereka payah dalam memastikan seseorang benar-benar melihat peringatannya pada waktu yang tepat. Notifikasi push standar hanya tergeletak di layar terkunci sampai kebetulan ada yang mengangkat ponselnya. Pesan Slack terkubur di kanal yang tak seorang pun mengawasinya saat malam. Email tak terbaca sampai Senin pagi.
Peringatan panggilan telepon mengubah persamaan itu. Saat health check API Anda gagal, ponsel Anda benar-benar berdering — persis seperti panggilan telepon berdering untuk urusan mendesak lainnya. Anda mengangkat, mendengar apa yang salah, dan bisa langsung mulai memperbaikinya alih-alih beberapa jam kemudian.
Mengapa notifikasi push gagal untuk layanan kritis
Rata-rata ponsel pintar menerima 50 sampai 100 notifikasi push per hari. Peringatan kegagalan API Anda bersaing dengan pembaruan aplikasi, notifikasi media sosial, peringatan berita, dan setiap aplikasi lain di perangkat itu. Ketika semuanya mendesak, tidak ada yang terasa mendesak.
Ini menciptakan pola yang berbahaya:
- Alat pemantauan Anda mendeteksi API mengembalikan error 500
- Ia mengirim notifikasi push ke ponsel Anda
- Ponsel Anda ada di atas meja, tengkurap, dengan Mode Fokus aktif
- Peringatannya tergeletak diam sampai ada yang menyadarinya — berjam-jam kemudian
Untuk microservice yang tidak kritis, penundaan itu sekadar menjengkelkan. Untuk API pembayaran, layanan autentikasi, atau backend produk utama Anda, penundaan itu merenggut uang dan kepercayaan yang nyata.
Cara kerja peringatan panggilan telepon dengan Echobell
Echobell mengirimkan notifikasi dalam tiga tingkat urgensi:
- Standar (Active): Notifikasi push biasa
- Peka waktu: Menembus Mode Fokus iOS tetapi tidak berdering
- Panggilan: Membuat ponsel Anda berdering seperti panggilan telepon biasa
Untuk kegagalan API yang berdampak pada pengguna, tingkat panggilan adalah pilihan yang tepat. Ia mencerminkan cara Anda menangani panggilan telepon mendesak lainnya — Anda mengangkatnya karena teleponnya berdering.
Penyiapannya lugas:
- Buat sebuah saluran di Echobell
- Setel jenis notifikasinya ke Panggilan
- Hubungkan alat pemantauan Anda lewat webhook
- Saat health check gagal, Echobell menelepon ponsel Anda
Menyiapkan peringatan panggilan dari alat pemantauan Anda
Sebagian besar platform pemantauan bisa mengirim webhook saat sebuah pemeriksaan gagal. Berikut cara menghubungkannya.
Memakai health check yang sudah ada
Kalau Anda sudah punya endpoint kesehatan (seperti /health atau /status), konfigurasikan monitor Anda untuk memeriksanya secara berkala. Ketika responsnya bukan 200, picu webhook-nya.
Echobell menerima payload webhook dengan judul dan isi:
curl -X POST https://hook.echobell.one/t/<channel-token> \
-H "Content-Type: application/json" \
-d '{
"title": "API DOWN: payment-service",
"body": "Health check failed - 500 error at 03:42 UTC",
"notificationType": "calling",
"externalLink": "https://your-dashboard.example.com/incidents/123"
}'
Kolom notificationType: calling itulah yang membuat ponsel berdering.
Apa yang perlu disertakan dalam peringatan
Jaga isi peringatan tetap mudah dipindai sekilas. Saat mengangkat panggilan pukul 3 pagi, Anda perlu memahami masalahnya seketika:
- Nama layanan — API atau microservice mana yang gagal
- Jenis error — timeout, 5xx, koneksi ditolak
- Stempel waktu — kapan kegagalannya mulai
- Tautan — ke mana harus langsung menyelidiki
Ini bukan tempat untuk pesan bertele-tele. Tujuannya adalah konteks instan supaya Anda bisa memutuskan apakah perlu benar-benar bangun atau cukup mengakuinya lalu tidur lagi.
Memilih tingkat urgensi yang tepat
Tidak setiap kegagalan API butuh panggilan telepon. Pakai peringatan panggilan untuk:
- Layanan pembayaran dan penagihan
- Endpoint autentikasi dan login
- API produk utama yang langsung dipakai pengguna
- Layanan yang menjadi tumpuan sistem kritis lainnya
Pakai notifikasi peka waktu untuk:
- Layanan sekunder yang penting tetapi tidak menentukan pendapatan
- Lingkungan pengembangan atau staging
- Tanda peringatan awal (tingkat error tinggi yang belum menjadi kegagalan penuh)
Pakai notifikasi standar untuk:
- Job latar belakang yang tidak kritis
- Metrik informatif yang tidak butuh tindakan
Pendekatan berjenjang ini membuat Anda tetap mendapat peringatan tanpa menimbulkan kelelahan peringatan.
Meningkatkan skala ke banyak layanan
Kalau Anda menjalankan lebih dari satu API, buat saluran terpisah untuk setiap layanan atau kelompok layanan:
production-payment-api— tingkat panggilanproduction-user-api— tingkat panggilanproduction-analytics-api— peka waktustaging-all— peka waktu
Ini memungkinkan Anda menyetel urgensi per layanan. API pembayaran Anda pantas mendapat panggilan telepon; pipeline analitik Anda kemungkinan besar tidak.
Manfaat sesungguhnya
Nilai dari peringatan panggilan telepon bukanlah deringnya itu sendiri, melainkan perubahan perilaku yang ditimbulkannya:
- Anda memperbaiki masalah lebih cepat karena mengetahuinya seketika
- Anda tidur lebih nyenyak karena tahu bahwa kalau ada yang rusak, Anda benar-benar akan dibangunkan
- Pengguna Anda mengalami downtime lebih singkat karena Anda merespons dalam hitungan menit, bukan jam
Untuk layanan kritis, perbedaan itulah seluruh intinya.