Krisis: AI mematikan semua layanan dan memblokir akses saat insiden
Agen memantau metrik kritis (kehilangan data, pelanggaran keamanan, DDoS, anomali finansial) dan saat melewati ambang, otomatis mematikan semua layanan (shutdown teratur), memblokir akses (isolasi jaringan), serta memberi tahu tim on-call dengan rencana aksi. Opsional: rollback ke versi stabil terakhir. $19/bulan.
Terkesan familiar?
Apa yang memakan waktu Anda
Insiden kritis berkembang cepat: pelanggaran keamanan atau korupsi data bisa terjadi dalam menit, dan tim tidak selalu menyadarinya tepat waktu
Kerusakan tumbuh saat berpikir: jika uang keluar tanpa kendali, kerugian tumbuh eksponensial
Tidak ada saklar cepat: mematikan semuanya (layanan, database, API) butuh satu menit, tapi kadang hanya ada margin 10 detik
Konsekuensi tidak terduga: Anda mematikan database, tapi aplikasi masih gagal 10 menit lagi — butuh shutdown terkoordinasi
Apa yang bisa dilakukan agen AI Anda
Bekerja dengan alat Anda
Mulai dalam beberapa langkah
Konfigurasi pemantauan dan pemicu
Tim infrastruktur menentukan metrik apa dan ambang berapa yang memicu shutdown darurat. Contoh: percobaan akses gagal > 1000/menit, tingkat error database > 50%, lonjakan volume transaksi finansial > 2σ. Bisa ada beberapa kondisi (cukup satu terpenuhi).
Pemantauan real-time
Agen mengumpulkan metrik terus-menerus dari Prometheus/Datadog dan membandingkannya dengan ambang. Jika kondisi terpenuhi, memulai shutdown berjenjang, bukan langsung: memberi 10–30 detik untuk pembatalan manual jika operator mendeteksi false positive.
Aktivasi dan konfirmasi
Agen mendeteksi ambang tercapai dan memposting di Slack: «ALERTA KRITIS: [alasan]. Memulai shutdown darurat dalam 30 detik. Kirim /cancel jika alarm palsu». Memberi jendela untuk membatalkan.
Shutdown teratur
Jika 30 detik berlalu tanpa pembatalan, agen memulai shutdown: SIGTERM ke semua kontainer, menunggu penutupan benar (hingga 30 detik), lalu SIGKILL. Menonaktifkan load balancer (tidak ada trafik baru). Memblokir jaringan jika perlu.
Respons insiden dan pemulihan
Agen memberi tahu tim on-call dengan konteks lengkap (apa terjadi, mengapa terpicu, status saat ini). Opsional bisa memulai pemulihan (rollback kode, restart infrastruktur). Tapi biasanya butuh investigasi manual sebelum memulihkan sistem.
Pertanyaan umum
Ya, tentu. Tim on-call bisa kapan saja mengirim /killswitch di Slack atau menekan tombol di panel: shutdown dimulai segera. Tidak perlu menunggu aktivasi otomatis jika Anda melihat sesuatu yang sangat serius.
Ingin OpenClaw tanpa DevOps?
OpenKlo adalah hosting terkelola untuk OpenClaw asli. Agen yang sama, siap dalam 3 menit.
Batalkan kapan saja · Model terbaik termasuk · Ganti paket kapan saja