ปิดฉุกเฉินด้วย AI: หยุดทุกอย่างตอนวิกฤต

วิกฤต: AI ปิดบริการทั้งหมดและบล็อกการเข้าถึงระหว่างเหตุการณ์

เอเจนต์มอนิเตอร์เมตริกสำคัญ (ข้อมูลสูญหาย ช่องโหว่ความปลอดภัย DDoS ความผิดปกติทางการเงิน) และเมื่อเกินเกณฑ์ จะปิดบริการทั้งหมดอัตโนมัติ (ปิดอย่างเป็นระเบียบ) บล็อกการเข้าถึง (แยกเครือข่าย) และแจ้งทีมเวรพร้อมแผนดำเนินการ หรือย้อนกลับไปเวอร์ชันเสถียรล่าสุดได้ตามต้องการ $19/เดือน

366k+⭐ OpenClaw บน GitHub
<5นาทีสู่การเปิดใช้

คุ้นๆ ไหม?

อะไรกำลังกินเวลาของคุณ

เหตุการณ์วิกฤตพัฒนาเร็ว: ช่องโหว่ความปลอดภัยหรือข้อมูลเสียหายอาจเกิดในไม่กี่นาที และทีมไม่ทันสังเกตเสมอ

ความเสียหายโตขณะกำลังคิด: ถ้าเงินไหลออกโดยควบคุมไม่ได้ การสูญเสียโตแบบเอ็กซ์โพเนนเชียล

ไม่มีสวิตช์เร็ว: ปิดทุกอย่าง (บริการ ฐานข้อมูล API) ใช้เวลาหนึ่งนาที แต่บางครั้งมีเวลาแค่ 10 วินาที

ผลลัพธ์คาดเดายาก: คุณปิดฐานข้อมูล แต่แอปยังล้มเหลวอีก 10 นาที — ต้องปิดแบบประสานกัน

ความสามารถ

เอเจนต์ AI ของคุณทำอะไรได้บ้าง

มอนิเตอร์เหตุการณ์วิกฤต

เอเจนต์เฝ้าเมตริกที่อาจชี้หายนะ: พุ่งของความพยายามเข้าถึงที่ถูกปฏิเสธ (ช่องโหว่ความปลอดภัย?) พุ่งของข้อผิดพลาดฐานข้อมูล (ข้อมูลเสียหาย?) พุ่งผิดปกติของธุรกรรมเงิน (ฉ้อโกง?) ความผิดปกติเครือข่าย เกณฑ์ตั้งค่าได้ตามประเภทเหตุการณ์

ปิดบริการทั้งหมดอย่างเป็นระเบียบ

เมื่อเปิดใช้ เอเจนต์ส่ง SIGTERM ไปทุกบริการ (ให้ 30 วินาทีปิดอย่างถูกต้อง) แล้ว SIGKILL ถ้ายังไม่ปิด ลำดับสำคัญ: frontend เว็บก่อน แล้ว API การเชื่อมต่อฐานข้อมูล และสุดท้ายฐานข้อมูล แต่ละขั้นถูกบันทึก

แยกเครือข่ายและบล็อกการเข้าถึง

เอเจนต์ปิดโหลดบาลานเซอร์ทั้งหมดได้ (ไม่มีอะไรเข้าสู่ระบบ) บล็อกการเชื่อมต่อขาออกทั้งหมด (กันข้อมูลรั่ว) หรือปิด endpoint API เฉพาะ (เช่น ปิดชำระเงินทั้งหมด) ให้เวลากตรวจสอบ

ย้อนกลับอัตโนมัติไปเวอร์ชันเสถียร

ทางเลือก: ถ้าเหตุการณ์เกี่ยวกับโค้ด เอเจนต์ย้อนกลับอัตโนมัติไปคอมมิตที่เชื่อถือได้ล่าสุด สร้างอิมเมจใหม่ และรีสตาร์ทโครงสร้างพื้นฐานได้ ต้องผ่าน health check ก่อนหน้าสำเร็จ

แจ้งเตือนและเอสคาเลต

เอเจนต์แจ้งทีมเวร หัวหน้าเหตุการณ์ และทีมความปลอดภัย (ถ้ามีช่องโหว่) หรือการเงิน (ถ้ามีฉ้อโกง) ทันที ให้แผนดำเนินการพร้อมบริบท: «ระบบถูกล็อก นี่คือสิ่งที่เกิด นี่คือขั้นตอนถัดไป» สามารถสร้างเหตุการณ์ใน PagerDuty อัตโนมัติ

ทำงานกับเครื่องมือของคุณ

Prometheus
Datadog
PagerDuty
Slack
SSH/servers
Kubernetes
วิธีใช้งาน

เริ่มต้นได้ในไม่กี่ขั้นตอน

1

ตั้งค่าการมอนิเตอร์และทริกเกอร์

ทีมโครงสร้างพื้นฐานกำหนดเมตริกใดและเกณฑ์ใดที่กระตุ้นการปิดฉุกเฉิน ตัวอย่าง: ความพยายามเข้าถึงล้มเหลว > 1000/นาที อัตราข้อผิดพลาดฐานข้อมูล > 50% พุ่งของปริมาณธุรกรรมเงิน > 2σ อาจมีหลายเงื่อนไข (พอเงื่อนไขใดเงื่อนไขหนึ่ง)

2

มอนิเตอร์แบบเรียลไทม์

เอเจนต์รวบรวมเมตริกต่อเนื่องจาก Prometheus/Datadog และเทียบกับเกณฑ์ ถ้าเงื่อนไขตรง จะเริ่มปิดแบบลูกโซ่ ไม่ทันที: ให้ 10–30 วินาทีสำหรับยกเลิกด้วยมือถ้าผู้ปฏิบัติการพบผลบวกลวง

3

เปิดใช้และยืนยัน

เอเจนต์ตรวจพบว่าถึงเกณฑ์แล้วโพสต์ใน Slack: «การแจ้งเตือนวิกฤต: [เหตุผล] เริ่มปิดฉุกเฉินใน 30 วินาที ส่ง /cancel ถ้าเป็นการแจ้งเตือนปลอม» ให้หน้าต่างยกเลิก

4

ปิดอย่างเป็นระเบียบ

ถ้าผ่าน 30 วินาทีโดยไม่ยกเลิก เอเจนต์เริ่มปิด: SIGTERM ไปทุกคอนเทนเนอร์ รอปิดถูกต้อง (สูงสุด 30 วินาที) แล้ว SIGKILL ปิดโหลดบาลานเซอร์ (ไม่มีทราฟฟิกใหม่) บล็อกเครือข่ายถ้าจำเป็น

5

ตอบสนองเหตุการณ์และกู้คืน

เอเจนต์แจ้งทีมเวรพร้อมบริบททั้งหมด (เกิดอะไรขึ้น ทำไมเปิดใช้ สถานะปัจจุบัน) สามารถเริ่มกู้คืนได้ตามต้องการ (ย้อนโค้ด รีสตาร์ทโครงสร้างพื้นฐาน) แต่ปกติต้องตรวจสอบด้วยมือก่อนกู้ระบบ

FAQ

คำถามที่พบบ่อย

ได้แน่นอน ทีมเวรส่ง /killswitch ใน Slack หรือกดปุ่มในแผงควบคุมได้ทุกเมื่อ: การปิดเริ่มทันที ไม่ต้องรอการเปิดใช้อัตโนมัติถ้าเห็นสิ่งร้ายแรงมาก

อยากได้ OpenClaw โดยไม่ต้อง DevOps?

OpenKlo คือโฮสติ้งแบบจัดการสำหรับ OpenClaw ต้นฉบับ เอเจนต์เดิม พร้อมใน 3 นาที

ยกเลิกได้ทุกเมื่อ · รวมโมเดลชั้นนำ · เปลี่ยนแพ็กเกจได้ทุกเมื่อ