คืออะไร Chaos Engineering
การทดสอบความยืดหยุ่นผ่านความล้มเหลว
Chaos Engineering
Chaos Engineering — สาขาที่แนะนำความล้มเหลวเข้าสู่ระบบโดยเจตนาเพื่อตรวจสอบความยืดหยุ่นและความสามารถในการกู้คืน
หลักการ Chaos Engineering
| หลักการ | คำอธิบาย | |---------|----------| | สมมติฐาน | กำหนดพฤติกรรมที่คาดหวัง | | รัศมีระเบิดน้อยสุด | จำกัดขอบเขตการทดลอง | | Production ก่อน | ทดสอบในสภาพแวดล้อมจริง | | อัตโนมัติ | การทดลองต่อเนื่อง |
ประเภทการทดลอง
- บริการล้มเหลว — kill pod/container
- ความล้มเหลวของเครือข่าย — latency, packet loss
- ข้อจำกัดทรัพยากร — CPU/memory stress
- ความล้มเหลวของ AZ — AZ failure
เครื่องมือ
- Chaos Monkey (Netflix) — คลาสสิกของ chaos
- Gremlin — แพลตฟอร์ม enterprise
- Litmus — Kubernetes-native
- Chaos Mesh — โปรเจ็กต์ CNCF
กระบวนการทดลอง
- กำหนดสถานะคงที่
- ตั้งสมมติฐาน
- แทรกความล้มเหลว
- สังเกตผลลัพธ์
- ปรับปรุงระบบ