dev-tools
Словарь ↗Chaos Engineering (хаос-инжиниринг)
Chaos engineering (хаос-инжиниринг) — практика намеренного внедрения сбоев в систему — убить серверы, добавить сетевую задержку, отрезать зависимость — чтобы узнать, как она реально ведёт себя под нагрузкой, прежде чем это за вас сделает настоящий сбой. Идея, популяризированная «Chaos Monkey» от Netflix, в том, что распределённые системы падают так, как нельзя полностью предсказать, поэтому единственный способ построить настоящую уверенность — проводить контролируемые эксперименты в условиях, близких к продакшену, и проверять, что система деградирует изящно, а не рушится. Правильный хаос-эксперимент начинается с гипотезы («если эта реплика базы умрёт, запросы переключатся за две секунды»), внедряет сбой на ограниченном радиусе поражения и измеряет результат. Для AI/SaaS-разработчиков он вскрывает скрытые допущения — отсутствующий тайм-аут, шторм ретраев, единую точку отказа, — которые проявляются только когда что-то ломается. Практическая заметка: не начинайте в продакшене. Стартуйте в staging с маленьким радиусом поражения и надёжной observability, чтобы измерять эффект и прерывать эксперимент, а к контролируемым продакшен-экспериментам переходите, когда доверяете своим предохранителям.
Похожие термины