В системе всегда есть скрытые слабые места. Вопрос в том, найдём ли мы их раньше, чем это сделает настоящий сбой
Доклад о том, как с помощью хаоса и контролируемых учений находить то, что обычные тесты часто пропускают: скрытые зависимости, критичные сервисы, неработающие фоллбэки и неизвестные точки отказа
Задача хаоса — в том, чтобы с помощью коротких контролируемых экспериментов увидеть, как система ведёт себя при отказе, и использовать полученные знания для повышения её надёжности