После инцидента анализируют, почему дефект не был предотвращён или обнаружен раньше, и какие изменения в тестах/процессах/мониторинге нужны.
Разбор
- Timeline, impact, detection, mitigation без blame culture.
- Пробелы: требования, тест-дизайн, среда, алерты, runbooks.
- Action items с владельцами и сроками (новые тесты, gate, дашборды).
- Проверка, что похожий класс дефектов закрыт системно.
Итог
Инцидент — вход в улучшение системы качества; без follow-up команда повторит ту же ошибку.