В Kubernetes тест упал по таймауту, а под уже перезапустился
Ночной регресс в Kubernetes упал: API отвечал таймаутами десять минут. Утром kubectl logs api-7d9f показывает нормальную работу, ошибок нет. В kubectl get pods у пода стоит RESTARTS: 2.
Как добраться до причины?
- Смотреть логи предыдущего запуска и события пода: причину перезапуска
- Повторить прогон и надеяться, что ошибка воспроизведётся
- Поднять локально тот же образ и проверить его вручную
- Считать падение нестабильностью и перезапустить упавшие тесты
