При недоступной базе все поды API перезапускаются по кругу
Сервис регистрирует AddHealthChecks().AddNpgSql(...) и отдаёт один эндпоинт /health. Kubernetes использует его и для liveness, и для readiness. База была недоступна две минуты — все поды ушли в перезапуски и поднимались ещё десять минут.
Как настроить проверки?
- Разделить эндпоинты: база — только в readiness
- Убрать проверку базы и liveness-пробу
- Увеличить failureThreshold liveness до 100
- Проверять базу чаще, раз в секунду
