Отставание консьюмера растёт до часа, а автомасштабирование не добавляет подов
Сервис на Go читает события из Kafka и пишет во внешний API, который отвечает медленно. HPA настроен на загрузку CPU 70%. В часы пик отставание консьюмера растёт до часа, но CPU подов около 15% — горутины в основном ждут ответа API, и HPA ничего не масштабирует.
Как настроить масштабирование?
- Масштабировать по отставанию группы, например через KEDA
- Снизить порог CPU в HPA до 10%
- Увеличить число горутин в одном поде до тысячи
- Отключить HPA и держать максимум подов всегда
