#readiness_probe — Public Fediverse posts
Live and recent posts from across the Fediverse tagged #readiness_probe, aggregated by home.social.
-
Не подавать холодным! Прогрев JVM перед запуском трафика
Всем привет! Меня зовут Александр, я бэкенд-инженер в Банки.ру. Пару месяцев назад мы поймали проблему, которая жила у нас довольно долго и которую мы упорно списывали на случайность. После каждой выкатки сервис первые несколько минут отвечал заметно медленнее обычного, а потом сам собой приходил в норму. Ушло около десяти релизов, прежде чем мы перестали считать это совпадением, и еще пара дней, чтобы найти настоящую причину. Ей оказался холодный старт JVM, а точнее то, что Kubernetes пускал на новые поды боевой трафик раньше, чем они были к нему готовы. Дальше расскажу, что мы видели на графиках, какие версии проверили и отбросили, что происходит внутри JVM в первые минуты жизни процесса и что мы сделали.
https://habr.com/ru/companies/banki/articles/1069534/
#прогрев_JVM #холодный_старт_JVM #JITкомпиляция #readiness_probe #Kubernetes_Java #паузы_GC #Spring_ApplicationRunner #время_ответа_после_деплоя #JWarmup #latency_после_релиза
-
Почему при rolling update летят 502, хотя readiness-проба на месте
Классическая сцена. Команда выкатывает релиз, деплой проходит зелёным, kubectl rollout status рапортует об успехе — а в графиках ингресса на минуту вырастает горка пятисотых. Не тысячи, обычно доли процента, но стабильно, каждый деплой. Дальше начинается фольклор. «Ну это же рестарт, при рестарте всегда так». «Добавьте ретраи на клиенте». «Деплойтесь ночью». Самый частый вариант — на графики просто перестают смотреть в момент выката. На самом деле rolling update умеет проходить вообще без потерь, и readiness-проба тут ни при чём — она отвечает за другую половину задачи. Потери происходят на выключении подов, и причина в том, что удаление пода — это не последовательность шагов, а гонка.
https://habr.com/ru/articles/1062020/
#kubernetes #devops #rolling_update #zero_downtime #readiness_probe #preStop #graceful_shutdown #kubeproxy #endpoints
-
Ваши liveness-пробы убивают здоровые поды. Разбор по шагам
Есть паттерн, который я вижу почти в каждом кластере, куда прихожу: liveness-проба, скопированная из туториала, которая годами тихо делает продакшен хуже. Не «не помогает» — именно делает хуже: превращает локальные замедления в каскадные рестарты и красивые инциденты на ровном месте. Тезис статьи простой: liveness-проба — это не «проверка здоровья». Это заявление «если этот запрос не ответил — процесс нужно убить». И в большинстве конфигураций, которые я встречал, это заявление ложно.
https://habr.com/ru/articles/1060942/
#DevOps #kubernetes #liveness_probe #readiness_probe #kubelet #health_check #отказоустойчивость