Автохилинг воркер-нод в Kubernetes
12 мая 2025 г., обновлено 01 октября 2026
915
1 минута чтения
Поделиться
Теперь для кластеров Kubernetes доступен автохилинг. Разберем на пальцах, как система сама чинит проблемные ноды:
Алгоритм работы:
1️⃣ Каждые 10 минут проверяем состояние всех нод.
2️⃣ Если нода в состоянии NotReady или со статусом Failed:
- Сначала пробуем ее перезапустить.
- Если не оживает — автоматом создаем новую взамен.
3️⃣ Для конкретных нод можно отключить автохилинг через лейбл.
Доступно для всех кластеров с автоскейлингом и без GPU-нод.
Пока нет комментариев