Kubernetes давно вышел за рамки оркестрации микросервисов. Компании всё чаще хотят разрабатывать и запускать ИИ-сервисы в том же инфраструктурном контуре, где живут остальные приложения, с едиными подходами к оркестрации, масштабированию, изоляции и управлению ресурсами. Kubernetes стал естественным кандидатом на роль универсального слоя управления вычислениями — включая нагрузки, которым нужны GPU. ИИ-задачи предъявляют к инфраструктуре несколько специфических требований, и Kubernetes закрывает каждое из них...
VK Cloud
KGateway вместо Ingress NGINX: что меняется в Kubernetes
В ноябре 2025 года команда Kubernetes объявила: поддержка Ingress NGINX прекращается в марте 2026 года. Больше не будет релизов, исправлений и патчей безопасности, а репозитории перейдут в режим только для чтения. Учитывая, что Ingress NGINX — один из самых распространённых ingress-контроллеров в Kubernetes, ему пришлось искать замену, и сам проект Kubernetes официально порекомендовал миграцию на Kubernetes Gateway API. Одна из зрелых реализаций этого стандарта — KGateway, прежде известный как Gloo Gateway...
Как устроен Cilium: eBPF вместо iptables в сети Kubernetes
Когда микросервисов становится несколько сотен и каждый из них постоянно общается с другими, сеть кластера перестаёт быть просто инфраструктурой и сама становится узким местом. Классические инструменты вроде iptables создавались для совершенно другой задачи и начинают тормозить: каждый новый под добавляет правила, и ядро системы вынуждено прогонять каждый пакет через тысячи проверок подряд. Здесь и появился Cilium — сетевой плагин, который убирает эту цепочку целиком и заменяет её кодом, работающим прямо внутри ядра Linux через технологию eBPF...
Argo CD в Managed Kubernetes: автоматизация релизов по GitOps
Argo CD переводит управление релизами из ручных команд и разрозненных CI-скриптов в GitOps-процесс: репозиторий хранит желаемое состояние приложения, а контроллер регулярно приводит к нему кластер. Для DevOps- и SRE-команд это меньше расхождения конфигураций, прозрачная история изменений и единый способ развёртывать приложения в тестовых, промежуточных и боевых средах. GitOps — модель, в которой желаемое состояние системы описывается декларативно и хранится в Git: состояние версионируется, а фактическое положение дел в кластере непрерывно сверяется с тем, что записано в репозитории...
GPU Operator в Managed Kubernetes: как запустить GPU без ручной настройки драйверов
До первой строки тренировочного кода ML-команда обычно упирается в инфраструктурную задачу: установить драйвер NVIDIA на каждую GPU-ноду, подготовить runtime для запуска GPU-контейнеров, подключить компонент, который сообщает планировщику кластера о наличии ускорителя, и не потерять совместимость версий при обновлении нод. GPU в Kubernetes работает стабильно только тогда, когда весь стек компонентов собран согласованно. Без автоматизации инженер собирает его из нескольких частей: драйвер NVIDIA,...
Отказоустойчивый кластер Kubernetes: мультизона, реплики, бэкап
Отказоустойчивый кластер Kubernetes часто падает не там, где ждали. Архитектор поднимает три мастер-ноды, распределяет реплики по нодам, ставит галочку HA в чек-листе, а через месяц авария в одной зоне доступности кладёт сервис целиком — потому что поды приложения оказались в одном дата-центре, а данные из отвалившегося тома никто не бэкапил. Отказоустойчивость редко работает как один переключатель. На деле это цепочка независимых уровней: диск и нода, зона доступности, управляющий слой кластера, само приложение, данные приложения...
