Вступить в клуб →
← К вакансиям
KODE85/100

DevOps инженер (LLM инфраструктура)

170 000–230 000 RUB
Опубликовано: 7 июля 2026
seniorremoteDevOpsfulltimeКалининградrukubernetesdockerhelmgitopsvllmsglangollamagpucudaprometheusgrafanapython
🔒 Контакты и отклик открываются после вступления в клубВступить →
Развертывание и сопровождение LLM-инференс платформ (vLLM, SGLang, Ollama) в Kubernetes, оптимизация производительности, мониторинг, автоматизация CI/CD. Требуется опыт DevOps от 4 лет и глубокая работа с GPU.
Публикатор: Татьяна Горбацевич Обсуждение: @•••••• #вакансия Город и адрес офиса: Калининград Формат работы: удаленка, гибрид, офис Занятость: полная Зарплатная вилка: от 170000 gross до 230000 gross Особенности найма: - удаленка только из городов РФ - 2 этапа интервью Описание вакансии: Чем предстоит заниматься: - Развертывание, сопровождение и обновление LLM-инференс платформ (vLLM, SGLang, Ollama); - Эксплуатация и развитие AI-платформы в Kubernetes, включая масштабирование и управление GPU-ресурсами; - Настройка AI Gateway (LiteLLM): маршрутизация запросов, API-ключи, квоты, лимиты и политики доступа; - Оптимизация производительности inference: batching, KV Cache, semantic cache, снижение latency и стоимости инференса; - Настройка мониторинга, логирования и трассировки (OpenTelemetry, Langfuse, SigNoz, Prometheus/Grafana); - Автоматизация CI/CD процессов для инфраструктуры и моделей, поддержка GitOps-подхода; - Интеграция и сопровождение сервисов памяти, векторных хранилищ и компонентов RAG/Agentic AI; - Диагностика и устранение инцидентов, обеспечение стабильности и высокой доступности LLM-платформы. Что мы ждём от нового члена команды: - ВАЖНО! Опыт в роли DevOps от 4 лет; - Опыт администрирования Kubernetes в production, Docker, Helm, понимание GitOps-подходов; - Опыт эксплуатации LLM inference-серверов (vLLM, SGLang, Ollama или TGI) и понимание их архитектуры; - Хорошее понимание принципов работы LLM: токены, KV Cache, batching, streaming, квантование, RAG; - Практический опыт работы с GPU (NVIDIA/CUDA), распределением ресурсов и оптимизацией производительности; - Опыт настройки мониторинга и observability (Prometheus, Grafana, OpenTelemetry, SigNoz/Langfuse); - Уверенные знания Linux, Docker, сетевого взаимодействия и диагностики инфраструктурных проблем; - Навыки автоматизации на Python и работы с CI/CD (GitLab CI/GitHub Actions); - Опыт работы с Redis, PostgreSQL и API-шлюзами; - Знание LiteLLM, KEDA, Qdrant/Milvus будет преимуществом. Название компании: KODE Контакты: @••••••

Похожие вакансии

Все вакансии →
Agvendremotefulltimesenior90

Senior DevOps

Senior DevOps for a B2B SaaS platform. Manage Kubernetes infrastructure on AWS (12 EKS clusters), Terraform, monitoring, databases. Fully remote.

awsterraformkubernetesekshelmdocker+6
7 сентября 20265 000–8 000 USD
ZexterLimassol, Cyprusonsitesenior70

Senior DevOps Engineer

Zexter, a technology company building digital infrastructure for the entertainment business, is looking for a Senior DevOps Engineer to work on-site in Limassol, Cyprus. Stack includes Jenkins, GitLab CI, Kubernetes, Helm, Docker, Linux, Bash/Python.

jenkinsgitlab-cikuberneteshelmdockerlinux+6
17 августа 2026
Контурremotefulltimesenior88

MLOps-инженер в инфраструктуру Центра ИИ

Контур ищет senior MLOps-инженера для развития инфраструктуры Центра ИИ: хостинг ML-моделей, инструменты, CI/CD, мониторинг. Предлагают удалённую или офисную работу с гибкими условиями.

pythonfastapiceleryansibledockerkubernetes+6
12 августа 2026
iGaming (NDA)remotefulltimelead85

Team Lead DevOps

Ищем hands-on Team Lead Platform/DevOps/SRE для возглавления платформенной команды в iGaming-компании. Задачи: развитие команды, развитие платформы на AWS/K8s, CI/CD, observability, SRE-практики.

kubernetesawsterraformhelmgitlab cigitops+6
30 июля 20265 000–8 000 USD