назад

DevOps инженер

Команда выстраивает современные CI/CD‑процессы на базе open‑source‑решений, обеспечивает поддержку тестовых окружений, команд разработки и тестирования. Ищем инженера в Devops команду развития ai сервисов.

Обязанности

• Проектирование и развитие архитектуры AI‑систем и сервисов инференса.
• Внедрение и настройка GPU‑планировщика для шаринга нагрузки на одном физическом сервере и k8s.
• Проектирование и поддержка ML‑пайплайнов.
• Организация CI/CD для моделей: версионирование данных, моделей, экспериментов.
• Мониторинг production‑моделей и инфраструктуры.
• Деплой и оптимизация LLM / inference‑серверов.
• Контейнеризация и оркестрация сервисов (Kubernetes, Helm).
• Настройка и поддержка CI/CD (GitLab CI).
• Настройка мониторинга и observability (Prometheus, Grafana).
• Обеспечение выполнения требований информационной безопасности в отношении инфраструктуры."
• Сопровождение инфраструктуры для инференса LLM‑моделей, AI‑сервисов, Mcp сервисов, агентов.
• Работа с GPU‑инфраструктурой и управление on‑prem GPU‑серверами:
• Настройка драйверов ОС, мониторинг, оптимизация использования ресурсов."

Обязательные требования

• Уверенное администрирование Linux
• Программирование на Python (автоматизация, скрипты, интеграции)
• Опыт настройки и поддержки пайплайнов в GitLab CI/CD
• Владение Ansible для управления конфигурациями и автоматизации развёртывания
• Практический опыт работы с Kubernetes (развёртывание, масштабирование, troubleshooting)
• Управление пакетами приложений через Helm
• Понимание принципов service mesh и опыт работы с Istio
• Настройка и поддержка HAProxy (балансировка, проксирование)
• Работа с Nexus (хранение и управление артефактами)
• Работа с Harbor (реестр контейнерных образов)
• Опыт работы с Kafka (настройка, поддержка, мониторинг)
• Управление секретами через Vault
• Настройка аутентификации и авторизации через Keycloak
• Построение дашбордов и алертинга в Grafana
• Желательно: связка Grafana + Prometheus для сбора и визуализации метрик
• Опыт работы с CUDA (GPU-ускорение)
• Знакомство с vLLM и LiteLLM (развёртывание и обслуживание LLM)
• Работа с MLflow (трекинг экспериментов, управление моделями)
• Автоматизация процессов через n8n
• Понимание принципов планирования GPU-ресурсов
• Знакомство с DRA, MPS, time-slicing для эффективного использования GPU

Будет плюсом

• Опыт построения отказоустойчивых кластеров Kubernetes в production
• Знание Terraform или других IaC-инструментов
• Понимание принципов SRE (SLI/SLO/SLA, error budget)
• Опыт работы с облачными провайдерами (Yandex Cloud, AWS, GCP)
• Навыки написания Helm-чартов и операторов Kubernetes

Расположение

Remote work

тип работы

DevOps

Номер вакансии

VR-72167

язык

English: A2 Elementary

Опыт работы

Regular

откликнуться

Нажимая «Отправить», я подписываю соглашение об использовании простой электронной подписи для подписания документов, связанных с обработкой моих персональных данных.

Я даю согласие на обработку персональных данных в целях потенциального трудоустройства. С Политикой обработки персональных данных можно ознакомиться здесь.

Я даю согласие на обработку персональных данных в целях включения в кадровый резерв. С Положением о кадровом резерве можно ознакомиться здесь.

Я даю согласие ООО «ИТ1» и компаниям на направление мне маркетинговых материалов и коммерческих предложений. Проставляя галочку, я также даю согласие на обработку персональных данных в указанных целях.

Работа у нас — это:

ДМС и страхование жизни

Корпоративные мероприятия

Культура обратной связи

Внутренняя ротация и ежегодная оценка

наставничество
и менторство

обучение, повышение квалификации

Индивидуальный план развития

Реферальная программа

Внутренние IT-сообщества

Похожие вакансии

DevOps

DevOps Remote work

Основной продукт — канальное приложение «Автоматизированное рабочее место (АРМ) оператора КЦ» Интерфейс, в котором работают операторы. Могут принимать звонки, подключать разные продукты, смотреть информацию по клиентам смб. И все это в микросервисной ар...

DevOps

DevOps Remote work

Мы - Компания IT_One, стратегический партнер по цифровизации российского бизнеса и государственных органов. Наша команда реализует крупнейшие проекты цифровой трансформации. Собрали большую команду, в которой сочетаются профессионализм, опыт и молодость...

Старший DevOps инженер (Infrastructure & Reliability)

DevOps Remote work

Подготовка и эксплуатация PROD-инфраструктуры для высоконагруженной системы. Обеспечение отказоустойчивости, disaster recovery и бесперебойной работы сервисов.

Старший DevOps инженер (Observability & Monitoring)

DevOps Remote work

Построение единой системы мониторинга, сбора метрик и логов для компонентов Kubernetes-кластера. Обеспечение прозрачности работы PROD-окружения.

Старший DevOps инженер (Security/DevSecOps)

DevOps Remote work

Обеспечение соответствия инфраструктуры требованиям информационной безопасности. Подготовка к аудитам, пентестам и внедрение security-практик на всех этапах жизненного цикла.

Junior DevOps

DevOps Москва

Продукт Дататека — это портал для работы с данными Банка. Предоставляет единый интерфейс для всего клиентского пути при работе с данными: от создания и описания данных, через поиск, получение и обработку данных до разработки и внедрения моделей в одной ...

Возврат к списку