MLOps / DevOps Engineer Middle+ (AI, Adult)

Михайлов Андрей Павлович
Москва Опубликовано 25 июля 2026
от 2000 $
Полная занятость3–6 летПрограммист
от 2000 $

Описание

Мы – амбициозный AI стартап, создающий платформу для коммуникации с продвинутыми ИИ персонажами, где технологии встречаются с глубоким пониманием человеческих желаний и эмоций. Сейчас мы в поисках MLOps / DevOps Engineer!

Цель — держать inference-serving и его стоимость: надёжная эксплуатация под нагрузкой, мониторинг, GPU cost ownership (utilization, FinOps, unit-экономика)

Используем AI-assisted development и внутренние шаблоны — важна готовность быстро разбираться, адаптировать и доводить инфраструктурные решения до production-состояния.


Профиль кандидата: backend/DevOps с уклоном в ML-serving либо infra-человек, комфортный с AI-assisted воркфлоу

Требования - обязательные:

- DevOps / Infra / MLOps middle-уровня
- Production serving или эксплуатация ML/AI-сервисов под нагрузкой
- Docker, Linux, networking basics
- Monitoring / observability: Prometheus / Grafana / logs / alerts или аналоги
- Очереди / оркестрация: Redis / RabbitMQ / Celery или аналоги
- GPU cloud: RunPod / Vast / Lambda / AWS / GCP GPU — или готовность быстро разобраться
- Python на рабочем уровне
- Cost ownership: GPU utilization, idle resources, spend anomalies, optimization proposals

Требования - nice-to-have:
- По инфре: ComfyUI в проде, diffusion / image-video pipelines, GPU autoscaling, spot / preemptible, inference optimization (TensorRT и т.п.), Kubernetes / Nomad, model versioning, FinOps-дашборды
- По agentic / gen-AI: serving агентных систем, agent observability (Langfuse / LangSmith), cost-контроль агентных лупов, MCP, incident response под агентные сбои

Обязанности:

- Эксплуатировать serving-инфру: деплой, обновления, надёжность
- Cost ownership: utilization, idle, spend-аномалии, дашборды, регулярный cost-review, рекомендации по spot / autoscaling / rightsizing
- Доводить инфра-решения до production (в т.ч. через AI-assisted development и шаблоны)
- Держать мониторинг, алертинг, observability; управлять очередями / оркестрацией нагрузки
- Снимать узкие места; reliability ownership

Важен также реальный cost-инстинкт (давал ли где-то экономию в деньгах) + умение работать через AI-tooling

Условия:

- График работы: 5/2

- Удаленная работа

- Заработная плата от 2000$

- Возможность профессионального роста и обучения

- Крутая команда молодых специалистов

- Оплачиваемые курсы для повышения квалификации

- Для тех, кто мечтает о путешествиях, организуем Международные Сборы!

- Рассрочка на обновление техники для тех, кто успешно прошел испытательный срок

Описание

Мы – амбициозный AI стартап, создающий платформу для коммуникации с продвинутыми ИИ персонажами, где технологии встречаются с глубоким пониманием человеческих желаний и эмоций. Сейчас мы в поисках MLOps / DevOps Engineer!

Цель — держать inference-serving и его стоимость: надёжная эксплуатация под нагрузкой, мониторинг, GPU cost ownership (utilization, FinOps, unit-экономика)

Используем AI-assisted development и внутренние шаблоны — важна готовность быстро разбираться, адаптировать и доводить инфраструктурные решения до production-состояния.


Профиль кандидата: backend/DevOps с уклоном в ML-serving либо infra-человек, комфортный с AI-assisted воркфлоу

Требования - обязательные:

- DevOps / Infra / MLOps middle-уровня
- Production serving или эксплуатация ML/AI-сервисов под нагрузкой
- Docker, Linux, networking basics
- Monitoring / observability: Prometheus / Grafana / logs / alerts или аналоги
- Очереди / оркестрация: Redis / RabbitMQ / Celery или аналоги
- GPU cloud: RunPod / Vast / Lambda / AWS / GCP GPU — или готовность быстро разобраться
- Python на рабочем уровне
- Cost ownership: GPU utilization, idle resources, spend anomalies, optimization proposals

Требования - nice-to-have:
- По инфре: ComfyUI в проде, diffusion / image-video pipelines, GPU autoscaling, spot / preemptible, inference optimization (TensorRT и т.п.), Kubernetes / Nomad, model versioning, FinOps-дашборды
- По agentic / gen-AI: serving агентных систем, agent observability (Langfuse / LangSmith), cost-контроль агентных лупов, MCP, incident response под агентные сбои

Обязанности:

- Эксплуатировать serving-инфру: деплой, обновления, надёжность
- Cost ownership: utilization, idle, spend-аномалии, дашборды, регулярный cost-review, рекомендации по spot / autoscaling / rightsizing
- Доводить инфра-решения до production (в т.ч. через AI-assisted development и шаблоны)
- Держать мониторинг, алертинг, observability; управлять очередями / оркестрацией нагрузки
- Снимать узкие места; reliability ownership

Важен также реальный cost-инстинкт (давал ли где-то экономию в деньгах) + умение работать через AI-tooling

Условия:

- График работы: 5/2

- Удаленная работа

- Заработная плата от 2000$

- Возможность профессионального роста и обучения

- Крутая команда молодых специалистов

- Оплачиваемые курсы для повышения квалификации

- Для тех, кто мечтает о путешествиях, организуем Международные Сборы!

- Рассрочка на обновление техники для тех, кто успешно прошел испытательный срок

Похожие вакансии

Менеджер по подбору персонала
Группа кадровых компаний АКМЭ
110000 – 160000 руб.
Полная занятостьОпыт 1–3 года
Менеджер по продукту
Призма
Зарплата не указана
Полная занятостьОпыт 3–6 лет
Оператор службы клиентской поддержки
Принтдирект
от 70000 руб.
Полная занятостьОпыт 1–3 года
Коммуникационный дизайнер
Твоя Полка
Зарплата не указана
Полная занятостьОпыт 1–3 года
Менеджер по продажам (тёплая база)
Оптисейл
до 4000
Полная занятостьОпыт 1–3 года
Графический дизайнер
СКИМ
от 1500 руб.
Полная занятостьОпыт не требуется