Старший инженер мониторинга

АВИТО ТЕХ
Москва •Опубликовано 30 июня 2026
Зарплата не указана
Полная занятость3–6 летОператор Колл-Центра
Зарплата не указана

Описание

О команде

Авито — это тысячи микросервисов и серверов, сложная техническая архитектура и востребованные продукты для пользователей. Работу всей системы обеспечивают метрики, алерты, логи и дашборды. Команда Incident & Problem Management помогает компании повышать стабильность площадки, координирует работу множества отделов при сбоях, а также разрабатывает решения, которые снижают вероятность появления инцидентов и упрощают процесс устранения проблем.

Мы ищем старшего инженера, который будет вести проектные стримы по улучшению систем мониторинга и качества сервисов, выступать наставником для сменных специалистов 24/7 и контролировать соблюдение SLA/SLO.

Обязанности:

  • вести проектные стримы по развитию мониторинга - от идеи до измеримого результата в метриках;
  • повышать качество алертов: внедрять новые, устранять шум, разбирать цепочки на крупных инцидентах;
  • держать SLA/SLO команды под контролем и подсвечивать отклонения раньше, чем они становятся проблемой;
  • развивать инструменты и документацию мониторинга, чтобы команде работалось быстрее и точнее;
  • участвовать в жизни команды: онбордить новичков, проводить технические интервью, вести встречи в отсутствие тимлида.

Требования:

  • работали в мониторинге, SRE или DevOps от 2 лет, включая опыт сменного графика 24/7;
  • уверенно знаете Linux: понимаете системные метрики, сеть, процессы, ресурсы CPU/RAM/disk, умеете разбирать production-проблемы на уровне хоста и приложения;
  • разбираетесь в системах мониторинга: Zabbix, Prometheus, Grafana, ELK, в том числе пишете и оптимизируете запросы в Graphite и Prometheus;
  • понимаете, как функционируют микросервисы в продакшене, и используете Git как базовый инструмент;
  • умеете вести стрим: декомпозировать задачи, отвечать за метрики и доводить до результата.

Условия:

  • возможность реализовать свои идеи в проекте с многомиллионной аудиторией;
  • талантливая команда, готовая поддержать ваши инициативы;
  • мощное железо, дополнительные мониторы и всё, что нужно для продуктивной работы;
  • прозрачная система премий, достойная зарплата — размер обсудим на собеседовании;
  • личный бюджет на обучение, который можно тратить на книги, курсы и конференции;
  • забота о здоровье: с первого дня у вас будет ДМС со стоматологией, в офисе принимают терапевт и массажист.
Описание

О команде

Авито — это тысячи микросервисов и серверов, сложная техническая архитектура и востребованные продукты для пользователей. Работу всей системы обеспечивают метрики, алерты, логи и дашборды. Команда Incident & Problem Management помогает компании повышать стабильность площадки, координирует работу множества отделов при сбоях, а также разрабатывает решения, которые снижают вероятность появления инцидентов и упрощают процесс устранения проблем.

Мы ищем старшего инженера, который будет вести проектные стримы по улучшению систем мониторинга и качества сервисов, выступать наставником для сменных специалистов 24/7 и контролировать соблюдение SLA/SLO.

Обязанности:

  • вести проектные стримы по развитию мониторинга - от идеи до измеримого результата в метриках;
  • повышать качество алертов: внедрять новые, устранять шум, разбирать цепочки на крупных инцидентах;
  • держать SLA/SLO команды под контролем и подсвечивать отклонения раньше, чем они становятся проблемой;
  • развивать инструменты и документацию мониторинга, чтобы команде работалось быстрее и точнее;
  • участвовать в жизни команды: онбордить новичков, проводить технические интервью, вести встречи в отсутствие тимлида.

Требования:

  • работали в мониторинге, SRE или DevOps от 2 лет, включая опыт сменного графика 24/7;
  • уверенно знаете Linux: понимаете системные метрики, сеть, процессы, ресурсы CPU/RAM/disk, умеете разбирать production-проблемы на уровне хоста и приложения;
  • разбираетесь в системах мониторинга: Zabbix, Prometheus, Grafana, ELK, в том числе пишете и оптимизируете запросы в Graphite и Prometheus;
  • понимаете, как функционируют микросервисы в продакшене, и используете Git как базовый инструмент;
  • умеете вести стрим: декомпозировать задачи, отвечать за метрики и доводить до результата.

Условия:

  • возможность реализовать свои идеи в проекте с многомиллионной аудиторией;
  • талантливая команда, готовая поддержать ваши инициативы;
  • мощное железо, дополнительные мониторы и всё, что нужно для продуктивной работы;
  • прозрачная система премий, достойная зарплата — размер обсудим на собеседовании;
  • личный бюджет на обучение, который можно тратить на книги, курсы и конференции;
  • забота о здоровье: с первого дня у вас будет ДМС со стоматологией, в офисе принимают терапевт и массажист.

Похожие вакансии

Data Engineer
WILIX
180000 – 240000 руб.
Полная занятостьОпыт 3–6 лет
Чат-менеджер по теплым продажам
Гуревич Наталия Сергеевна
55000 – 100000 руб.
Полная занятостьОпыт 1–3 года
Senior .NET/C# Backend разработчик
GO Digital
200000 – 350000 руб.
Полная занятостьОпыт более 6 лет
Менеджер по развитию ключевых клиентов / Customer Success Manager
Data Light
150000 – 200000 руб.
Полная занятостьОпыт 3–6 лет
Инфлюенсер/контент креатор/блогер/UGC креатор
Hikee
25000 – 100000 руб.
Полная занятостьОпыт 1–3 года
Визовый специалист
Голубицкая Алёна Дмитриевна
60000 – 250000 руб.
Полная занятостьОпыт 1–3 года