Старший инженер мониторинга

АВИТО ТЕХ
Москва Опубликовано 30 июня 2026
Зарплата не указана
Полная занятость3–6 летОператор Колл-Центра
Зарплата не указана

Описание

О команде

Авито — это тысячи микросервисов и серверов, сложная техническая архитектура и востребованные продукты для пользователей. Работу всей системы обеспечивают метрики, алерты, логи и дашборды. Команда Incident & Problem Management помогает компании повышать стабильность площадки, координирует работу множества отделов при сбоях, а также разрабатывает решения, которые снижают вероятность появления инцидентов и упрощают процесс устранения проблем.

Мы ищем старшего инженера, который будет вести проектные стримы по улучшению систем мониторинга и качества сервисов, выступать наставником для сменных специалистов 24/7 и контролировать соблюдение SLA/SLO.

Обязанности:

  • вести проектные стримы по развитию мониторинга - от идеи до измеримого результата в метриках;
  • повышать качество алертов: внедрять новые, устранять шум, разбирать цепочки на крупных инцидентах;
  • держать SLA/SLO команды под контролем и подсвечивать отклонения раньше, чем они становятся проблемой;
  • развивать инструменты и документацию мониторинга, чтобы команде работалось быстрее и точнее;
  • участвовать в жизни команды: онбордить новичков, проводить технические интервью, вести встречи в отсутствие тимлида.

Требования:

  • работали в мониторинге, SRE или DevOps от 2 лет, включая опыт сменного графика 24/7;
  • уверенно знаете Linux: понимаете системные метрики, сеть, процессы, ресурсы CPU/RAM/disk, умеете разбирать production-проблемы на уровне хоста и приложения;
  • разбираетесь в системах мониторинга: Zabbix, Prometheus, Grafana, ELK, в том числе пишете и оптимизируете запросы в Graphite и Prometheus;
  • понимаете, как функционируют микросервисы в продакшене, и используете Git как базовый инструмент;
  • умеете вести стрим: декомпозировать задачи, отвечать за метрики и доводить до результата.

Условия:

  • возможность реализовать свои идеи в проекте с многомиллионной аудиторией;
  • талантливая команда, готовая поддержать ваши инициативы;
  • мощное железо, дополнительные мониторы и всё, что нужно для продуктивной работы;
  • прозрачная система премий, достойная зарплата — размер обсудим на собеседовании;
  • личный бюджет на обучение, который можно тратить на книги, курсы и конференции;
  • забота о здоровье: с первого дня у вас будет ДМС со стоматологией, в офисе принимают терапевт и массажист.
Описание

О команде

Авито — это тысячи микросервисов и серверов, сложная техническая архитектура и востребованные продукты для пользователей. Работу всей системы обеспечивают метрики, алерты, логи и дашборды. Команда Incident & Problem Management помогает компании повышать стабильность площадки, координирует работу множества отделов при сбоях, а также разрабатывает решения, которые снижают вероятность появления инцидентов и упрощают процесс устранения проблем.

Мы ищем старшего инженера, который будет вести проектные стримы по улучшению систем мониторинга и качества сервисов, выступать наставником для сменных специалистов 24/7 и контролировать соблюдение SLA/SLO.

Обязанности:

  • вести проектные стримы по развитию мониторинга - от идеи до измеримого результата в метриках;
  • повышать качество алертов: внедрять новые, устранять шум, разбирать цепочки на крупных инцидентах;
  • держать SLA/SLO команды под контролем и подсвечивать отклонения раньше, чем они становятся проблемой;
  • развивать инструменты и документацию мониторинга, чтобы команде работалось быстрее и точнее;
  • участвовать в жизни команды: онбордить новичков, проводить технические интервью, вести встречи в отсутствие тимлида.

Требования:

  • работали в мониторинге, SRE или DevOps от 2 лет, включая опыт сменного графика 24/7;
  • уверенно знаете Linux: понимаете системные метрики, сеть, процессы, ресурсы CPU/RAM/disk, умеете разбирать production-проблемы на уровне хоста и приложения;
  • разбираетесь в системах мониторинга: Zabbix, Prometheus, Grafana, ELK, в том числе пишете и оптимизируете запросы в Graphite и Prometheus;
  • понимаете, как функционируют микросервисы в продакшене, и используете Git как базовый инструмент;
  • умеете вести стрим: декомпозировать задачи, отвечать за метрики и доводить до результата.

Условия:

  • возможность реализовать свои идеи в проекте с многомиллионной аудиторией;
  • талантливая команда, готовая поддержать ваши инициативы;
  • мощное железо, дополнительные мониторы и всё, что нужно для продуктивной работы;
  • прозрачная система премий, достойная зарплата — размер обсудим на собеседовании;
  • личный бюджет на обучение, который можно тратить на книги, курсы и конференции;
  • забота о здоровье: с первого дня у вас будет ДМС со стоматологией, в офисе принимают терапевт и массажист.

Похожие вакансии

Middle Python Backend разработчик
Standfin
Зарплата не указана
Полная занятостьОпыт 3–6 лет
Middle Frontend-разработчик
Playerok
от 200000 руб.
Полная занятостьОпыт 1–3 года
Контент-менеджер/Видеомонтажер
ADWAY.TEAM
40000 – 60000 руб.
Полная занятостьОпыт не требуется
Тимлид команды разработки
SW Development
350000 – 400000 руб.
Полная занятостьОпыт более 6 лет
Ночной модератор сайта (Армения)
High Load Technologies
от 400 $
Полная занятостьОпыт 1–3 года
Digital-designer (Удаленно из России)
Clickise
до 120000 руб.
Полная занятостьОпыт 3–6 лет