Senior Big Data Engineer (Data Platform)

Lamoda Tech
Москва •Опубликовано 30 сентября 2026
Зарплата не указана
Полная занятость3–6 летАналитик
Зарплата не указана

Описание

Чем предстоит заниматься:

  • Разрабатывать и совершенствовать лучшую на рынке платформу данных электронной коммерции нового поколения;
  • Проектировать и разрабатывать ETL пайплайны на Airflow для Spark (Batch, Streaming), Iceberg, Trino;
  • Оптимизировать действующие пайплайны и джобы на Spark - мониторить нагрузку на кластер и оптимальность затрачиваемых джобами ресурсов и если необходимо оптимизировать;
  • Взаимодействовать с аналитиками и ML специалистами для создания/развертывания инструментов и наборов данных, соответствующих их вариантам использования - поддерживать регулярные связи с data ops для развития дата-платформы;
  • Анализировать и внедрять инструменты инжиниринга данных (Lineage, DQ);
  • Проектировать хранилища данных на основе k8s, настраивать производительность, мониторинг, планировать емкости кластера и другой инфраструктуры - думать над тем что и как грузить и в каких партициях;
  • Решать задачи, связанные с внедрением облачной инфраструктуры - разрабатывать новую архитектуру хранилища
  • Проводить code review и принимать участие в архитектурных решениях по дата платформе в команде.

Мы ожидаем:

  • Kubernetes - понимание ресурсной модели, просмотр конфигураций, troubleshooting.
  • Опыт работы с Hadoop (HDFS, Hive Metastore)
  • Опыт работы со Spark (spark SQL, streaming, понимание ньюансов работы с pyspark);
  • Apache Icberg – владение процедурами, snapshots, maintenance
  • Глубокое понимание Airflow (2, 3) – идемпотентность, assets, backfills
  • Уверенное знание Git, CI/CD;
  • Python, Scala/Java – ООП, проектирование библиотек, интеграционные/юнит тесты;
  • Хорошее понимание СУБД, SQL;

Будет плюсом:

  • Опыт работы с Docker (уверенное владение для поднятия локального окружения проекта);
  • Опыт работы с Kafka – понимание архитектуры и слабых мест;
  • Опыт с облачными технологиями: преимущественно Yandex Cloud;
  • Опыт с Clickhouse.
  • AI-native подход к разработке: активное использование Claude Code / Codex и подобных инструментов, опыт построения harness-систем — агентов с инструментами, автоматизации через LLM, RAG.
Описание

Чем предстоит заниматься:

  • Разрабатывать и совершенствовать лучшую на рынке платформу данных электронной коммерции нового поколения;
  • Проектировать и разрабатывать ETL пайплайны на Airflow для Spark (Batch, Streaming), Iceberg, Trino;
  • Оптимизировать действующие пайплайны и джобы на Spark - мониторить нагрузку на кластер и оптимальность затрачиваемых джобами ресурсов и если необходимо оптимизировать;
  • Взаимодействовать с аналитиками и ML специалистами для создания/развертывания инструментов и наборов данных, соответствующих их вариантам использования - поддерживать регулярные связи с data ops для развития дата-платформы;
  • Анализировать и внедрять инструменты инжиниринга данных (Lineage, DQ);
  • Проектировать хранилища данных на основе k8s, настраивать производительность, мониторинг, планировать емкости кластера и другой инфраструктуры - думать над тем что и как грузить и в каких партициях;
  • Решать задачи, связанные с внедрением облачной инфраструктуры - разрабатывать новую архитектуру хранилища
  • Проводить code review и принимать участие в архитектурных решениях по дата платформе в команде.

Мы ожидаем:

  • Kubernetes - понимание ресурсной модели, просмотр конфигураций, troubleshooting.
  • Опыт работы с Hadoop (HDFS, Hive Metastore)
  • Опыт работы со Spark (spark SQL, streaming, понимание ньюансов работы с pyspark);
  • Apache Icberg – владение процедурами, snapshots, maintenance
  • Глубокое понимание Airflow (2, 3) – идемпотентность, assets, backfills
  • Уверенное знание Git, CI/CD;
  • Python, Scala/Java – ООП, проектирование библиотек, интеграционные/юнит тесты;
  • Хорошее понимание СУБД, SQL;

Будет плюсом:

  • Опыт работы с Docker (уверенное владение для поднятия локального окружения проекта);
  • Опыт работы с Kafka – понимание архитектуры и слабых мест;
  • Опыт с облачными технологиями: преимущественно Yandex Cloud;
  • Опыт с Clickhouse.
  • AI-native подход к разработке: активное использование Claude Code / Codex и подобных инструментов, опыт построения harness-систем — агентов с инструментами, автоматизации через LLM, RAG.

Похожие вакансии

Помощник руководителя в отдел контроля
Супертек
15000 – 40000 руб.
Полная занятостьОпыт не требуется
Менеджер Wildberries — удалённая работа
БОР-М
50000 – 70000 руб.
Полная занятостьОпыт 1–3 года
B2B-маркетолог / Marketing Manager
Сила Ума
Зарплата не указана
Полная занятостьОпыт 3–6 лет
Менеджер по продажам
Семенов Антон Петрович
80000 – 150000 руб.
Полная занятостьОпыт 1–3 года
Менеджер по продажам в онлайн-школу
Егорова Дарья Ивановна
от 130000 руб.
Полная занятостьОпыт 1–3 года
Визовый специалист
Голубицкая Алёна Дмитриевна
60000 – 250000 руб.
Полная занятостьОпыт 1–3 года