Не упустите лучшие вакансии!
Подключите наш Telegram-бот и получайте мгновенные уведомления о новых предложениях из 10+ источников. Будьте первым, кто откликнется!
Подключить ботаTechnical Lead Data Engineer в Доставку
Какие задачи вас ждут
Разработка и поддержка ETL-процессов, повышение качества и стабильности данныхВы будете проектировать и поддерживать ETL-пайплайны для обработки данных — от источников до дашбордов, работая в составе V-team своих доменов данных. Также вам предстоит обеспечивать стабильность и производительность витрин и дашбордов, разрабатывать механизмы контроля качества данных и оптимизировать существующие процессы обработки.
Поддержка инфраструктуры данных
Вам нужно будет поддерживать работу ключевых компонентов платформы (ClickHouse, Greenplum, YTsaurus, ETL-сервисы), взаимодействуя с инфраструктурными командами.
Техническая поддержка аналитиков
Вы станете основным контактным лицом для аналитиков по техническим вопросам работы с данными и инструментами платформы.
Руководство командой и развитие платформы данных
Вам предстоит стать техническим лидером для команды инженеров данных: вы будете распределять задачи, контролировать их выполнение, участвовать в планировании и определении стратегических направлений развития платформы. Также вам нужно будет внедрять стандарты и лучшие практики в области обработки и хранения данных, оптимизировать рабочие процессы и устранять «узкие места» в архитектуре и процессах обработки данных.
Взаимодействие с командами и развитие сотрудников
Вам нужно будет взаимодействовать с другими командами и стейкхолдерами для согласования технических решений и интеграции данных, а также развивать команду: помогать сотрудникам расти профессионально, организовывать обучение и обмен знаниями, проводить код-ревью и способствовать повышению качества кода.
Мы ждем, что вы
- Отлично знаете Python
- Работаете с Greenplum, Vertica, ClickHouse или любыми другими MPP СУБД
- Можете работать с большими объёмами данных в экосистемах Hadoop (HDFS, Spark, Hive), YTsaurus или аналогичных
- Понимаете принципы проектирования хранилищ данных, ETL-фреймворков, а также систем мониторинга за состоянием хранилища
- Умеете оптимизировать запросы и оценивать вычислительную нагрузку
- Имеете опыт руководства небольшой командой (2–3 человека)
Будет плюсом, если вы
- Создавали сложные высоконагруженные ETL- и ELT-пайплайны (плюсом будет знание code-driven ETL Luigi, Airflow)
- Разрабатывали процессы обработки сложных событий (CEP) почти в реальном времени (Kafka Streams, Spark, Flink и пр.)
- Работали с инструментами стека Python для Data Science (Jupyter, pandas, SciPy, Matplotlib, Bokeh и пр.)
- Разрабатывали проверки качества данных, мониторинга стабильности и использования данных
- Понимаете ценность данных для принятия решений бизнесом
- Коммитите в публичные репозитории или пишете статьи с примерами работ
Ваше резюме увидят первым!
Автоматическое поднятие на HeadHunter каждые 4 часа. Увеличьте свои шансы на успех в 10 раз!
Подключить автоподнятие