🔥

Не упустите лучшие вакансии!

Подключите наш Telegram-бот и получайте мгновенные уведомления о новых предложениях из 10+ источников. Будьте первым, кто откликнется!

Подключить бота

Data Engineer (GenAI)

Севергрупп Группа компаний
Москва
Полный день
Опубликовано: 20 Oct 2025

Десятилетиями мы создаем инновационные продукты и комплексные решения из стали. Проходим весь цикл: от добычи и переработки сырья до выпуска и продажи готовой продукции. Нас 50 000, и каждый ежедневно вносит свои идеи, опыт и профессионализм в общее дело. На работе мы осваиваем новые профессии, технологии и инструменты, растем вместе с компанией.

Мы всегда ищем людей, готовых к вызовам. Людей, которым интересно быть частью больших проектов и важно постоянно развиваться в профессии.

Обязанности:
  • проектировать и строить RAG-пайплайны (выстраивать весь цикл жизни данных для RAG: от извлечения из API (REST/GraphQL), веб-скрапинга (Scrapy) и парсинка сложных документов (PDF, DOCX) до тонкой очистки, сегментации на смысловые блоки и обогащения метаданными, настраивать и оптимизировать векторные хранилища (Qdrant, Weaviate), чтобы поиск был молниеносным и точным.
  • автоматизировать мир вокруг (взять под контроль ключевые бизнес-процессы, настроив CDC для SAP HANA и других систем, чтобы наши агенты всегда работали с актуальной информацией, а не вчерашними данными, построить отказоустойчивые DAG в Airflow/Prefect, которые будут работать как швейцарские часы, а твоя система мониторинга (Grafana/Prometheus) предупредит о любой аномалии раньше, чем она станет проблемой.
  • создавать данные из ничего (когда реальных данных не хватает - использовать LLM для генерации синтетических датасетов, создавая идеальные данные для обучения и тестирования наших агентов.
Требования:
  • имеете опыт от 1 года в роли Data Engineer и уверенно владеете Python (Pandas, PySpark) и SQL;
  • имеете практический опыт построения ETL/ELT-пайплайнов (Airflow, Prefect, Dagster);
  • понимаете полный цикл подготовки данных для RAG: парсинг, чанкинг, работа с векторными БД (Qdrant, Weaviate) и интеграция с фреймворками (LangChain, LlamaIndex);
  • имеете опыт работы с облачными сервисами и разными типами БД (PostgreSQL, S3).
    Будет плюсом:
  • участие в ML/GenAI проектах: работа с feature store (Feast), логирование экспериментов (MLflow);
  • опыт настройки мониторинга пайплайнов и данных (Grafana, Prometheus);
  • знакомы с практиками MLOps и понимание, как данные живут в жизненном цикле ML-модели.
Условия:
  • стабильность, на которую можем опираться. Официальное оформление в аккредитованной IT-компании, «белая» зарплата и ежегодная индексация, льготная ипотека и отсрочка от армии;
  • рост без потолка. Оплачиваем курсы, тренинги и сертификации, отправляем на конференции и форумы. Поддерживаем во всём, что помогает расти;
  • прозрачная мотивация. Ежеквартальные или годовые премии за результат — индивидуальный и командный;
  • здоровье в приоритете. ДМС со стоматологией + доплата по больничному от 50 до 100 %;
  • опции для родителей. Финансовая помощь при рождении ребёнка и 100 % оплата отпуска по беременности и родам;
  • допы, которые радуют. Корпоративная мобильная связь, а ещё — скидки от наших партнёров: на технику, спорт, еду, обучение и не только. Маленькие бонусы, которые делают будни приятнее;
  • атмосфера, которая заряжает. У нас не боятся пробовать новое, идеи обсуждаются на равных, а не спускаются сверху. Жёстких иерархий нет — есть свобода предлагать, менять процессы и влиять на то, что и как вы делаете.
🚀

Ваше резюме увидят первым!

Автоматическое поднятие на HeadHunter каждые 4 часа. Увеличьте свои шансы на успех в 10 раз!

Подключить автоподнятие