🔥

Не упустите лучшие вакансии!

Подключите наш Telegram-бот и получайте мгновенные уведомления о новых предложениях из 10+ источников. Будьте первым, кто откликнется!

Подключить бота

ML-инженер в отдел контента Маркета

Яндекс
Москва
Гибридный, Офис
Опубликовано: 06 May 2025
Яндекс Маркет — один из ведущих маркетплейсов с миллионами активных пользователей и сотнями миллионов товарных предложений.

Мы ищем специалиста в ML-команду B2B. Вы будете собирать различные выборки и обучать на них модели машинного обучения (в том числе BERT, DSSM, CatBoost, YandexGPT).

В числе задач команды — матчинг товаров, их классификация по товарному дереву, поиск ошибок и неконсистентности в товарном предложении, измерение качества партнёрского контента, сравнение различных инфомоделей и многое другое.

Какие задачи вас ждут

Сбор выборок и обучение моделей машинного обучения
Вам предстоит собирать различные выборки для обучения моделей машинного обучения, включая BERT, DSSM, CatBoost, YandexGPT. Мы постоянно разрабатываем новые инструменты, адаптируем существующие под конкретные бизнес-задачи, а также внедряем крупные ML-технологии, появляющиеся в Яндексе.

Взаимодействие с системами краудсорсинга по разметке данных для обучения
Вам предстоит работать с системами краудсорсинга для разметки данных, необходимых для обучения. Поскольку наши пользователи — продавцы, у нас нет пользовательских логов в привычном понимании. Для новой задачи почти никогда нет готовой разметки, приходится собирать её с помощью асессоров и автоматизировать этот процесс.

Исследование данных Маркета и формулирование выводов
Вам предстоит анализировать партнёрский контент — описание, параметры и прочую метаинформацию о товарах, а также историю прохождения конкретных товаров через внутренние бизнес-процессы. Необходимо делать выводы об эффективности этих процессов и искать узкие места.

Мы ждем, что вы

  • Обладаете аналитическим складом ума
  • Разрабатывали нейросети с использованием PyTorch или другого фреймворка для работы с текстами
  • Понимаете принципы работы распределённых вычислительных систем, работали со стеком Hadoop (Spark, Hive)
  • Знаете классические алгоритмы и структуры данных
  • Способны самостоятельно искать и находить ответы на вопросы, разбираться в сложных системах и сервисах, читая код и документацию
  • Хорошо знаете SQL, умеете писать сложные запросы
  • Способны быстро обучаться и воспринимать большой объём новой информации

Будет плюсом, если вы

  • Стремитесь учиться и развиваться в области анализа данных
  • Занимались продакшен-разработкой на Java
  • Работали системным аналитиком
  • Знакомы с системами Unix
🚀

Ваше резюме увидят первым!

Автоматическое поднятие на HeadHunter каждые 4 часа. Увеличьте свои шансы на успех в 10 раз!

Подключить автоподнятие