Не упустите лучшие вакансии!
Подключите наш Telegram-бот и получайте мгновенные уведомления о новых предложениях из 10+ источников. Будьте первым, кто откликнется!
Подключить ботаCrowd Solutions Architect в Yandex Crowd
Мы запустили краудсорсинговую платформу Яндекс Задания, участвовали в запуске YandeхGPT, выходе Поиска в Казахстан, обучении Алисы арабскому языку и даже шёпоту — и во многих других проектах Яндекса.
Crowd Solutions Architect отвечает за техническую и организационную сторону разметки данных: от сбора требований до анализа качества. Мы создаём решения, которые лежат в основе ML-моделей и автоматизации для сервисов с миллионами пользователей.
Сейчас мы расширяем команду и ищем специалиста, который будет проектировать процессы разметки, взаимодействовать с заказчиками, строить пайплайны и улучшать качество данных. Работа сочетает технические и управленческие задачи — примерно 50/50.
Какие задачи вас ждут
Проектирование и запуск проектов разметки данныхВы будете работать с заказчиками — командами Яндекса, которым нужны размеченные данные. Ваша задача — понять их потребности, декомпозировать задачу, спроектировать процесс разметки и подготовить техническое решение. Это может быть как простая разметка текстов, так и сложные сценарии с несколькими этапами проверки и валидации.
Построение и поддержка пайплайнов
Вам предстоит создавать и поддерживать пайплайны сбора, обработки и выгрузки данных. Это включает написание скриптов, настройку автоматизаций, интеграцию с внутренними системами и API. Вам нужно будет следить за стабильностью процессов и оптимизировать их под рост объёмов и качества.
Анализ и контроль качества
Качество данных — ключевой показатель успеха. Вы будете определять метрики, строить дашборды, проводить эксперименты и анализировать результаты. Например, оценивать скорость разметки, точность исполнителей, влияние изменений в инструкциях и обучении на итоговый результат.
Взаимодействие с командами и исполнителями
Вам предстоит координировать работу с командами-заказчиками, смежными инженерными группами и исполнителями заданий. Это включает управление ожиданиями, согласование сроков, проведение встреч и обратную связь.
Мы ждем, что вы
- Уверенно владеете Python, Java или Groovy и можете писать скрипты для обработки данных
- Умеете работать с большими файлами (JSON, TSV, CSV) и эффективно их обрабатывать
- Свободно пишете и применяете SQL-запросы для анализа и трансформации данных
- Понимаете основы инфографики и визуализации данных
- Имеете опыт взаимодействия с заказчиками (сбор требований, управление ожиданиями, фиксация результатов)
- Готовы работать в условиях быстро меняющихся требований и высокой неопределённости
- Владеете английским языком на уровне не ниже Intermediate (чтение документации, общение в письменной и устной форме)
Будет плюсом, если вы
- Работали с API и настраивали интеграции между сервисами
- Применяли методы математической статистики для анализа данных
- Запускали или настраивали проекты в Толоке
- Тестировали LLM и внедряли их в рабочие процессы
- Владеете арабским языком (это особенно ценно, учитывая наши текущие задачи по локализации и поддержке новых рынков)
- Имеете опыт в машинном обучении: создавали или обучали модели в рабочих или академических проектах
О команде
Наша команда состоит из шести CSA. Наш основной заказчик — международная Алиса, поэтому мы ведём проекты разметки не на русском, а на других языках.Мы работаем в гибридном формате, с фокусом на результат, а не на график. Процессы у нас прозрачные: все задачи в трекере, все решения обсуждаем в чатах и на встречах. Следуем принципам Agile.
Мы ценим инициативу, критическое мышление и умение работать в условиях неопределённости. У нас нет «так было всегда» — если есть идея, как сделать лучше, мы её тестируем.
Ваше резюме увидят первым!
Автоматическое поднятие на HeadHunter каждые 4 часа. Увеличьте свои шансы на успех в 10 раз!
Подключить автоподнятие