Не упустите лучшие вакансии!
Подключите наш Telegram-бот и получайте мгновенные уведомления о новых предложениях из 10+ источников. Будьте первым, кто откликнется!
Подключить ботаML-инженер в команду данных синтеза речи
Какие задачи вас ждут
Работа с даннымиВам предстоит разрабатывать систему хранения действительно больших данных и доступа к ним для ML-разработчиков. В вашем распоряжении будут петабайты аудио, которые необходимо эффективно хранить и уметь быстро обрабатывать.
Майнинг данных
Вы будете улучшать пропускную способность текущих пайплайнов сбора данных и масштабировать их для поддержки множества языков, работать с разнородными источниками и разрабатывать процессы майнинга аудиоданных.
Оценивание качества данных
Вам предстоит работать с процессами оценивания параметров данных, разрабатывать и применять ML-модели детекции шума, музыки, нескольких голосов, синтетической речи, несовпадения текста и аудио, детекции языка. Эти оценки позволят отфильтровать данные и сделать наш синтез лучшим в мире.
Больше об ML в Яндексе — в канале Yandex for ML
Мы ждем, что вы
- Пишете на Python
- Строили пайплайны сбора данных для ML
- Понимаете, как работать с большими объёмами данных
- Применяли на практике, а лучше обучали ML-модели
- Мотивированны и готовы глубоко погружаться в область
Ваше резюме увидят первым!
Автоматическое поднятие на HeadHunter каждые 4 часа. Увеличьте свои шансы на успех в 10 раз!
Подключить автоподнятие