🔥

Не упустите лучшие вакансии!

Подключите наш Telegram-бот и получайте мгновенные уведомления о новых предложениях из 10+ источников. Будьте первым, кто откликнется!

Подключить бота

Ведущий Data Scientist (Reinforcement Learning & Research)

ООО "Новые технологии"
Якутск, Россия
Удаленно
Опубликовано: 06 Aug 2025
150 000

О нашем проекте

Мы работаем над системой управления доходами (RMS). Наши клиенты - российские авиакомпании.

Задача роли

Разработать и обучить RL-агента для управления доходами авиаперевозчика на уровне рынка: многопериодное принятие решений, ценовые уровни/классы бронирования, реакция спроса, конкуренция, неопределённость.

Зоны ответственности

  • Постановка формальной задачи RL: определение пространств состояний/действий/вознаграждения, ограничений и KPI.
  • Разработка и валидация симулятора рыночной среды на основе исторических данных (реакции спроса, сезонность, шоки).
  • Исследование и внедрение алгоритмов RL/IL (value-based, policy-gradient, actor-critic, off-policy/offline RL).
  • Экспериментальный дизайн: off-policy оценка, A/B в симуляторе, подготовка к онлайн-экспериментам.
  • Инструменты качества: стабильность обучения, воспроизводимость, мониторинг метрик (reward, RM KPI, робастность к шокам).
  • Взаимодействие с продуктом/инженерией: требования, передача моделей в прод, контроль деградаций.

Ожидаемые результаты (12 месяцев)

  • Прототип агента, превосходящий базовые эвристики по целевой метрике (например, дополнительная выручка на рейс/ОД) в симуляторе.
🚀

Ваше резюме увидят первым!

Автоматическое поднятие на HeadHunter каждые 4 часа. Увеличьте свои шансы на успех в 10 раз!

Подключить автоподнятие