Не упустите лучшие вакансии!
Подключите наш Telegram-бот и получайте мгновенные уведомления о новых предложениях из 10+ источников. Будьте первым, кто откликнется!
Подключить ботаСтарший LLM-разработчик в команду Нейро
Какие задачи вас ждут
Создание и улучшение реворд-моделейДля обучения генеративных моделей с помощью RL критически важно иметь хорошие реворды, которые умеют автоматически оценивать соответствие ответов требуемым свойствам. Мы обучаем дискриминативные и генеративные реворд-модели, используем все доступные современные методы для улучшения их качества: SFT, RL, ризонинг. Эта работа напрямую влияет на улучшение качества ответов для пользователей.
Обучение LLM-асессора
Мы стремимся сделать процесс оценки качества ответов более эффективным и точным. Вы будете работать над созданием LLM-агентов, которые будут помогать человеку с фактчекингом и разметкой данных, благодаря чему эти процессы станут быстрее, дешевле и даже качественнее.
Сжатие и удешевление LLM-асессора и реворд-моделей
Для обучения сильных LLM нужно большое количество данных, а значит, нам нужно запускать много процессов разметки и обучения. Вам предстоит экспериментировать с архитектурами и методами уменьшения моделей и ускорения инференса, чтобы все наши пайплайны сходились быстрее.
Подробнее про [Alice AI](https://ya.ru/ai/aliceai#section-llm)
Мы ждем, что вы
- Знаете Python
- Хорошо разбираетесь в классических DL и NLP
- Решали NLP-задачи с использованием трансформеров
- Понимаете, как устроены современные LLM, решали с их помощью прикладные задачи или имеете релевантный исследовательский опыт
Ваше резюме увидят первым!
Автоматическое поднятие на HeadHunter каждые 4 часа. Увеличьте свои шансы на успех в 10 раз!
Подключить автоподнятие