ML-разработчик в команду Alice AI VLM Reasoning
🔎
ML-разработчик в команду Alice AI VLM Reasoning
Привет! Я Лёша, руководитель команды Alice AI VLM Reasoning. Мы учим мультимодальные модели рассуждать: понимать документы, графики, таблицы и интерфейсы, аккуратно распознавать текст, а также доводим поведение модели до продуктового качества через RLHF. Если вы хотите драйвить мультимодальный reasoning и RL-алайнмент, работать со сложнейшими задачами на стыке текста, картинок и видео — ждём вас в команде.
Алексей Григорьев
Руководитель команды
Какие задачи вас ждут:
• Развивать RL и RLHF для VLM
Предстоит переосмыслить методы алайнмента на стыке визуальной и текстовой модальностей: как наградить модель за правильный визуальный reasoning, как отучить её галлюцинировать и как превратить продуктовые требования в функцию награды. Внедрять решения в RLHF-пайплайн, чтобы поведение модели было предсказуемым и полезным.
• Развивать reasoning и работу с документами (OCR)
Вы будете учить модель рассуждать над сложным визуальным контекстом: разбирать документы, таблицы, графики и интерфейсы, распознавать текст и следовать многошаговым инструкциям. Для этого предстоит собирать reasoning-данные и экспериментировать с UG-данными и AI-фидбэком.
• Разгонять large-scale-обучение до предельных скоростей
RL loop для мультимодальных моделей — это один из самых сложных вызовов в современном ML. Предстоит ускорять генерацию на лету, профилировать узкие места и добиваться того, чтобы эксперименты крутились кратно быстрее, а GPU не простаивали ни секунды.
Мы ждём, что вы:
• Отлично знаете классические ML, NLP и CV
• Понимаете, как устроены современные LLM или VLM, решали с их помощью прикладные задачи
• Имеете опыт работы с RL или RLHF, post-training или мультимодальным reasoning
• Следите за трендами в области LLM и VLM
Будет плюсом, если вы:
• Работали с reasoning-задачами, post-training или RLHF/alignment
• Обучали большие модели или large-scale ML-системы
Наши бонусы:
Мы заботимся о детях яндексоидов и устраиваем детские дни в офисе. Это не все бонусы —
полный список тут
.
📩
Откликайтесь на вакансию
на нашем сайте
#генеративные_технологии
#ML
#LLM
#VLM
#CV
#NLP
#RL
#москва
#питер
#белград
#гибрид
#офис
Откликнуться в Telegram →
⚠️ Никогда не платите «за оформление» или «гарантию трудоустройства» — это признак мошенников. Работа ТРУ не несёт ответственности за содержание вакансии.