CCareerLab
Главная/Вакансии/IT/ML-разработчик в команду Alice AI VLM ReasoningЯндекс
Яндекс
IT · Гибрид · Санкт-Петербург

ML-разработчик в команду Alice AI VLM Reasoning

До 1 годаfulltimeГибрид
Не указана
зарплата не указана в источнике
ОткликнутьсяОбновлено июль 2026 г.
ФорматГибрид
Тип занятостиfulltime
ОпытДо 1 года
О компании

Яндекс — технологическая компания, создающая интеллектуальные продукты и сервисы на основе машинного обучения: поиск, беспилотники, облако, образование и десятки других направлений.

Чем предстоит заниматься
  • Развивать RL и RLHF для VLM. Вам предстоит переосмыслить методы алайнмента на стыке визуальной и текстовой модальностей: как наградить модель за правильный визуальный reasoning, как отучить её галлюцинировать при описании изображения и как превратить продуктовые требования сервисов
  • Яндекса в функцию награды. Вы будете находить ответы на эти вопросы и внедрять решения в RLHF-пайплайн — так, чтобы поведение модели было предсказуемым, полезным и безопасным.
  • Развивать reasoning и работу с документами (OCR). Требуется выйти за пределы простых подписей к фото. Вы будете учить модель рассуждать над сложным визуальным контекстом: разбирать документы, таблицы, графики и интерфейсы, аккуратно распознавать текст (OCR) и безупречно следовать многошаговым инструкциям. Для этого предстоит собирать reasoning-данные и активно экспериментировать с UG-данными и AI-фидбэком.
  • Разгонять large-scale-обучение до предельных скоростей. RL loop для мультимодальных моделей — это один из самых сложных инженерных вызовов в современном ML. Вам предстоит ускорять генерацию на лету, профилировать узкие места и добиваться того, чтобы эксперименты крутились кратно быстрее, а GPU не простаивали ни секунды.
  • Больше об ML в Яндексе — в канале Yandex for ML.
Что мы ждем от тебя
  • Отлично знаете классические ML, NLP и CV
  • Понимаете, как устроены современные LLM или VLM, решали с их помощью прикладные задачи или имеете релевантный исследовательский опыт
  • Имеете опыт работы с RL или RLHF, post-training или мультимодальным reasoning — или готовы быстро погрузиться в эти направления
  • Следите за трендами в области LLM и VLM, умеете с ходу отличать хайп от рабочих практик и готовы быстро реализовывать новые идеи
  • Работали с reasoning-задачами, post-training или RLHF/alignment
  • Имеете опыт работы с OCR и document understanding: распознавание текста, структуры документов, таблиц и графиков
  • Обучали большие модели или large-scale ML-системы
  • Понимаете ограничения современных VLM и следите за трендами в multimodal reasoning
Как откликнуться

Нажмите «Откликнуться», заполните короткую форму и прикрепите резюме. Команда обычно отвечает в течение 3 рабочих дней.