
Job description
Центр Исследований занимается созданием SoTA технологий искусственного интеллекта для анализа финансовых данных и их применения для AI-трансформации Блока Риски. Наша задача разработать и обучить мультимодальную reasoning модель, объединяющей текстовые данные и цифровые следы клиентов для улучшения качества решений банковских задач.
- проводить генерацию и очистку синтетических данных с использованием LLM и LLM-as-a-Judge подходов
- обучать большую мультимодальную LLM (текст + цифровые следы клиентов)
- применять RL подходы для улучшения reasoning способностей модели
- выполнять валидацию на современных бенчмарках разработанного решения с точки зрения точности и корректности рассуждений
- оценивать решения на real-world данных.
Железо и данные:
-
выделенный кластер 500+ GPU A100 80GB
-
Spark/Hadoop для работы с Big Data
-
доступ ко всем банковским данным, необходимым для построения решения.
-
опыт работы от 3-х лет
-
глубокие знания ML/DL (в частности, трансформеры, большие
языковые модели)
- уверенный опыт обучения LLM моделей
- уверенные знания Python: torch, transformers, peft
- Английский B2+.
Будет плюсом:
-
опыт работы с мультимодальными моделями
-
знание методов RL для LLM (RLHF, DPO, GRPO, RLVR, GSPO)
-
опыт распределенного обучения больших моделей (FSDP, ZeRO, Mixed-precision, Tensor/Pipeline Parallelism)
-
публикации в топовых журналах (Q1) или конференциях (A-A*).
-
комфортный современный офис м. Кутузовский пр. или м. Волгоградский проспект
-
формат работы - офис
-
годовая премия
-
корпоративный спортзал и зоны отдыха
-
более 400 образовательных программ СберУниверситета для профессионального и карьерного развития
-
регулярные митапы и развитое DS-community
-
расширенный ДМС, льготное страхование для семьи и корпоративная пенсионная программа
-
гибкий дисконт по ипотечному кредиту, равный 1/3 ключевой ставки ЦБ
-
бесплатная подписка СберПрайм+, скидки на продукты компаний-партнеров
-
вознаграждение за рекомендацию друзей в команду Сбера.