Data Scientist (NLP|LLM)
Что предстоит делать
Вакансия в СберЗдоровье — ведущей MedTech-компании России. Команда занимается разработкой и поддержкой медицинских языковых моделей (LLM) и NLP-решений для здравоохранения. Проект включает полный цикл работы с данными и моделями: от сбора и очистки до внедрения в продакшн. Вы будете работать с клиническими данными, строить RAG-системы, разрабатывать мультиагентные архитектуры и оркестрацию с помощью LangGraph, а также участвовать в научных исследованиях и публикациях. Технологический стек включает PyTorch, HuggingFace, MLflow, vLLM, Docker, K8s и другие современные инструменты.
Что мы ждём от кандидата
- Опыт работы в NLP/ML от 3 лет
- Уверенное владение Python: типизация, тестирование, профилирование, продакшн-код
- Опыт обучения и дообучения трансформеров: PyTorch + HuggingFace, знание Accelerate, DeepSpeed или аналогов
- Опыт построения data-pipelines и воспроизводимых экспериментов: датасеты, версии, конфиги, трекинг (MLflow или ClearML)
- Понимание LLM-систем: retrieval, tool-calling, агенты, галлюцинации, ограничения продакшна
- Навыки оценки качества: метрики, бенчмарки, error analysis, ablations, работа с разметкой и экспертной валидацией
Что предлагаем
- Сильная команда профессионалов
- Возможность развития в ведущей MedTech-компании России
- Уютный офис в Сити с панорамным видом на город
- Гибридный формат работы
- Корпоративная техника
- Медицинская программа с телемедициной, стоматологией, психологами и диагностикой
- Оплачиваемые курсы английского языка
- Поддержка активного образа жизни: корпоративные занятия и компенсация абонементов
- Обучение в СберУниверситете и оплата профильных курсов
Что мы даём команде
О Deffic
Откликнитесь на сайте работодателя.