TGViewer
Работа в ИТ Работа в ИТ @workayte · 12.6K subscribers
Post #3969 926
#вакансия #удаленно #россия

Data Scientist (NLP|LLM) в крупнейшую в России Digital Health платформу, объединяющая различные сервисы цифровой медицины.

Компания рассматривает кандидатов только из России
З/п: обсуждается индивидуально.
Формат работы: Офис, Гибрид(Москва,уютный офис в БЦ Симонов Плаза с видом на Москва-реку);
Удаленка
.
Уровень позиции: Senior

🔷Задачи:
Проектировать и поддерживать полный цикл улучшения медицинских LLM: сбор, очистка, версионирование данных, обучение и дообучение (SFT, preference-tuning, DPO/ORPO, instruction tuning).
Строить датасеты и контуры разметки: схемы и гайдлайны, контроль согласованности, генерация синтетических данных, self-training, анализ ошибок и bias.
Разрабатывать LLM-based пайплайны и агентов для медицинских задач: RAG по клиническим рекомендациям и справочникам, tool-calling, маршрутизация, multi-step workflows, оркестрация (LangGraph и мультиагентные фреймворки), guardrails.
Создавать и развивать систему оценивания: тест-наборы и бенчмарки, автоматические метрики и LLM-as-a-judge там, где уместно, экспертная валидация с врачами, red-teaming, регрессионные прогоны, A/B тестирование в проде.
Проводить исследовательские итерации: формулировать гипотезы, ставить эксперименты, делать ablation-исследования, документировать результаты, готовить научные статьи и доводить материалы до публикации.

🔷Обязательные требования:
3+ лет в NLP/ML, уверенный Python: типизация, тестирование, профилирование, аккуратный продакшн-код.
Практический опыт обучения и дообучения трансформеров: PyTorch + HuggingFace, понимание Accelerate, DeepSpeed или аналогов.
Опыт построения data-pipelines и воспроизводимых экспериментов: датасеты, версии, конфиги, трекинг (MLflow или ClearML), умение делать корректные сравнения.
Понимание LLM-систем: retrieval, tool-calling, агенты, деградации качества, галлюцинации, ограничения продакшна.
Навыки оценки качества: метрики, бенчмарки, error analysis, ablations, работа с разметкой и экспертной валидацией.
Опыт в медицине или биомеде: клинические тексты, ICD-10, клин. рекомендации, понимание доменных рисков.
Опыт alignment: preference data, RLHF, DPO, safety eval, hallucination mitigation. Практика продакшн-инференса: vLLM, оптимизация стоимости и задержки, Docker, K8s, мониторинг, трассировка.
Опыт с retrieval-стеком: hybrid search, rerankers, FAISS, Elastic, pgvector, продуманноеchunking, grounding.

Отклики ждём @fr_rec

--
[< Подпишитесь на канал «Работа в ИТ» >]
More from @workayte
  1. Sep 22, 2026🚀 Ищем специалиста технической поддержки (Junior+) Мы — B2B SaaS-компания. Развиваем прод…
  2. Sep 18, 2026#вакансия #job #senior #fulltime #Lead #Data #Engineer #Platform #Ереван #РФ ✅Ищем Lead Da…
  3. Sep 18, 2026#вакансия #customersupport #supportengineer #technicalsupport #healthtech #startup #fullti…
  4. Sep 18, 2026Ищем в команду Geo-ML инженера Что обязательно: - Классический ML на табличных данных: бус…
  5. Sep 17, 2026На проект ведущего банка России, требуется Системный аналитик. Проект создание платформы P…
  6. Sep 17, 2026#vacancy 🚀 C++ Developer (Middle) 📍 Минск | Full-time | Office / Hybrid 💻 Опыт: от 3 ле…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →