TGViewer
Data Science Work Data Science Work @datasciencework · 2.76K subscribers
Post #213 1.19K
Компания: Сбер
Должность: MiddleSenior/Lead CV Engineer
Вилка:
Middle: 180к -250к gross (+ годовая премия х5-х7)
Senior: 250к - 350к gross (+ годовая премия х5-х7)
Lead: 300к - 400к gross (+ годовая премия х5-х7)
Город: Москва
Контакты: @Igeti


Наша команда занимается задачами, связанными с интеллектуальной обработкой документов, созданием систем OCR/HCR, парсингом таблиц и извлечением сущностей и фактов из текстовой информации.Помимо проектов с обработкой документов, мы также создаем фреймворки для типовых задач в области CV и NLP, которыми пользуются многие команды банка.В данный момент, мы приступили к созданию No-code платформы по обработке неструктурированного контента, где бизнес сможет самостоятельно выстраивать пайплайны обработки и интеграции из готовых модулей, настраивать процесс ручной верификации и разметки, а также создавать свои модели с помощью наших фреймворков через UI.

Задачи:
— Развитие собственного движка OCR
— Создание моделей распознавания рукописного текста и текста in the wild
— Детекция и распознавания таблиц, в том числе искаженных и без видимых границ
— Определения языка текста, поворота, типа шрифта и т.д.
— Прототипирование No-code платформы для обработки неструктурированного контента (картинки, тексты)
+ для Lead позиции:
— Руководство командой из 3+ DS и разработчиков
— Выстраивание процессов разметки, обучения и деплоя моделей для команды

Обязаности:
— Имплементация и обучение моделей OCR, детекции текста, детекции объектов, сегментации и классификации
— Чтение статей и перекладывание SOTA на пром рельсы, в том числе NAS и self-supervised learning для HCR
— Запуск распределенного обучения на GPU кластере MLSpace (Кристофари)
— Организация циклов дообучения на новых данных (постановка задач разметчикам, запуск crowdsource майнинга данных и т.д)
— Оптимизация моделей для исполнения: квантизация, прунинг и дистилляция моделей. Портирование на :tensorrt: и :openvino:
— Релизы новых моделей в среды исполнения

Требования:
— Отличное знание одного из Pytorch/TF: + numpy, sklearn, pandas
— Опыт разработки/обучения/внедрения одной или нескольких типов моделей: object detection , semantic segmentation, instance segmentation, OCR, text detection, text spotting и т.д.
— Хорошее знание классического CV и OpenCV
— Хорошее знание алгоритмов, python3, ООП, SOLID, git, docker
— Желание изучать новые подходы, модели и технологии
+ для Lead позиции:
— Опыт руководства командой
— Развитые Soft skills

Плюсом будет:
— Хороший профиль на :github:
— Медальки на :kaggle:
— Опыт в GAN, StyleTransfer, Domain adaptation и NAS
Если вы сильный специалист, но не нашли подходящую вилку – пишите, обсудим.

Для отправки резюме, заполните форму: https://airtable.com/shrAGZcx9Si4boOOu
По всем вопросам писать мне в телеграм: @Igeti
Airtable Airtable | Everyone's app platform Airtable is a low-code platform for building collaborative apps. Customize your workflow, collaborate, and achieve ambitious outcomes. Get started for free.
More from @datasciencework
  1. Sep 4, 2025#вакансия #job #работа #python #pytorch #llm #datasets #api #gpt #llama #prompt Вакансия:…
  2. Jun 20, 2024#вакансия #vacancy #relocation #Python #PyTorch #NLP #AI Position: AI Engineer Company: al…
  3. Nov 17, 2023Компания: wunderfund.io Должность: Data Infrastructure Researcher Вилка: $4k-$8k net Форма…
  4. Nov 17, 2023#вакансия #разработка #базыданных #postgresql #sql #fulltime #офис #строительство 🙂 Разра…
  5. Nov 16, 2023Компания: Контур Должность: TechLead Research Engineer: NLP/Speech Вилка: от 400 00…
  6. Nov 16, 2023#вакансия #vacancy #удаленка #разработчик #dataengineer #etlengineer #sql #датаинженер Ком…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →