Компания: Сбер
Должность: MiddleSenior/Lead CV Engineer
Вилка:
Middle: 180к -250к gross (+ годовая премия х5-х7)
Senior: 250к - 350к gross (+ годовая премия х5-х7)
Lead: 300к - 400к gross (+ годовая премия х5-х7)
Город: Москва
Контакты: @Igeti
Наша команда занимается задачами, связанными с интеллектуальной обработкой документов, созданием систем OCR/HCR, парсингом таблиц и извлечением сущностей и фактов из текстовой информации.Помимо проектов с обработкой документов, мы также создаем фреймворки для типовых задач в области CV и NLP, которыми пользуются многие команды банка.В данный момент, мы приступили к созданию No-code платформы по обработке неструктурированного контента, где бизнес сможет самостоятельно выстраивать пайплайны обработки и интеграции из готовых модулей, настраивать процесс ручной верификации и разметки, а также создавать свои модели с помощью наших фреймворков через UI.
Задачи:
— Развитие собственного движка OCR
— Создание моделей распознавания рукописного текста и текста in the wild
— Детекция и распознавания таблиц, в том числе искаженных и без видимых границ
— Определения языка текста, поворота, типа шрифта и т.д.
— Прототипирование No-code платформы для обработки неструктурированного контента (картинки, тексты)
+ для Lead позиции:
— Руководство командой из 3+ DS и разработчиков
— Выстраивание процессов разметки, обучения и деплоя моделей для команды
Обязаности:
— Имплементация и обучение моделей OCR, детекции текста, детекции объектов, сегментации и классификации
— Чтение статей и перекладывание SOTA на пром рельсы, в том числе NAS и self-supervised learning для HCR
— Запуск распределенного обучения на GPU кластере MLSpace (Кристофари)
— Организация циклов дообучения на новых данных (постановка задач разметчикам, запуск crowdsource майнинга данных и т.д)
— Оптимизация моделей для исполнения: квантизация, прунинг и дистилляция моделей. Портирование на :tensorrt: и :openvino:
— Релизы новых моделей в среды исполнения
Требования:
— Отличное знание одного из Pytorch/TF: + numpy, sklearn, pandas
— Опыт разработки/обучения/внедрения одной или нескольких типов моделей: object detection , semantic segmentation, instance segmentation, OCR, text detection, text spotting и т.д.
— Хорошее знание классического CV и OpenCV
— Хорошее знание алгоритмов, python3, ООП, SOLID, git, docker
— Желание изучать новые подходы, модели и технологии
+ для Lead позиции:
— Опыт руководства командой
— Развитые Soft skills
Плюсом будет:
— Хороший профиль на :github:
— Медальки на :kaggle:
— Опыт в GAN, StyleTransfer, Domain adaptation и NAS
Если вы сильный специалист, но не нашли подходящую вилку – пишите, обсудим.
Для отправки резюме, заполните форму: https://airtable.com/shrAGZcx9Si4boOOu
По всем вопросам писать мне в телеграм: @Igeti
Post #213
1.19K