Мои хорошие друзья сейчас в поиске кандидатов для расширения команды, занимающейся разработкой методов синтеза сценарного видео💪
Мы строим сложную мультимодальную систему, которая превращает текстовые инструкции в готовые ролики. От идеи до финального видео — через генерацию изображений, видео, аудио и оркестрацию всех процессов.
Технологический стек:
📍Бэкенд & Оркестрация: FastAPI, PostgreSQL, Redis
📍Фронтенд: Vue.js
📍ML-сервисы: генерация изображений (text-to-image/image-to-image), видео (text-to-video/image-to-video), TTS, lipsync, LLM
📍Инфраструктура: MinIO, FFmpeg, on-prem GPU-кластеры, мониторинг, CI/CD
Кого ищут (middle/senior):
📍ML-инженер (Video-Gen)
📍ML-инженер (Image-Gen)
📍ML-инженер (LLM / сценарный ассистент)
📍ML-инженер (TTS / V2A / TTA)
📍DevOps / MLOps
📍Data-инженер
📍Фронтенд-разработчик (Vue)
📍Разметчик данных (изображение/видео/аудио/тексты)
Что будете делать (коротко):
📍Генерация видео/изображений со стабильными персонажами и стилем, lipsync и AV-синхронизация
📍Персонализация (LoRA/PEFT), ускоренный инференс и профилирование GPU
📍Сценарный движок на базе LLM: JSON-структуры, валидации, интеграции с ASR/TTS
📍Промышленный контур: упаковка моделей как сервисов, CI/CD, мониторинг
Условия:
📍Оформление по ТК, конкурентная з/п
📍Современная on-prem инфраструктура, собственные дата-корпуса, доступ к вычислительным ресурсам
📍Прямое влияние на архитектуру продукта и модельный стек
📍Возможен удалённый формат работы из регионов РФ
⚠️Если заинтересовало и появились вопросы — пишите в ЛС @jganeeva.
Буду благодарен за репосты🙏