Нет, я серьезно. Вас не восхищают работы ригеров? Это когда статичную картинку режут на слои и добавляют в них жизнь?
Самые крутые работы это гипер плавные движения волос, мимика, движения тела. Кто видел мои рабочие столы или фулл из стима (V епта) — это же экстаз.
И вот у меня с момента личных скриптов и вокрфлоу в ComfyUI было понимание, как же сделать свои обои анимированные (пример сверху).
Однако, сука, то шайтан меня убеждает играть 164 часа в Crimson Desert, то надо бы пойти деньги заработать, то контент делать.
Но вот я дорвался до того, чтобы сделать свои обои и опубликовать их в Steam, чисто по приколу. А для вас написать гайд.
Первым делом: Агент + инстанс
Нам нужно нашему кодексу-клоду-дипсику объяснить, что мы будем разворачивать воркфлоу на арендованном железе.
И можно взять уже чужие штуковины с такого сайта как Civitai, можно поискать в комментах мой слитый личный воркфлоу под Anima или зайти ко мне в приватку (там их 40+ кастомных).
Но нас интересует связка
Любой генерации аниме артов (Anima) + какой-то воркфлоу плавных луп анимаций на какой-то видео модели, допустим wan (например этот).
Когда все нужное мы нашли, дело остается за малым. Агента просим составить скрипт развертки, который просит от нас 2 API ключа от HuggingFace и упомянутого Civitai (для прона .red), ибо без этих ключей не получится скачать бесплатные модельки и воркфлоу.
При необходимости можно попросить иишку исправить воркфлоу, например преднастроить параметры или поменять исходящее разрешение картинки.
Затем создаем SSH ключ для арендованного инстанса, в моем случае это сервис Vast.ai с видяхой 6000 и диск на 100гб чтобы все влезло. По этому ключу наша LLM идет сама на инстанс.
Ну и на счет самого инстанса, там дохуилярд нюансов. Уж перессказывал полутора часовый стрим из моей приватки я не буду, но гайдик вам солью.
Теперь садимся делать
В моем text2image воркфлоу дергаем ползунки на широкоформатную картинку, подбираем связку LoRA по стилям художников и обработке.
Так и быть, боярин слил фулл кастом самописный воркфлоу со всеми прописанным инструкциями по этой ссылке.
Скачиваем картинку из конца узла, переключаемся на следующий, а именно тот, что будет делать нам loop анимацию. В нем обычно надо поменять число кадров/fps/"агрессивность".
Типо создавать ли много движений или персонаж в кадре чуть-чуть двигается и все. В промпте описываем как будет меняться сцена и вуаля.
Кстати, в ComfyUI можно отдать Hermes, например, уже настроенный узел. ПКМ по вкладке и выбрать API, скачиваем json и кидаем агенту.
Так мой Deepseek внутри Hermes накидывал сам промпты и сам запускал генерации, а потом кидал в личку готовые изображения.
Что по итогу?
Примерно один доллар в час и примерно 20-40 минут на один готовый ролик.
Но если вы не знаете, что вам нужны конкретные параметры и воркфлоу.:
- Motion Pass Steps 2
- Generation Steps 8
- Resolution Multiplier 2
- Video Frame Multiplier 4
То конечно все тесты, прогоны займут несколько часов или примерно сутки (емодзи клоуна хомяка). Тут еще надо промпт подходящий вашей задумке надо составить.
Ну и в итоге подрезать видос на 0.5 сек, чтобы сократить резкий переход aka дрифт статики в нейро-анимацию. Чтобы весь стиль был единым.
Мне кажется, что мы пока в "рановато" чтобы заменить работу подобных людей, но уже близко.
Да и работа ригера обойдется в 5-10 раз дороже, пускай результат будет лучше, но без вау. Вопрос как справятся платные модели. Бесплатные вот так справляются.
А так чисто ультимативно на локальных моделях вы не скованны ничем, поэтому не будет проблем с промптом "трогает груди эдакая блудница".
Но да, надо озадачиваться вопросом развития новых навыков, привыкнуть к ComfyUI, еще и карточку Zarub оформить для оплаты.
Напоминаю, что мои обои для Wallpaper Engine лежат по этой ссылке и это точно не китайская мальвар, верь мне.
А я со всех рефок в этом посте куплю пачку доширака и сделаю на один десяток аниме