Высокое разрешение
Когда SD только вышел, меня немного разочаровало маленькое разрешение изображений, на которых была обучена модель, и как следствие разрешение картинок, которые она по умолчанию лучше всего генерит. Это всего 512 x 512 пикселей. При попытке увеличить разрешение, возникала всем известная проблема, с двухголовыми персонажами, повторяющимися объектами и т.д.
С тех пор вышло много инструментов, которые позволяют делать изображения высокого разрешения. Сначала это были многочисленные ИИ-апскейлеры на базе GAN, и Хайрез Фикс, который начинает генерить изображение в низком разрешении, а потом переключается на более высокое, но не слишком, иначе может кончиться видеопамять. Потом появился
Ultimate SD Upscaler, который после апскейла режет изображение на мелкие куски, которые нейронка может переварить, их обрабатывает по отдельности, и потом обратно сшивает. Этот метод позволяет делать изображения вообще любого разрешения, если у вас есть время ждать просчета всех тайлов.
Проблемой этого метода было то, что за раз нейронка видит только тот тайл, с которым работает, и забывает про общую картину. Т.е. если вы, например, апскейлите Бетмена, и сейчас нейронка обрабатывает подмышку Бэтмена, то она будет пытаться там разглядеть целого отдельного Бэтмена. И я вам гарантирую, ей это удастся. Т.е. она по сути не решала проблему с двойными головами, а усугубляла ее. Поэтому люди советовали менять промпты, чтобы в них не упоминался основной объект, ставить денойз поменьше, чтобы лучше сохранялась первоначальная композиция. И надо сказать, иногда получалось вполне достойно.
А потом вышел Tile ControlNet, который не дает нейронке забывать общую картинку. О нем в следующем посте.
Я хотел приложить картинку с
Бэтменом из Бэтменов, чтобы проиллюстрировать, как не надо делать, в итоге поработал по ней немного инпэинтиногом, чтобы скрыть швы между тайлами, и очень даже интересно получилось.
#текст