Генерировал всякие практические изображения по работе и пришел к выводу, что меня все больше волнует отсутствие творчества в работе и вот почему:
1) Результат непредсказуемый и фактически никак не зависит от глубины промта в случае с генерацией изображений (как бы вы там промт не описывали и не переписывали)
2) Вариантов и стилей генерации может быть слишком много (это затрудняет выбор)
3) Конечная композиция часто не требует правок, что ставит под вопрос наличия компетенций у специалиста (а когда все-таки требуются правки?)
4) Модели все еще лучше считывают контекст из английского текста при составлении простов, что как бы добавляет еще один пласт неопределенности в конечный вывод
Выходит так, что клепать картинки и даже цельные композиции из нескольких объектов в сцене достаточно просто на приемлемом для production уровня, но получить именно то, что ты хочешь, — это уже большая проблема и игра в черный ящик. Меня здесь смущают наличие хаоса и неконтролируемый результат генерации
На все это накладывается бездонная гора стилей генерации; все это хочется попробовать, протестировать. Мало того, что это отнимает больше времени, так еще и не приближает к выстроенному решению
В любом случае, это уже не ваш острый глаз и дизайнерский взор, а какая-то компиляция всех дизайнерских трудов. Так еще и результат генерации может координально отличаться даже при одинаковом промте
Резонно будет заметить, что в Stable Diffusion можно настроить сцену, модели, типы рендера и еще миллион параметров своими руками, но извините, что не испытываю удовольствия от генерации 99 практически одинаковых изображений для того, чтобы выстрадать идеальный промт и настройки. Да и каким образом настройка каких-то там крутилок, нод и цифр приближает нас к контролю над конечным результатом?
Попытка контролировать даже неконтролируемое (систематизировать, упорядочить и тд) присутствует практически у любого человеческого создания
Промт можеть быть любой, все равно результат рандомный. Все попытки обучать людей писать промты для изображений — это, конечно, супер. И какая-то базовая база там может быть, чтобы не было совсем ужаса на выходе, но это все равно выглядит, как попытка
систематизировать действия и выводы бессистемной генеративной модели
Даже если отбросить контроль, то какие компетенции нужны от человека, который рисует дизайны в интернетах теперь?
Вот давайте представим, что мы продаем мед и отделу маркетина очень нужна реклама для всего: таргет, баннеры на сайт, билборды, оформление для социальных сетей
Мы подбираем референсы на pintrest (или где-нибудь еще), приходим в chat gpt и вводит: «вот компания такая-то, занимаемся этим и этим, нужны вот такие вот баннеры, вот референсы прикрепляю, предложи пару идей для визуальной идентичности бренда»
На выходе мы получим какие-то изображения, делаем upscale
Купим подписку на Photoshop и вычистим артефакты генеративным заполнением или заменим там деталь где-нибудь
Выясним размеры и формат, который нужен для печати или чего-либо еще
Добавим в сцену еще какую-нибудь генерацию, текст, кнопку и сможем выдохнуть, потому что не true дизайнеры даже до данного этапа дойти не смогут нормально
Немного сумбурно вышло, но это попытка отрефлексировать процесс повсеместного внедрения ai и, как следствие, замену творчества на лотерею