Количество проектов, занимающихся генерацией изображений по тексту, все увеличивается и увеличивается. Сейчас набирает популярность еще один - Stable Diffusion от stability.ai. Отдельного сайта у проекта пока нет, доступ - ограничен (но если постараться - получить можно). Но из тех нарисованных картин, что выложены в сеть, выглядит как достойный конкурент Dall-E.
По обзорам выглядит, что стилистика - ближе к стилю Midjourney, сказочно-мультипликационному, чем к фотореалистичному стилю Dall-E. Но мои тесты показали, что и в фотореалистичность Stable Diffusion умеет. В числе других отличий от конкурентов - заявлены более слабые фильтры запросов, что позволяет генерировать, например, более вольные картинки. Или изображения с лицами известных личностей. Другие виды фильтров - пока обсуждаются, но насилие или слишком вольные картинки (вы поняли, да) явно будет запрещено и тут.
Погоняв Stablfe Diffusion, мне показалось что у нее менее богатое воображение, чем у Dall-E, но это только первое впечатление. Если вы помните предыдущую статью, самое главное при работе с нейрохудожниками - умение правильно составить запрос. А так же очень много времени. (Когда-нибудь на пенсии автор блога, не умеющий рисовать руками, станет AI художником, творящим чудеса запросами, а пока…)
А пока вот вам по-быстрому нарисованный с помощью Stable Diffusion котенок на пляже, и он желает всем хорошего дня:
Post #77
8.66K