Генерация иллюстраций с помощью JSON в ChatGPT и Cursor
Последнюю неделю в Twitter мне постоянно попадаются посты про генерацию рекламных изображений через ChatGPT с помощью JSON.
Механика простая:
1️⃣ Загружаешь референс-картинку и просишь ИИ описать её в виде JSON.
2️⃣ Меняешь в этом JSON нужные данные под себя - и получаешь новое изображение в том же стиле.
Я решил попробовать это для своего курса по Lovable - сделал простые карточки, и они получились вполне приличными.
Я скормил ChatGPT несколько референсов с Pinterest и попросил описать стиль, чтобы в будущем можно было воспроизводить его в новых картинках.
Дальше захотелось сделать что-то посложнее - иллюстрацию с несколькими карточками, описывающими порядок действий.
Тут уже пришлось попросить ИИ сгенерировать JSON, который бы помог ИИ детально понимать структуру картинки.
Результаты были практически “что надо”, но все время были небольшие недочеты - я попробовал десяток раз исправить это, но все было тщетно.
Появилась гипотеза: возможно, у ИИ есть минимальный размер шрифта, с которым он может адекватно работать.
Я даже сделал тест — попросил сгенерировать картинку для проверки зрения с минимально возможным текстом. ИИ нарисовал шрифт даже меньше, чем в моей картинке.
В итоге я сдался и решил сгенерировать те же карточки, но через HTML. Попробовал сразу несколько моделей:
- Claude - не подгружает Tailwind в preview.
- ChatGPT - делает все топорно.
- Gemini 2.5 - отлично и быстро генерирует нужный интерфейс и отображает с подгрузкой библиотек.
Дорабатывать код я пошел в Cursor, где можно общаться с ИИ и сразу же видеть результат + открыть его в браузере отдельным окном, чтобы сделать полноразмерный скриншот.
А как у вас обстоят дела с генерацией картинок? Есть интересные кейсы?
Post #313
1.13K




- ❤ 3
- 🔥 3