ох, прежде чем разбирать хайп чатов c GPT от OpenAI, давайте сперва про как работают графические нейронки, переделыающие фото (например, stable diffusion, на которой lensa ai).
- нейронку обучают и она накапливает в себе фичи (features) изображений (рис 1), библиотеку элементиков
- извлечение фичей показано на рис 2 на всем понятном примере, у объектов на фото часто разные ракурсы. накапливается куча фичей (могут быть размером буквально в несколько пикселов (!).
- для разных типов объектов фичи разные (рис 3). могут быть монохромно описанные, а могут и цветные (рис 4 - слева репрезентации, справа из каких фото извлекли).
- далее можно делать синтез. вот примеры пейзажа (рис 5) или лица (рис 6)
- а ваше фото нейронка сперва превращает в ч/б репрезентацию (левая верхняя картинка на рис 7)
и
- далее рисует эту вашу репрезентацию (вашу уникальная анатомию + все это в ракурсе вашего фото) уже фичами из других стилей. на рис 7 видно, как сову рисуют стилем оригами. фон нейронка рисуют отдельно
Post #575
332







- 👍 4