Недавно исследователи из Швейцарской высшей технологической школы представили алгоритм, который позволяет создавать изображения на основе текстовых описаний и эскизов. Но чем отличается именно эта нейросеть от всех других примеров?
Ее особенность состоит в том, что она распределяет объекты по разным планам. Сначала она создаёт фон, затем — объекты на переднем плане. Это позволяет избежать искажений объектов и фона, которые неизбежно возникают при редактировании изображения.
Результат работы новой нейросети вы можете увидеть на анимации выше, подробная информация и код доступны на GitHub: https://github.com/dariopavllo/style-semantics
Post #171
1.08K