Продолжаем тему Изобретения №3
=> Немного о стыке цифрового мира с аналоговым
Как мы знаем, существующие нейросети основаны на вероятностях и, как следствие, могут лишь предположить, что следующий бит информации будет к месту рядом с предыдущим. Отсюда шестые пальцы у людей на генерируемых картинках, инструкция по использованию стоп-крана в самолёте и подобные этому ляпы. Поэтому особой вехой в развитии генеративных алгоритмов является представление нарисованного в физическом мире.
=> При чём тут лапа
Несмотря на то, как бы нам хотелось, объекты физического мира нельзя заменить в мгновение ока и к их созданию \ модификации нужно подходить очень точно и вероятностный подход здесь может быть не просто не полезен, но даже опасен, если мы говорим, например, о переноске морских контейнеров над головами людей. Поэтому потренироваться лучше, конечно, на кошках и перед тем, как ставить задачи по добавлению эвристики в управление чем-бы то ни было за пределами песочницы в виде нашего монитора, мы задались вопросом о том, как же можно сопоставить картинки, получаемые с камеры и мир.
=> Что накопали
Уже сейчас есть несколько вполне боевых попыток создания 3D моделей с помощью алгоритмов:
- https://habr.com/ru/news/857768/
- https://habr.com/ru/news/865104/
- https://www.lookx.ai/
Однако, это лишь только доказывает возможность экспорта результата подсчёта вероятностей в виде графической репрезентации, но мало помогает нам в наших исследованиях.
Поэтому мы пойдём длинным путём - всё это придётся делать через карту глубины.
Мы даже нашли примеры, как это можно сделать руками (на видео) и автоматизированно с помощью других алгоритмов: https://github.com/HarendraKumarSingh/stereo-images-to-3D-model-generation/tree/master.
И в ближайшее время мы будем изобретать велосипед, который позволит создать среду для моделирования.
Немного о лапе: https://t.me/gen_xt/210
В эфире снова был Genesis 🎤
#genesis #генезис #встреча #genesis_gadget #gadget_3
Post #231
225

