TGViewer
attention deficit attention deficit @papers_please · 202 subscribers
Post #16 406
📄 MUNIT: Multimodal Unsupervised Image-to-Image Translation [ECCV 2018]

Авторы работы добились мультимодальной генерации картинок между двумя доменами. Теперь не нужно обучать модель для каждой пары пород собак, т.к. порода — это просто стиль собаки 🐶

Для этого общее латентное пространство разделяется на 2: content и style, причём общим остаётся только content-пространство, а style-пространство своё у каждого домена. Сэмплируя стиль при генерации, авторы получают разные результаты.

Также в работе есть несколько теоретических результатов, наиболее важный из которых — доказательство, что cycle-consistency приводит к дельта-функциям распределения латентных кодов и как следствие к унимодальным результатам генерации.

10 эмбеддингов стиля из 10: https://teletype.in/@ploshkin/munit
Teletype MUNIT: Multimodal Unsupervised Image-to-Image Translation https://arxiv.org/abs/1804.04732
More from @papers_please
  1. Aug 12, 2026произошли два леген-wait for it-дарных релиза от нашей службы: 1. gryphon — от слова gener…
  2. Jul 6, 2026Про аватарку канала Если присмотреться, то можно заметить, что это не нормальная картинка,…
  3. Jul 6, 2026с содержательными постами перерыв, пока будет развлекательный контент
  4. Jun 20, 2026Как продать картину подороже? Допустим, вы хотите продать картину. Её себестоимость — это…
  5. Jun 15, 2026Ранжирование по eCPM Вернёмся к вопросу о том, как ранжировать объявления. Во вводном пост…
  6. Jun 14, 2026Дизайн механизмов Итак, аукцион решает проблему распределения слотов между рекламодателями…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →