TGViewer
Channel Public Channel
VideoLab & Self-Motivated Learning

VideoLab & Self-Motivated Learning

@vgcourse

Канал лабораторий машграфики ВМК МГУ, анализа видео института ИИ МГУ и анализа видео университета Иннополис.

О том, как меняется DL-мир и как заставить себя прокачиваться, чтобы успевать за ним.

А лучше не просто успевать, а быть в числе лучших)
Subscribers
1.29K
Photos
381
Videos
31
Links
322

Showing posts older than #180 · Back to latest

Older Posts 19 shown
Post #178 1.31K
Господа, сегодня Сергей расскажет про наш новый бенчмарк, ссылку на который я кидал выше, будучи в хорошей компании докладчиков)))
  • ❤ 1
Post #177 1.29K
Господа!

Сегодня на собрании сотрудников факультета многолетняя работа вашего покорного слуги и вверенного ему коллектива была отмечена деканом! 💃✌️💃

Приятно! 🙂
  • 🔥 18
  • 🎉 4
  • ❤ 1
Post #176 1.25K
Господа!

Я про это пока не писал, а у нас идет весьма интересный проект. Сейчас нейросети конкретно добрались до сжатия картинок и уже два года идет процесс разработки стандарта JPEG AI. Это зимой мы работали над метриками артефактов нейросетевого сжатия (они иногда довольно прикольно галлюцинируют, причем сильно не всегда это можно легко задетектить). В конце весны мы сильно интенсифицировали этот проект (в том числе выделили 400 тысяч рублей на разметку артефактов на Толоке), а в июне я вошел в состав экспертов стандарта, мы получили доступ к исходникам драфта JPEG AI и начали гонять наши метрики на них.

Видео (ниже) для Науки PRO мы записали в начале июня, но при монтаже добавили в него реальные косяки JPEG AI (наслаждайтесь одними из первых в мире 😉😂🤣). Датасет артефактов нейросетевого сжатия планируем опубликовать этой зимой. Ну и понятно, что в картинки пошли, чтобы быть лучше готовыми к аналогичным проблемам в видео (ибо работы в области нейросетевых кодеков уже идут и там мно-о-о-о-ого чудного и фееричного 😨☺️😉)))

Кратко за 22 минуты про эволюцию сжатия картинок в 21 веке:
https://youtu.be/OrikOKilifU
YouTube От JPEG и JPEG 2000 к JPEG AI | Сжатие изображений в XXI веке – Дмитрий Ватолин | Научпоп Кто и когда разработал формат JPEG? Почему при сжатии изображений могут возникать артефакты? Какие преимущества у формата JPEG перед другими? Существует ли сегодня проблема сжатия картинок и насколько остро она стоит? Какие форматы сжатия изображений существуют…
  • 🔥 2
  • 👏 1
Post #175 1.09K
Коллеги!

Из наших неопубликованных новостей. На сайте «Истовый инженер» (сайт про инженерные профессии с упором, внезапно, на Software Engineer) вышло мое интервью. 😁

В начале они зачем-то хотели "про то, как все начиналось" поспрашивать. Так что кому интересно про то, как создавалась лаборатория компьютерной графики на ВМК - велкам. А дальше про развитие стереокино (в том числе наш вклад), про сравнение кодеков (самый известный в мире наш проект), про бенчмарки и взлом метрик качества. В общем - про нашу активность.

Го читать! 📖😉
Истовый инженер 3D-мигрень, стереослепота и бенчмаркинг по-русски: эксперт по обработке видео о трендах в профессии Видео занимает более 80% интернет-трафика в современном мире, и эта доля постоянно растёт. Увеличивается разрешение и глубина цвета кадра, качество съёмки смартфоном стремительно приближается к профессиональному. Если в 2000-х трансляция в Full HD требовала…
  • 🔥 5
  • ❤ 1
Post #173 1.19K
Коллеги!

Когда мы набираем студентов меня иногда спрашивают, а я регулярно подчеркиваю, что мы любим девушек.

Раскрываю причины! 😉

Статья FAST ADVERSARIAL CNN-BASED PERTURBATION ATTACK ON NO-REFERENCE IMAGE QUALITY METRICS у нас зашла на ICLR (которая входит в ТОП-3 The Most Important AI Conferences 2023, т.н. AI Core A*), при то, что в авторах, как легко заметить выше - две наших замечательных девушки. Причем Екатерина - первый и основной автор - только что закончила бакалавриат (!!!).

Деликатно замечу, что у нас аспирантов с хотя бы просто с А* по пальцам одной руки на факультете (поправьте меня, если вдруг чего не знаю). Да, тут Tiny, но и основной автор - бакалавр! Ну и недавно Tiny track решили включить в труды (это увеличит их цитирование). Йе-е-е-е-е! 🥳

Пруф: https://dblp.org/rec/conf/iclr/ShumitskayaAV23

В общем девушек мы очень любим, особенно таких классных! 💐🙂
  • ❤ 10
  • 👍 5
  • 🤔 1
Post #172 1.04K
Господа!

Что-то я наши новости не кидаю, а они таки у нас есть!

Так у нас ОПУБЛИКОВАН НОВЫЙ (15-й по счету!) бенчмарк MSU Metrics Robustness (пока бета)! 👍

В нем 15 метрик качества видео и картинок проанализированы на предмет устойчивости к 9 видам состязательных атак, включая популярные FGSM-based, толкаемые в т.ч. нами Universal Adversarial Perturbation-based и Perceptual-aware атаки.

Внимательный читатель заметит, что в соседнем бенчмарке у нас 49 метрик качества в лидерборде, так что есть куда расширять (другое дело, что это огромная работа).

У этого бенчмарка самая большая команда (большинство других делало 1-2 человека). Потенциально - это безмерно интересный бенчмарк, который может стать одним из наших самых звездных.🆒

Интересно, что тема непреднамеренного взлома (когда метрика в loss непреднамеренно ломается при обучении сети, т.е. при обучении находятся недостатки метрики, а не улучшается модель, чего обучающий может сразу не заметить) постепенно становится все более и более популярной. На КДПВ (который чуть-чуть виден на скриншоте выше) видно, как нейросетевая метрика почти в 4 раза (эпичный пример!) поднимается взломом, портя при этом картинку, а не улучшая ее, как должно быть при улучшении метрики. И у нас есть шанс глубоко прокопать эту интереснейшую тему! 👍

Публикация была привязана к отдаче статьи, углубление работ продолжается (в частности сейчас уперлись в потолок по вычислительным мощностям). Не будем останавливаться на достигнутом! 😁
  • 🔥 8
  • ❤ 1
Post #171 1.05K
Господа!

К вопросу о публикациях бакалавров.

Сегодня у нас приняли 2 статьи наших бакалавров (выделены ниже) на EUSIPCO 2023!

Dear Nikolai Karetin, Ivan Molodetskikh, Dmitriy Vatolin,

Paper ID: 1751
Title: PERCEPTUAL SUPER-RESOLUTION BENCHMARK WITH DEEP FULL-REFERENCE METRIC FOR PAIRWISE QUALITY ASSESSMENT

The review process for the 31st European Signal Processing Conference (EUSIPCO 2023) has now been finalized, and it is our pleasure to inform you that your paper has been accepted for publication. Congratulations!

Dear Egor Chistov, Nikita Alutis, Maxim Velikanov, Dmitriy Vatolin,

Paper ID: 1728
Title: COLOR MISMATCHES IN STEREOSCOPIC VIDEO: REAL-WORLD DATASET AND DEEP CORRECTION METHOD

The review process for the 31st European Signal Processing Conference (EUSIPCO 2023) has now been finalized, and it is our pleasure to inform you that your paper has been accepted for publication. Congratulations!

Но это не все. Недавно статья Екатерины Шумицкой зашла на ICLR Tiny! (на секундочку, это А*)

Публикаций бакалавром первым автором на конференциях такого уровня у нас пока не было! И, очевидно, в этом большая заслуга Насти Анциферовой!

У нас цель - как минимум по Scopus у каждого бакалавра (первым автором). 3 статьи бакалавров за неделю, включая ICLR Tiny - хорошо приближают к этой цели! )

Горячие поздравления авторам! 🥳🎉🥇🏆🎉🥳
  • 🎉 14
  • 🔥 7
Post #170 1.13K
Господа!

ВТОРУЮ НЕДЕЛЮ ПОДРЯД ТОЛЬКО ЗАВТРА (26го апреля, среда)! И ТОЛЬКО В ЛАБОРАТОРИИ!

Для проекта Huawei мы СНОВА арендуем большой HDR телевизор! Большая просьба подойти c 11:30 до 18:00 в 702 и посмотреть на нем мультики и покушать мятные пряники и мармеладки) (мультики новые, будут интересны даже тем, кто был в прошлый раз)

Вопросы (по координации) писать теперь по другому адресу https://t.me/ANDRYH4

Ваше беспристрастное мнение о качестве контента внесет ЕЩЕ БОЛЕЕ неоценимый вклад в улучшение HDR 4K видео ближайшего будущего! 😉
  • 🔥 14
  • 🤔 2
  • 😢 1
Post #169 1.31K
Post #168 1.09K
Господа!

ТОЛЬКО ЗАВТРА! И ТОЛЬКО В ЛАБОРАТОРИИ!

Для проекта Huawei мы арендуем большой HDR монитор! Большая просьба подойти с 10:30 до 15:30 в 702 и посмотреть на нем мультики и покушать мятные пряники) (с чаем!!!))))

Вопросы (по координации) писать https://t.me/nickossaf

Ваше беспристрастное мнение о качестве контента внесет неоценимый вклад в улучшение видео ближайшего будущего! 😉
  • 🔥 5
  • 🤩 2
  • 👍 1
Post #167 1.07K
Кому интересно в режиме реального времени наблюдать, как китайцы захватывают мир 😉 (в области видеокодеков) - вот предельно свежий анонс (выложен только что) о релизе двух наших сравнений кодеков, сделанный специально к NAB Show. В двух словах - они движутся без лишней PR шумихи, но широким фронтом (несколькими компаниями) и довольно мощно.

https://www.linkedin.com/pulse/msu-video-codecs-comparison-hardware-cloud-released-dmitriy-vatolin/
Post #166 1.01K
Ну и чтобы 2 раза не вставать на тему LLM)

Выше график роста успешности предложений GitHub Copilot за 3 и 4 кварталы прошлого года (график отсюда). Видно, что в 4 квартале рост ускорился.

Вопрос: что будет, если они добавят +20% за 4 квартала этого года? )))

Понятно, что это непросто, но с другой стороны если кто следит, как GPT штурмует CodeForces и LeetCode, там очень впечатляющий прогресс за последние 1,5 года. А в этом году вложения в тему выросли чуть не на два порядка (только OpenAI получила 10 миллиардов долларов инвестиций, что не может не сказаться на скорости их работы).

Из свежего - Amazon недавно предложила свой Amazon CodeWhisperer совершенно бесплатно:
https://aws.amazon.com/ru/codewhisperer/
Понятно, почему они так делают - им нужны данные для обучения и совершенствования. Но тенденция и конкуренция налицо!

Что это означает для вас... 🤔

Помню 4 года назад я спорил с дизайнером по поводу прогресса нейросетей (тогда только-только нейросети мазки кистей повторяли). Дизайнер мне не верил, что их профессия сильно пострадает. Сегодня это факт.

Два года назад я спорил с копирайтером, что нейросети их потеснят. Он мне говорил "Яндекс Балабол - это просто смешно!". Хорошо смеется тот, кто смеется без последствий... Сегодня их профессия почти накрылась.

Я с огромным удовольствием поспорю (желательно публично, чтобы материал для хабра был))), что в ближайшие 3-4 года структура спроса (сформулируем деликатно) на программистские специальности кардинальным образом изменится! Запомните этот твит! 😉

Это заведомо будет означать необходимость переобучения и дообучения (которые тем сложнее, чем больше возраст). Плюсом для вас будет то, что с дистанции сойдет много "возрастных" программистов, но я бы на вашем месте не радовался этому, а смотрел бы дальше 😉. Sapienti sat!
  • 😁 3
  • 🔥 1
Post #165 718
У нас много разных интересных новостей, руки не доходят писать.

Пару недель назад сделал доклад в треке AI на TrueTechDay от МТС. На удивление мероприятие было очень масштабным. Они называют 2 тысячи человек на месте (7 треков параллельно!) и еще 16 тысяч уникальных онлайн.

Наиболее интересным (помимо впечатлившего размаха мероприятия и, собственно, докладов) там было очень интересное общение с другими спикерами. На которое едва ли не большая часть времени там ушла))). В том числе были очень интересные дискуссии про будущее LLM.
  • 👍 7
  • 🤔 2
  • 👎 1
Post #164 909
Коллеги!

На прошлой неделе Максим Синюков (4 курс) доложил свою статью (постер) на Data Compression Conference в штате Юта в США.

Из путевых заметок Максима:

Наши статьи по взлому метрик заинтересовали Bytedance, Netflix, Amazon, Alibaba (некоторые даже видели статью раньше). Из Amazon люди удивились, что некоторые метрики у них используются как основные (например, VMAF) и могут так сильно быть взломаны. Сказали, что им это очень важно. Пропиарил старую статью по взлому VMAF NEG

Из нетфликса было пару человек. Сильный взлом они не видели, тоже были сильно удивлены. Но все равно Андрей Норкин сказал, что для их внутренних целей компании она подходит, поэтому все хорошо с метрикой.

Какие выводы можно сделать:

1. "Сложно не значит невозможно". Да, поехать в США сейчас эпопея, но это совершенно реально!

2. Первую Scopus статью у Максима приняли в августе перед началом 2 курса (следствие его плотной работы по научной теме весной). Заметим, что не у всех бакалавров получается Scopus. При этом прикольно, что улучшение нейросетевых помогаек программистам идет такими темпами, что не может не сказаться на популярных специальностях уже с конца этого года. И кто-то будет к этому так или иначе готов, а кто-то нет.

3. Компании активно интересовались нашими исследованиями и мы, очевидно, недостаточно усилий прикладываем для рекламы наших достижений. Будем работать.

До сведения Нетфликса, что с метрикой не все хорошо, обязательно доведем, они недооценивают последствий сильного взлома ))) (а с Норкиным мы знакомы лично)
  • 🔥 14
  • ❤ 8
Post #163 1.23K
Всем привет уже завтра начнется спецкурс «Интеллектуальные методы обработки видео»

Ждем всех желающих в 14:35 в аудитории 609

P.s. на гифке изображен четырехмерный кадр вычислительного видео одного из заданий курса
  • ❤ 5
Post #162 1.12K
Господа!

Только что ушла в релиз большая статья про Super-Resolution на Хабре!

В конце прошлого года три наших бенчмарка SR вышли на 3 первых места (из 16) на papers with code https://paperswithcode.com/task/video-super-resolution

+ у нас идут работы по сбору большого датасета артефактов Super-Resolution

+ мы дообучаем и улучшаем SR.

Обо всем это подробнее тут:
https://habr.com/ru/post/716706/

#Habr
  • 🎉 5
  • 🔥 2
Post #161 1.2K
Всем привет!
Уже скоро начнется весенний спецкурс «Интеллектуальные методы обработки видео» — в следующую среду 15 февраля.

Формат проведения — очные лекции каждую среду в 14:35 в аудитории 609.

В ходе курса вы узнаете об актуальных задачах обработки видео.
А также:
* Получите базовые навыки работы с видеоконтентом.
* Научитесь работать с 4D кадрами
* Построите и обучите нейросеть для повышения разрешения.

Чат курса по прежнему доступен по ссылке:
  • 🔥 3
  • 😢 2
Post #160 1.28K
Господа!

Из забавного. В прошлом году нас больше 4 месяцев плотной работы заняла запись онлайн курса по сжатию в Вышке.

Ключевые отличия:
* Собрали темы по сжатию, в т.ч. которые на ВМК я перестал читать (например, сжатие звука)
* Под это дело обновили часть слайдов
* Сделали задания небольшими и добавили тесты

Сейчас глобальное развитие идет в сторону онлайн курсов, но у них помимо пачки плюсов есть пачка минусов + нужно по-другому делать слайды, нужно по-другому давать материал (блоки максимум 15 минут), нужно по-другому проверять задания. Но это в любом случае новый уровень и охват гораздо большей аудитории.

Материала записали довольно много. Вместе с допами получилось больше 20 часов видео в 10 лекциях (т.е. для желающих идти глубже материала больше, чем в среднем семестровом курсе).

Также по настоятельной просьбе продюсера курса я организовал 4 интервью с двумя экспертами по темам лекций. Это когда я прикидываюсь валенком задаю сознательно глупые вопросы о том, как это все применяется сегодня в реально жизни в компаниях. Причем с руководителем технической части Кинопоиска мы пошли еще дальше (в игре в Дудя))) и был даже блиц))))) В общем постарались реализовать то, что заметно сложнее реализовать в рамках обычного курса, а в онлайн - самое оно!

Кому интересно - вот промо курса.

Останавливаться на достигнутом не собираемся - будем двигаться дальше! 😉

О еще одном нашем курсе скоро напишу! 😎
YouTube Методы сжатия и передачи данных (Ватолин) Промо
  • 👍 14
  • 🔥 1
  • 😢 1
Post #159 1.09K
Коллеги!

Я периодически топлю за то, что производные ChatGPT существенно поменяют мир в ближайшие 3-5 лет. В последней статье на хабре (которая, кстати, №1 по хабралайкам среди всех моих статей за 7 лет, добралась до 150 тысяч просмотров, 14 места в топе года и до по сути до 2 места по полезноте - в статье 4 место, но за это время она умудрилась обогнать "Краткий справочник по «всем-всем» командам Linux" и "Как я несколько лет боролся с прокрастинацией и победил: полное практическое руководство" 😨😉😎... Как получилось обогнать победу прокрастинации я до сих пор не понимаю, очевидно я недооцениваю актуальность проблемы мозгового ожирения). Но там я про ChatGPT буквально одним предложением.

А тема на глазах развивается! Есть, например, стартап, который пилит поисковую систему нового поколения. И я его как хакнуть VMAF спросил:
https://labs.kagi.com/ai/contextai?question=how+to+hack+VMAF

В ответах чисто в стиле ChatGPT и с использование веба очень наглядно видно, насколько веб улучшает качество ответа на таком запросе:
———————————————————————————
Web + AI

Hacking VMAF is possible by artificially increasing the metric through video preprocessing techniques. This can be done by applying different color corrections to compressed videos, which increase the values of full-reference metric VMAF and its tuning-resistant version, VMAF NEG [1][2][3][4]. A pipeline for tuning parameters of processing algorithms has been proposed that allows to increase VMAF by up to 218.8% [5]. It should be noted that while it is possible to hack VMAF, this should be taken with a grain of salt when comparing pre-processing approaches [6]. Additionally, other methods such as video distortion have also been proposed for increasing VMAF quality values [7].
[1]: Hacking VMAF and VMAF NEG: vulnerability to different ... (
https://arxiv.org/abs/2107.04510)
[2]: Potential VMAF Hack · Issue #489 · Netflix/vmaf · GitHub (
https://github.com/Netflix/vmaf/issues/489)
[3]: Hacking VMAF and VMAF NEG: vulnerability to different ... (
https://arxiv.org/pdf/2107.04510)
[4]: Hacking VMAF with Video Color and Contrast Distortion (
https://ceur-ws.org/Vol-2485/paper12.pdf)
[5]: [PDF] Hacking VMAF and VMAF NEG: Vulnerability to Different ... (
https://www.semanticscholar.org/paper/71c676b4ec1465ed6a52684c1cf5ffea7a717c45)
[6]: Review: iSize BitSave Video Preprocessing (
https://www.streamingmedia.com/Articles/Editorial/Featured-Articles/Review-iSize-BitSave-Video-Preprocessing-139985.aspx?utm_source=related_articles&utm_medium=gutenberg&utm_campaign=editors_selection)
[7]: Video Distortion Method for VMAF Quality Values Increasing | DeepAI (
https://deepai.org/publication/video-distortion-method-for-vmaf-quality-values-increasing)

AI

VMAF (Video Multi-Method Assessment Fusion) is a video quality metric developed by Netflix. It combines multiple algorithms to measure the perceptual quality of a video, and can be used to compare different encodings or codecs. Unfortunately, VMAF cannot be hacked as it is an algorithm that measures the quality of videos based on various factors such as resolution, bitrate, frame rate etc.


#Habr
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →