Недавно посмотрел интервью с основателем DeepMind Денисом Хассабисом, лауреатом Нобелевской премии по химии (он создал ИИ модель AlphaFold, которая предсказывает структуру белка человека) и узнал очень интересный факт про модели генерации видео, например, Veo, Sora, Runway Gen и другие.
Оказывается, что создание моделей генерации изображения нужно не просто для создания развлекательного контента. Основные цели этих моделей - научить понимать ИИ ощущения, которые стандартные текстовые LLM понимать не могут, а именно то как мы воспринимаем наш мир, логику его существования, потому именно при генерации видео мы можем понять, как модели реально интерпретируют наш реальный мир, его физику, и по факту именно такие видеомодели приближают нас к созданию AGI (общие ИИ).
Так что для больших компаний развитии моделей генерации изображений, этов большей степени шаг к созданию AGI, нежели чем просто генерация видео для соц сетей.
А вы знали об этом аспекте ИИ моделей генерации видео?
Полезная информация:
Курс по evaluation AI |
Мой фреймворк для оценки AI |
С чего начать изучение AI | Инструменты для оценки AI |
Инструменты для оценки AI (ч.2)
Post #119
615

- 🤔 6
- 👍 4
- ❤ 1