Стартап Tavus представил Griffin – первую в мире модель, которая прошла видео-тест Тьюринга
В живом видеозвонке на минуту 48% участников (26 из 54) решили, что говорили с реальным человеком, когда говорили с Griffin. Прежде чем читать дальше, посмотрите демки, они правда выглядят пугающе живо и уже потрясли соцсети (на анонсе Tavus уже 10 миллионов просмотров).
Модель смеется, меняет тон, перебивает и позволяет перебить себя, хорошо чувствует паузы. Плюс отлично следует инструкциям, и видит/понимает собеседника и его окружение (например, может помочь собрать кубик рубика). И это уже не говоря о таких мелких вещах, как покрутиться на стуле или, например, улыбнуться, как живой собеседник.
Griffin работает как единая full-duplex video-to-video система. Каждые доли секунды она решает, стоить ли сейчас молчать, кивнуть, поддакнуть или перехватить реплику, и все это время продолжает смотреть и слушать, в том числе пока говорит сама. Поверх этого менеджера работают стриминговые генераторы речи и видео, которые превращают эти сигналы в голос и лицо в реальном времени. Некоторые детали архитектуры есть в блогпосте.
Модель пока доступна только избранным тестировщикам как research preview, потому что Tavus действительно уверены, что она способна обмануть человека, заставив его думать, что он говорит не с ИИ. Релиз обещают «очень скоро» после проработки безопасности и разработки водяных знаков.
Post #10077
16K
- 🔥 154
- 🤯 75
- 😁 24
- ❤ 12
- 👍 10
- 🤔 6
- 🍓 2
- 🤗 2
- 😎 2