Gemini переходит на язык жестов и детектор лжи
Google продолжает допиливать свой мультимодальный движок Nano Banana, и свежее обновление — это прямое признание: текстовые промпты для редактирования фото всё ещё работают «через раз». Теперь вместо того, чтобы мучительно подбирать эпитеты, пытаясь объяснить нейросети, почему «синий стул» должен стать «бирюзовым креслом», можно просто обвести объект пальцем.
В чём соль? Эволюция взаимодействия с ИИ уходит от «говорильни» к прямому манипулированию. Визуальное указание (In-painting) на порядок эффективнее текста: нейросеть больше не гадает, о каком именно углу кадра идёт речь. Для разработчиков и дизайнеров это сигнал — интерфейсы будущего будут строиться на гибриде голоса и жеста.
И что теперь? Помимо кистей и ластиков, Gemini научили «детектору правды». Модель теперь умеет анализировать не только статичные изображения, но и видео на предмет признаков генерации.
Зачем это? В эпоху дипфейков, которые штампуются за секунды, инструмент проверки видео от самого бигтеха — это попытка Google возглавить цифровую полицию нравов. Теперь отличить реальное видео от творчества нейросети станет чуть проще (по крайней мере, пока алгоритмы генерации не сделают следующий рывок).
Post #89
50
