🔍 Google представила Agentic Video для Gemini — до 88% меньше токенов и до 66% ниже стоимость анализа видео. Google DeepMind добавила новый режим понимания видео в Gemini 3.7 Flash, 3.6 Flash и 3.5 Flash-Lite. Вместо того чтобы последовательно прогонять через модель весь ролик, Gemini теперь сама решает, какие фрагменты видео нужно подробно посмотреть, возвращается к нужным моментам и использует инструменты для дополнительного анализа.
По внутренним тестам Google, такой подход позволяет сократить расход токенов до 88%, стоимость — до 66%, одновременно повысив качество до 7%. Это vendor benchmarks, поэтому цифры стоит воспринимать как результаты самой Google, но направление очень показательное.
✈️ Почему важно для Industrial AI: огромная часть промышленных данных — это не текст, а видео с камер, drones, bodycams, inspection systems и производственных линий. Если агент может вместо постоянного полного анализа видеопотока сам выбирать момент, где «что-то произошло», экономика computer vision резко улучшается.
Для mining это может выглядеть так:
100 камер → AI не анализирует каждый кадр одинаково → обнаруживает аномалию → углубляется в нужный участок → связывает событие с FMS/SCADA → создаёт alert или действие.
Это делает массовый video analytics намного более реалистичным.
Google
Post #498
134
- 👍 1