Gemini отрастила руки: Google показала, как должен работать настоящий ИИ-агент
Помните хайп вокруг AutoGPT и BabyAGI, когда мы пытались заставить нейронки самостоятельно выполнять сложные цепочки задач, а они бесконечно зацикливались или галлюцинировали? Google решила показать, как это должно работать в продакшене, и выкатила Gemini Agent на базе новой модели Gemini 3.
Это фундаментальный сдвиг парадигмы: мы уходим от концепции «чат-бота» (который просто говорит) к концепции «агента» (который делает).
Как это выглядит под капотом: Агент не просто парсит текст, он поднимает изолированный инстанс Chrome и ведет себя как пользователь. Он умеет ходить по сайтам, кликать кнопки, заполнять формы бронирования и связывать данные из разных сервисов (например, найти письмо в Gmail и на его основе создать событие).
Звучит как кошмар безопасника? В Маунтин-Вью это понимают. Агент работает в песочнице (без доступа к вашим основным кукам и паролям), а на любое критическое действие — будь то транзакция или отправка сообщения — срабатывает Human-in-the-loop: система обязательно запросит ваше «ОК» перед тем, как что-то натворить.
Пока фича доступна только подписчикам AI Ultra в США, но тренд очевиден: скоро навык написания промптов сменится навыком делегирования рутины.
Post #33
97
