Курс по созданию агентов Google x Kaggle (кавер "Заместители"). Серия 1. Основы!
Благодаря вашей поддержке мы начинаем серию постов, где разбираем 5-дневный интенсив от Google & Kaggle по созданию агентов.
Серия постов позволит вам с нуля разобраться в теории AI агентов и сделать первого реального агента на гугловых технологиях! Вы можете пройти курс в оригинальном исполнении Google & Kaggle.
Моя же задача помочь вам сделать первые шаги и извлечь самую мякотку в условяих супер ограниченного времени, в котором все мы с вами живем. Ну и я буду делать это на русском языке в отличие от Гугла ✋
Теория.
1. Что такое AI агент?
AI агент — это небольшая ИИ-система, которая достигает поставленные цели, а не просто отвечает на вопросы. Агента можно сравнить с живым организмом. У него есть:
- Мозг. Его роль выполняет LLM.
- Руки. За них — функции, которые может вызывать LLM для решения специфической задачи (например, поиск в интернете, калькулятор и др).
- Нервная система. Он же оркестрационный слой, в котором с помощью промптов настраиваются инструкции, которым следует мозг агента (LLM), чтобы решать задачи.
- Тело и ноги. Деплой агента в сервис, будь то телеграм бот, помощник в UI интерфейсе или любое другое "воплощение" агента перед юзером. И здесь речь не только о красоте, но и о грамотной подготовке инфраструктуры.
2. Как действует один агент
Пользуясь всеми своими частями тела, главная цель агента - решить поставленную задачу. Для этого агентов настраивают следовать примерно такому циклу (он как раз и задается в оркестрационном слое) из 5 шагов:
1. Ясно сфорулируй задачу из запроса юзера.
2. Просканируй, какие инструменты и действия тебе доступны.
3. Продумай план действий для достижения цели.
4. Выполни действие, следуя плану.
5. Наблюдай и оценивай получаемые результаты. И вернись к пункту 3.
Эволюция от AI агента к мультиагентной саморазвивающейся системе
Она состоит из 4 этапов:
0. "Ядро мышления" (просто LLM) — это мозг в банке. Языковую модель просто один раз обучили. И пускай она очень умная, она может только разглагольствовать. Это не агент.
1. "Подключенный" — это уже мозг с руками. И теперь мозг может выполнять запросы в интернет, получать актуальную информацию, пользоваться инструментами для написания кода и тд. К этому уровню относится нашумевшие RAG системы. Это уже простейший агент.
2. "Стартег" — мозг с руками и нервной системой. Полноценный агент, который может пройти полный цикл из 5 шагов, который мы обсудили выше.
3. "Мультиагентная система" — это команда из "стратегов" с распределением обязанностей. У каждого агента в такой системе определяется роль и обязательно есть "менеджер", который планирует и ставит задачи другим. Большинство лучших существуюих агентных систем в мире находятся на этом уровне.
4. "Саморазвивающаяся мультиагентная система" — та же команда, но теперь она понимает, когда сталкивается с каким-то ограничением. И для решения этого ограничения она может собственными силами создать нового агента или новый инструмент. Таким систем еще нет, только эксперименты.
Теоретическую базу мы с вами освоили!
Мы живем с вами в мире видосов, поэтому я решил для более простого усвоения знаний сопровождать посты корткими видосами. И сгенерил их с помощью NotebookLM! Ловите первый. Да, он кринжевый в части видео, но от этого же веселее! 😁 А вот озвучка мне нравится - можно просто как подкаст слушать. Это не нейрослоп — контент в видео дейтсвительно полезный! Как вам такой формат?
Источник: Whitepaper.
Теперь к практике.
#ииученьесвет
Post #143
1.59K