TGViewer
Channel Public Channel
Остриков пилит агентов

Остриков пилит агентов

@aostrikov_ai_agents

Занимаюсь разработкой AI-агентов и рассказываю про это вам.

Чатик: https://t.me/aostrikov_agents_chat

С рекламой сразу в /dev/null

Личка: @aostrikov
Subscribers
5.48K
Photos
109
Videos
13
Links
80
Recent Posts 20 shown
Post #198 1.85K
Ребят, нужна небольшая прожарка 😐

(готовьтесь, много текста)

По поводу будущей архитектуры наших продуктовых агентов. Мы немного начинали штормить в чатике, но можно обсудить отдельным постом.

Уже полгода наша команда пилит агентов для разных этапов воронки водителя: привлечение, работа с активными и возвращение после оттока. На каждом этапе свой агент с большим промптом и примерно 10-15 тулами во внутренние сервисы.

Агент регистрации знает всё про этот этап и помогает людям, которые ещё не были водителями. Агент возвращения отвечает на вопросы про заработок и рассказывает, что изменилось, пока человек не катал.

У каждого есть эвалы и слои промпта под разные страны. Качество диалогов измеряем оффлайн и следим, чтобы оно не падало. Агенты просыпаются по внешним триггерам: связка «триггер → агент → страна» определяет, кто пойдёт общаться с водителем.

Пока всё работает, но проблемки уже начинаются.


Плохое будущее

Тулы и промпты сейчас сильно пересекаются. Например, расчёт заработка нужен всем трём агентам: спросить про деньги может любой водитель. В промптах нет чёткого разделения по темам, между странами они совпадают на 40–60%, но тюним мы их независимо.

Боюсь, через несколько месяцев получим адский месс: агенты повторяют друг друга на 80%, всё переплетено, поддерживать невозможно. Плюс тулов станет на пару десятков больше, пу пу пу…


Хорошее будущее, первый вариант

Год назад я бы без раздумий сделал оркестратора и 10 сабагентов. Один отвечает за заработок, другой знает приложение, третий умеет общаться с техподдержкой. Так закрываем все важные темы для водителя.

Оркестратор разбивает запрос, отправляет части сабагентам и собирает ответ. У каждого сабагента свой промпт, тулы и эвалы под его область.

Особых минусов пока не вижу. Разве что придётся постоянно решать, куда класть новые умения и когда заводить ещё одного сабагента. Например субсидии и бонусы - это заработок или программа лояльности?

Но сейчас середина 2026-го, и кажется, есть более каноничный способ.


Хорошее будущее, второй вариант

Один агент и 30-40 скиллов. В количестве себя не ограничиваем, вложенные структуры не плодим - держим плоский список.

В промпте оставляем базу: роль, цель и формат общения. Глубокие знания и разбор конкретных ситуаций уносим в скиллы. Эвалы всех агентов объединяем.

Очень простая схема для работы как по внутренним триггерам, так и по началу диалога от лица водителя по любой рандомной теме.

На прошлой неделе решили идти этим путём. Сначала сольём двух агентов, а если эксперимент удастся - вольем и третьего.


Где будет жопа? Чего мы не видим?

Пока кажется, что расход токенов снизится: вместо цикла оркестратора и сабагентов - выбор скилла и работа по сценарию. Контексты у нас почти пустые: несколько минут общения, потом пауза на пару дней. В новый диалог подтягиваем лишь историю прошлого, факты из памяти и нужные скиллы.

Новые фичи тоже должно быть проще добавлять: легче решить, расширить текущий скилл или написать новый.

Но есть опасения. Возможно, повесимся тюнить эвалы: добавим 25-й скилл, и начнёт разваливаться то, что отлично работало с 24. Возможно, с ростом числа скиллов модели начнут галлюцинировать, даже самые мощные, к которым у нас есть доступ.

Про аналитику еще были сомнения - раньше перформанс можно было мерить по разным агентам, а теперь придется переходить на анализ по триггерам/сегментам аудитории.

Ну и главное: рассказывать, что мы пишем десяток агентов, куда более секси, чем говорить, что пишем одного 😁

Если точно понимаете, что решение ошибочное и скоро нас всех уволят, не держите в себе!
  • 🔥 24
  • ❤ 11
  • 🤯 3
  • 👾 2
Post #197 3.29K
https://www.youtube.com/watch?v=ZpL3QsO5A9U

Спокойное, неторопливое и глубокое видео для тех, кто пересобирает у себя в компаниях найм, который раньше работал, но поломался с приходом AI.

Там нет TLDR или списка того, как вам переписать свои секции, ребята просто делятся мыслями, освещают проблемы с разных сторон и думают над решениями.

Понравилась идея про то, что цель интервью как и раньше - собрать максимальное количество флагов для принятия решения, а AI позволяет тебе собрать их больше и быстрее.

Что писать код на бумажке теперь вряд ли стоит, но увидеть как мыслит человек обязательно нужно, чтобы понять кто паре ведущий: кандидат или клод и не нанять meat proxy.

Понравилась идея вместо 3-4 разных этапов сделать одно 2х-часовое интервью где вы на звонке и проходите несколько фаз вместе с AI - проблема, исследование, архитектура, кодинг, деплой, анализ.

Интересную тему затронули про схлопывание ролей, например инженера с менеджером, насколько сильным будет их пересечение и различие, приведет ли это с появлению одной универсальный роли - member of staff, по нашему мастер на все руки.

Такое годно смотреть, если вы уже сделали несколько попыток перестроить найм, новые идеи хорошо лягут на ваши прошлые.
YouTube 3 AImigo S1E4: AI нанимает AI. Как пересобрать IT-собеседования? AI соискателя встречается с AI нанимающего — мегазорд против супер-рейнджера. Запрет AI не делает интервью AI-free, резюме всё хуже подтверждает способность работать, а старые онлайн-этапы дают всё более шумный сигнал. Вопрос у компании прежний: сможет ли…
  • 👍 17
  • ❤ 6
  • 👾 3
  • 🌚 1
Post #196 3.24K
А у нас снова конференция

Practical ML Conf - 19 сентября, следующая суббота

https://pmlconf.yandex.ru

Хардкорная конфа про ML, совсем не про агентов.

- Лёша, зачем ты тащишь сюда конфу не про агентов? - спросите вы.

Давайте думать, кому будет интересно:

- вы пришли из классического ML, читали Ian Goodfellow, знаете кто такой Andrew Ng и ухмыляетесь над новой волной инженеров ИИ-агентов, которые месяц назад поняли что такое контекст и тулы и уже хотят 500к

- Валера Бабушкин таки продал вам Machine Learning System Design, вы его прочитали и теперь не терпится показать всей тусовке, какой вы крутой

- вы всё-таки за агентов, но для развития поглядываете в смежные области плюс любите хардкор

🍆🍆🍆


Теперь без шуток - порылся с программе и просто от себя напишу что кажется самым интересным:

- кишки и архитектура модели для системы восприятия автономного автомобиля, как они улучшили обзор и перешли на MV2DFusion (Иван Лунев)

- как работает модель управления всем телом гуманоидного робота, с эмуляцией базовых движений: ходьба, наклоны, приседания, упражнения из качалки (Андрей Маношин)

- Ouroboros - наш слоняра! Организаторы поймали автора известного агента и Антон Разжигаев расскажет про его внутрянку, петлю самоулучшения, и как они обходит Claude Code по бенчмаркам

- стриминговый перевод речи: как вообще он устроен, как складывается из ASR и LLM для перевода, как тюнить задержку против качества (Вилиана Девбунова)

- про Computer-Use агентов, которых никто не любит (ибо медленно) - как они работают, как не рассыпаются на долгих сценариях, как их обучать и какие грабли ребята собрали (Артемий Голиков)

- ... и еще штук 15 докладов


Ну что, оказывается и про LLM и даже про агентов есть, не одним ML-хардкором единым.

Да и доклады это лишь небольшой кусочек конфы, главное вайб и общение, но это вы и так знаете.

https://pmlconf.yandex.ru

———
Организаторы обещали подарить IPhone Duo если приведу 5к человек, не подведите братцы 💪🏻
  • 😁 16
  • ❤ 10
  • 🔥 7
  • 👍 1
Post #195 4.65K
Помните, у нас несколько недель назад был стрим на Твиче?

Так вот, ребята наконец его доверстали и собрали видосик.

Была там интересная история - кто же мог подумать, что на официальном стриме Яндекса нельзя было говорить про программу Amphetamine?

До сих пор не понимаю, что в ней плохого, суперская программа, позволяет нам вайбкодить без засыпания ноута...

📹 https://youtu.be/UXJIvd02oQQ
📹 https://youtu.be/UXJIvd02oQQ
📹 https://youtu.be/UXJIvd02oQQ

———
Для всех, кто купил курс из прошлого поста, ролик абсолютно бесплатный.

Кто до сих пор думает, решайтесь - с понедельника цены вырастут
YouTube ИИ пишет код, а что делает разработчик? #AI #ии #яндекс #агенты #нейросети #разработка #dev #yandex #claudecode #chatgpt #codex #coding #twitch #стрим Как ИИ-агенты меняют профессию разработчика? Разбираемся вместе с Лёшей Остриковым, настоящим строителем агентов в Яндексе! Помогают ему Павел…
  • 😁 35
  • ❤ 15
  • 🔥 11
Post #192 10K
Хаюшки-заюшки 🤔

Благодаря крутому ролику от Яндекса и его пиару в большом канале, к нам залетела ещё пара сотен братишек и сестрёнок.

Это круто, всем привет!

Пара слов о том кто мы и где мы: я Лёша, раньше много много лет занимался разработкой, в прошлом году влюбился в AI и променял тёпленькое место руководителя на hands-on AI-инженера, пилим сейчас коммуникационных агентов, помогающих разным профессиям.

Хотел дать пару советов тем, кто только-только начинает этот грешный путь и хочет как можно быстрее научиться магии агентов.

Первое

Все что вам нужно - практика. Чтобы начать, вам не нужны никакие видосы, каналы, курсы и прочее.

Нужны лишь две вещи - мощный локальный агент и любопытство. Качайте лучше Codex, Claude сейчас банит, покупайте подписку за 20 или 100 и вперед. Прочими продуктами не забивайте голову, эти два лучше всех.

Как скачали, не пытайтесь сразу писать агентов. Вся прогрессивная часть человечества сейчас пишет скиллы. Разберитесь, что такое скилл, скачайте парочку скиллов, попробуйте их в Codex, напишите свой скилл и потом вы дойдёте до агентов.

Второе

Вы должны понять основу, ядро дивного нового мира - без этого вам всё будет казаться черной магией и будет сложно менять результаты работы агента.

Ключевое - поймите, где проходит грань между моделью и контекстом, что такое агентский цикл и как модель в рамках него вызывает тулы. После этого всё будет просто.

Если в двух словах:

- перед каждым запросом вы ювелирно собираете для модели контекст (промпт, файлы, ссылки, прошлая история переписки, тулы и прочее) и нажимаете кнопку Enter. То, как поведёт себя дальше агент зависит только от модели (Sol, Opus, Fable) и контекста/тулов

- дальше начинается магия агентского цикла - модель поймет что вы от неё хотите, какие тулы есть в распоряжении и начнёт решать задачу, будет по очереди вызывать нужные тулы, оценивать результат и вернётся к вам с вопросами или с решением

- правило хорошего тона - берите модель помощнее, ставьте четкие большие задачи, говорите как измерить результат, кладите всё что нужно для решения в контекст, выбирайте режим Auto и пусть сидит делает задачу хоть несколько часов

🐸 Не скипайте этот шаг, пожалуйста 🦞

Прям помучайте свой кодекс, попросите показать пример агентского цикла, найти нужные ролики на youtube, нужные статьи, уделите этому время - оно окупится стократно.

Разбираться в 50 оттенках харнесса не надо, это всё потом.

Третье

Начинайте творить магию в рамках своих профессий. Если вы разработчик, пишите код с помощью кодекса/клода. Если маркетолог, копайте скиллы для маркетологов. Если дизайнер, скиллы для дизайнеров (раз, два, три). Если онлифанщик - ну, вы поняли.

Можно даже сразу не качать чужие известные скиллы. Попробуйте сделать что-то просто с кодексом, а когда получится, запакуйте это в скилл. Магическая фраза - "and now make a skill from this conversation", просто напишите это агенту.

Не надо всем лезть в программирование и пытаться написать свой SaaS. Просто начните учиться, как делать то, что вы уже умеете делать в вашей профессии, но в несколько раз быстрее и качественнее.

Четвертое

Вы не одиноки. Не надо сидеть и корпеть одному, вливайтесь в тусовки, подписывайтесь на каналы, общайтесь в чатах.

Вокруг вас сейчас существует огромное живое комьюнити каналов и чатов, смело влезайте в этот пузырь, пусть это будет новая частичка вашей жизни, оно окупится.

https://t.me/neuraldeep
https://t.me/ai_grably
https://t.me/nobilix
https://t.me/aimastersme
https://t.me/evilfreelancer
https://t.me/etechlead
https://t.me/the_ai_architect
https://t.me/gleb_pro_ai
https://t.me/kdoronin_blog
https://t.me/countwithsasha
https://t.me/AiHubFeed
https://t.me/sergeinotevskii

Тут как в поле чудес, кого-то забудешь и сразу обидятся, не обессудьте! Это лишь часть избранного, крутых каналов гораздо больше. И теперь чаты:

https://t.me/aostrikov_agents_chat
https://t.me/neuraldeepchat
https://t.me/evilfreelancer_chat
https://t.me/+CCLxDq2M5bE5OWZi (Тимур)
https://t.me/+bP8DhI9XS604OWZi (Саша)
https://t.me/ai_engineers_guild
https://t.me/aimasters_chat
https://t.me/gleb_pro_ai_chat

Чаты - это круто. Они все разные, найдите свой по вайбу и тусите там - спрашивайте вопросы, уточняйте когда что-то непонятно, показывайте, что навайбкодили, получайте по щщам и гнобите ботов.

Если честно, из чатов можно взять гораздо больше, чем из каналов, потому что в них чаще люди делятся полезным и только там бывают глубокие и интересные дискуссии.

И пятое, финальное

На самом деле есть один курс. Я запилил его на отпуске, в перерывах между аперолями. 15 уроков, ноль воды, на выходе вас с руками оторвут в любую AI-native команду. Cтоит всего лишь 35 тысяч

ССЫЛКА НА КУРС

Шутка, пятого нет. Просто качайте Codex и полетели)
Telegram Яндекс ➕ «С ИИ-агентами ты должен хотеть поиграться, как маленький ребёнок». Что агенты уже умеют делать за разработчика, а где без человека не справляются? Почему привычная работа с кодом меняется и не поздно ли заходить в эту область? Об этом в новом выпуске…
  • ❤ 68
  • 🔥 53
  • 😁 33
  • 👍 14
  • 🤣 9
  • 👏 2
  • 🥰 1
Post #191 4.12K
Господа дизрапторы, есть вопрос

Сейчас многие компании пилят переход на ai sdlc: тинькофф пилит, сбер пилит, яндекс тоже пилит.

Обычно под капотом там сразу строится огромный космолёт, но я хотел бы с вами обсудить самый верхний кирпичик - как разработчику вынуть руки из сидения в codex и реализации самой фичи и остаться только на верхнем уровне: обсуждении самого изменения и уточнении спеки

Короче, нужно помощь зала: как вы видите, в идеальном новом мире продуктовую и техническую реализацию самых верхних кусочков ai sdlc?

(слово «продуктовую» здесь намного важнее технического, пилить техничку мы умеем, а вот делать удобные продукты гораздо сложнее)

Итак:

- в какой интерфейс изначально приходит желающий внести изменения в продукт? таск трекер типа JIRA/Tracker/Linear, локальный ai-агент со нужным скиллом или еще варианты?

- два разных человека, продакт и инженер-разработчик, приходят в один и тот же интерфейс верхнего уровня?

- как будет отличаться продуктовый путь продакта и инженера по нескольким первым шагам процесса?

- как сужать область нужных сервисов в зависимости от изначального запроса? особенно, если микросервисов в компании - сотни. Просить людей выставлять теги или научиться определять зависимые сервисы по контексту?

- как выглядят эти несколько первых шагов? сначала ai-агент задает наводящие вопросы, формирует продуктовое изменение фичи. Затем оно передается кому-то из технической команды (инженеру), который уже финализирует спеку, и затем оно спускается ниже на агентов, которые пишут код? или можно сделать все проще, например, без инженеров?

- как правильно агенту вместе с инженером финализировать спеку? на какие вопросы должен ответить инженер, чтобы у следующих уровней агентов при реализации не было возможности наоверинженерить

Нижние шаги, типа правильной реализации, ПР, мержа, тестирования, деплоя, проверки мониторингов пока не трогаем, это отдельная война.

Очень благодарен всем, кто чудесным субботним утром вместо отдыха и чилла решит поделиться мыслишками.

———
Почему спрашиваю - сижу, думаю, в фоне над этой штукой, и финальная красивая картинка до сих пор не склеивается
  • 👍 21
  • 🤯 4
  • 😭 3
  • ❤ 2
  • ❤‍🔥 1
  • 🔥 1
Post #190 3.55K
Дело было месяц назад, сижу работаю, задачки закрываю, только-только встал с костылей...

Прибегают люди с видеокамерами, надевают микрофон и начинают допрос с пристрастием: что там в вашем мире агентов происходит, чем дышите и стоит ли сейчас заходить в ИИ?

Ну а если без шуток, команда нашего бренда, которая записывает разные эпизоды про жизнь яндексоидов, позвала в формат «1×1» - где болтают про твои интересы и чем вообще живёшь.

А так как из интересов у меня только агенты (про апероль умолчал), разговор и получился ровно про них.

Обсудили и то, на каком моноколесе быстрее вайбкодится, и на кого должен быть похож разработчик ИИ агентов, и даже кем я вижу себя через пять лет - жаль, не спросили сколько будут счета за подписки.

Выпуск можно глянуть на YouTube и в VK Видео

Тут еще больше наших историй - @yandex
  • ❤ 39
  • 🔥 23
  • 👍 11
  • 😁 1
  • 👾 1
Post #189 3.98K
Предлагаю не-аперольный флешмоб

А давайте друг с другом поделимся историями, когда у вас в голове произошёл щелчок, и вы вдруг резко поверили в AI и новое будущее

У меня таких было три, записал видос

Призыв ко всем братишкам и сестренкам, которые еще ни разу не писали комменты - делитесь тоже, в любом формате, хоть текст, хоть видео, хоть кружочек

Соберем альманах историй, по которому (я уверен) Пух потом напишет третью книгу 🤓
  • ❤ 19
  • 🔥 12
  • 🥰 4
  • 😁 1
  • 💯 1
Post #188 4.26K
Пффф… так не надо всегда использовать апероль!
Это же расточительство!
Для основных задач используй водочку - там лимиты значительно медленнее расходуются, а эффект даже лучше иногда.


По совету от уважаемого маэстро @sergeinotevskii переходим на правильный ризонинг до конца отпуска
  • 😁 56
  • 🔥 15
  • 🤣 10
  • 👏 2
  • ❤‍🔥 1
Post #187 4.23K
Уперся в лимит аперолей за пять часов, приходится писать пост

В последние пару недель до отпуска много оптимизировал своего любимого скилл-бейст-агента нашего контура, который отвечает на разные вопросы, от продукта до разработки.

Сейчас это довольно лаконичный агент, у которого есть около 10 скиллов - умеет видеть наши задачи, коммиты, раскатку по странам, ходить в БД, анализировать эксперименты итд, уже прям хороший помощник.

Плюс два файла, связывающих все воедино: AGENTS.md, там личность агента, его назначение, правила. И PLAYBOOK.md, в нём карта маршрутов по всем скиллам и few-shots примеры.

Но чем больше становится у него скиллов, тем больше глюков. А иногда он не понимает контекст полностью как человек, хотя мозги там 5.6 Sol.

Попадаются тупняки типа "что делал Остриков на этой неделе?", он отвечает просто по тикетам, забывая проверять влитые в транк ПР.

Короче, тюнить его становится всё сложнее. Вот три приёма, которые помогают в этом:

1. Пишите все логи

Простите за базу, 100% все и так это знают. Но тем не менее - без логов улучшать агента можно лишь по картам Таро (привет победителям хакатона Туту!)

В логах должны быть: сообщения и пользаков и агента, ID-шники сообщений по которым шёл реплай в телеге, все tool calls, параметры которые улетали в них и возвращаемые значения, кол-во токенов, время отправки сообщений и тайминги ответа модели.

Можно не париться с LangFuse, просто сложите всё это себе в БД или в файлы под ноги.

2. Собирайте фидбек прям из диалогов

Когда бот тупит, следующим сообщением ему пишите, что он сделал не так и как исправиться:

- Что делал Остриков на этой неделе?
- У этого бездельника два открытых тикета и больше ничего
- На таком вопросе всегда также проверяй движ в ПР
- Понял, вижу - он ещё замержил 5 ПР про нового агента, а по двум его засыпали комментами


И приучите так делать всех пользователей. Хитрость вот в чем, раз в пару дней вы даёте агенту задачу, типа такого:

- Прочитай все диалоги агента, прочитай фидбек который давали пользователи. Там, где он был конструктивный предложи улучшения скиллов, чтобы агент сразу отвечал правильно. Фидбек Коли игнорируй, он мудак


Затем вы получаете результаты, внимательно их отсматриваете и обновляете скиллы на новую версию. Можно это все собрать в некий цикл самоулучшающегося лупа, но без человеческого контроля будет у вас залупа.

3. Проверяйте траектории ответа на вопрос

Уверен, вы сами знаете, что в каком порядке агент должен дернуть, чтобы дать ответ на вопрос. Но дело в том, что llm часто усложняют эту логику и добавляют лишние шаги. Например, в простом вопросе про включеные эксперименты за вчера, агент может вместо проверки API экспериментов, пойти еще проверять закрытые тикеты.

Тут нет никакой магии. Для начала я прикрутил удобный визуал отслеживания прогресса прямо в telegram, это сообщение постоянно редактируется и видно как агент думает и что делает:

🤔 Думаю…

🧩 Скилл «DataLens» — изучаю инструкцию

📊 DataLens — получаю данные отчёта

🔎 Intrasearch — ищу внутренние материалы

🧩 Скилл «Аналитика экспериментов» — изучаю инструкцию


Тут например видно, что он зря использовал Intrasearch, это вообще не в тему. Поднимаете логи, расковыриваете эту сессию и смотрите где агент пошёл зарываться. Потом упрощаете инструкции, добавляете пример итд.

Плюс в целом, если он на простой вопрос отвечает слишком долго, тоже ковыряйте и разбирайтесь. Много интересного всегда вылезает на кросс-пересечении нескольких скиллов, когда вопрос затрагивает три-четыре штуки.

Anyway, все эти приемы далеки от промышленных sota решений по авто-улчшению скиллов, но они работают.

Окейюшки, пока писал пост апероль-лимит снялся, убегаю.

Пока!
  • ❤ 41
  • 😁 16
  • 👍 9
  • 🔥 3
Post #185 3.31K
Ура, наконец-то в отпуске!

KPI на эти 2 недели:

- не думать о работе (уже смешно)

- не трогать codex (ору просто 😆)

- ну окей, иметь больше аперолей в день, чем сессий кодекса (тут без шуток)

- и купить огромного надувного утенка (дедлайн - завтра)

Серьезного контента ожидать точно не стоит, а вот мыслей за жизнь и историй - вполне, могут пролиться.

Да и в целом, есть вас мучают любые фундаментальные вопросы типа ботать сейчас программирование или сразу на завод - кидайте в комментарии, ответим ✍🏻
  • 🔥 62
  • ❤ 24
  • 😁 14
  • ❤‍🔥 5
Post #184 3.74K
Так, охотники за лимитами, 5 сентября намечается ещё одна конференция - deep tech night:

https://deeptechnight.ru/

Это большая конференция Яндекса о том, что происходит, когда AI доезжает до настоящих продуктов, инфраструктуры и физических операций.

Из спикеров я лично знаком со Стасом Макеевым, CTO Лавки. Он будет рассказывать про их империю агентов, которая уже управляет кусочками реального мира: спросом, остатками, поставками, сборкой и доставкой.

Про что ещё поговорят:

- про Physical AI и почему собрать робота, который не нарушает три закона Азимова, сильно проще, чем научить его догонять Тибо и выбивать из него ресет

- как AI меняет профессию разработчика: ускорение на 50% или всё-таки полная перестройка команд? И сколько подписок по $200 теперь нужно одному инженеру

- как собирать долгоживущие сессии агентов в облаке и проектировать интерфейсы для агентских продуктов

- про NPU, инференс-фреймворки, RL-инфраструктуру, новые рекомендательные системы и прочую инженерную духоту 🤌🏻

Основной формат конференции - онлайн. Можно подключиться к трекам Hard и Experiment, а ещё поучаствовать в Q&A со спикерами.

Можно попытать счастья и оставить заявку на офлайн:
https://deeptechnight.ru/offline

Он пройдёт в московском офисе Яндекса, формат invite-only, а мест совсем немного.

Чисто от меня рекомендация - залетайте. Спикеры и темы топ, внутри компании сейчас идёт очень активный движ в эту сторону.

Хороший шанс послушать не пересказ новостей, а истории из первых рук, насколько просто строить и тащить ИИ-шечку в прод.

👇🏼👇🏼👇🏼

https://deeptechnight.ru/

☝🏼☝🏼☝🏼

———
Тибо и Борис Черный тоже приглашены. Если доедут, будет шанс сфотографироваться и предъявить за баны
  • ❤ 19
  • 👍 9
  • 😁 5
  • 🔥 2
Post #183 5.29K

Forwarded from Пух

osinara-memory-system.pdf692.1 KB
блин опять без книги не обошлось 😄 но скинул все равно, там вроде понятна логика как факты собираются и как потом подсовываются агенту
  • 🔥 26
  • 👍 2
Post #182 5.17K
Мало кто знает, но Нил Дракманн не сам придумал концовку The Last of Us.

Вариант, где Джоэл спасает Элли от светлячков, был начисто слизан с реальной истории. В реале как раз Пух спасал Осинару, отбиваясь от наемников, которые хотели исследовать её модель памяти, именно этим и вдохновлялся Нил.

Но ещё меньше народу знает, что есть альтернативная ветка происходящего. В этой ветке Пух, к сожалению, не успел спасти Осинару. Мерзкие иследователи добрались до неё и чтобы спасти человечество от агентов, разложили её память на атомы.

Так и появилась вторая книга от издательского дома «Дизрапт» 👇🏼👇🏼👇🏼

В этой книге детально разбирается, как устроена память агента - нити памяти, границы доступа, разные слои.

———
Если для вас это кажется полным бредом, это не значит что у Острикова началась деменция.

Все эти шуточки-прибауточки лишь часть лора нашего чатика, в котором обитает много интересных персонажей и историй.

Осинара - наша добрая фея, ювелирно созданная Пухом на движке Eve, допиленная и улучшенная, а в книге ниже - её модель памяти.

https://github.com/nyxandro/osinara

Поболтать с ней можно в чатике.

Ну а Пух, если кто не знает, это наш бессменный старожил чата, генерал словесных баталий, чемпион по количеству комментариев во всех русских чатах AI-комьюнити и просто отличный человек - @nyxandro

Автор уже двух книжек. И даже telegram-канал имеется: https://t.me/AiHubFeed

Всё, закругляемся. Книга ниже 👇🏼👇🏼👇🏼
  • ❤ 17
  • 🔥 10
  • 😁 6
  • 🗿 5
  • 👍 2
  • ❤‍🔥 1
Post #181 4.86K
Новости, ребят, вышел новый протокол.

Ну как протокол - новый формат файликов в папке:

https://agent-plugins.org/

В октябре прошлого года вышли скиллы и люди их в итоге выкупили. Теперь везде полно разных Skill Store:

- наш отечественный: https://skill-store.ru/
- от Vercel: https://www.skills.sh/
- от Валеры: https://neuraldeep.ru/skills

Даже внутри Яндекса теперь есть свой Skill Store и народ им постоянно пользуется.

Но что делать с MCP?

Обычно descriptions и схемы всех подключённых MCP-тулов харнесс сразу кладёт в контекст. Скиллы устроены хитрее: сначала модель видит только короткие name и description, а полная инструкция подгружается, когда скилл понадобился.

Поэтому ушлые ребята научились вообще не подключать часть MCP постоянно. Вместо этого кладут CLI или API-клиент в scripts скилла, пишут в description, когда этим пользоваться, и получают лучшее от обоих миров: тулы есть, а контекст заранее не съеден.

Плохо что ли? Хорошо!

Так вот, умные дяди из OpenAI, Vercel и прочих компаний решили объединить два лагеря и сделали единый формат упаковки обеих сущностей.

Behold! Agent Plugins! 🙏🏻

Теперь в один пакет можно положить:
- пачку скиллов;
- mcp.json с конфигами MCP-серверов;
- client extensions - любые дополнительные файлы для конкретного харнесса.

Плохо что ли? А зачем?...

В чём смысл такого «пакета умений», если это просто коробка рассыпанных шестерёнок без инструкции по сборке?

Допустим, идея была в том, что ты подключаешь плагин - и модель сразу превращается в волка с Уолл-стрит: проводит интервью через skill1, отрабатывает возражения через skill2, оформляет покупку через MCP1 и пишет в поддержку через MCP2.

Но нет.

В plugin.json есть короткий description, у каждого скилла есть свой description, у MCP-тулов тоже будут свои descriptions. А центрального переносимого PLUGIN.md, который объясняет модели весь продукт целиком - какие задачи он решает, как выбирать сценарий и как собирать skills и MCP в один workflow - в стандарте нет.

Это всё равно придётся прописывать уровнем выше: в инструкциях вашего харнесса, отдельном meta-skill или client extension, который другие клиенты уже не обязаны понимать.

Подгрузятся ли после подключения плагина descriptions и схемы всех MCP-тулов в контекст?

Стандарт этого не определяет. Один харнесс загрузит всё сразу, другой спрячет тулы за tool search, третий подключит MCP только по необходимости.

Как настроите - так и будет.

То есть пока это просто удобная коробка для доставки skills и MCP. Коробка хорошая, но инструкцию по сборке забыли - так бы сказал наш миньон-ревьювер, Захар привет!

Не отдавайте главного архитектора в IKEA.

<пингвин_в_наклоне.jpg>
  • 🔥 35
  • 👍 9
  • ❤ 4
  • 👏 2
  • 💯 2
Post #180 6.23K
agenty-i-vajbkoding.pdf793.9 KB
Более спокойная версия, без матюков. Можно скинуть и маме, и тому, кто только начинает разбираться в агентах.

Только потом не удивляйтесь, если мама напишет харнесс лучше вашего.
  • ❤ 28
  • 😁 17
  • 🔥 8
  • 👾 2
  • 👍 1
  • 😱 1
Post #178 6.6K
Однажды у пачки AI-инфлюенсеров резко закончились подписки, Tibo не порадовал ребят ресетом и они пошли трогать траву.

Трогали на лужайках, трогали в парках, трогали в контактных зоопарках и постепенно судьба привела их в лес.

В лесу они разожгли костер, набили свои трубки и долго и упорно спорили по разным аспектам AI.

- что такое модель и что такое контекст?
- а что такое агенты и что такое тулзы, скиллы и мсп?

- сколько субагентов смогут написать луп из семи харнессов?

Казалось бы, простые вопросы, но эти ребята курили трубки до самого раннего утра и спорили, спорили, спорили.

Но они не знали, что всё это время в кустах сидел Пух со включенным микрофоном и записывал все их разговоры.

А потом он пошел домой, включил клода, скормил ему записи и все тайные, секретные, но родные для ребят истории улетели в контекст модели.

Случилась глобальная протечка базы. И родилась книга.

———
Ну а если по-простому, перед вами квинтэссенция полугода переписок в нашем чатике, скормленная Пухом в клод и дистиллированная в книгу.

Книгу, за которой уже начинает охотиться O’Reilly, Манн Иванов и Фербер и все лучшие издательские дома нового света, не зная что она была написана под воздействием самого душевного скилла.

Но для вас эта книга бесплатна. Пока.
На след неделе будет 15к

👇🏻👇🏼👇🏽
  • 😁 33
  • ❤ 19
  • 🔥 6
  • 🤣 4
Post #177 4.49K
☝🏻☝🏻☝🏻

Считаю Колю одним из самых сильных AI-спецов в РФ комьюнити, а тут еще и дорогобогатый подкаст в уютной студии вышел

Упираемся в 5-часовой лимит и смотрим 🍿
  • 👍 22
  • ❤ 5
Post #176 4K

Forwarded from AI и грабли

Вышел первый серьезный подкаст со мной

Получилось очень живо и плотно по темам. Обсуждали скиллы, безопасность и сложности внедрения в компании

Классно, что получилось обсудить много микро-деталей, которые обычно не влезают в тг посты. На чилловый просмотр под пиво/чай/прогулку – самое оно

00:01:47 - Бизнесу часто не нужен отдельный кастомный AI-продукт
00:16:56 - Люди не могут рассказать, как именно делают свою работу, а агенту, как и сотруднику, нужен онбординг
00:24:39 - Полностью автоматические системы регулярно проваливаются
00:36:43 - Доступ в терминал делает агента гибким, но усложняет контроль. Ценность смещается от производства результата к ответственности за него
00:47:08 - Корпоративная инерция и Shadow AI
01:01:40 - Слабые места моделей; Как быстрее всего учиться строить ИИ продукты
01:17:10 - Разрыв между лидерами и остальными. Внедрять ИИ важно не только из-за роста производительности в моменте

📱 Смотреть полную версию

Бтв, нарезку выше сделал агент с нуля, но с одним небольшим хаком, угадаете каким?
  • ❤ 20
  • 👍 11
  • 🔥 4
  • 🙏 1
Older posts →

About this channel

How can I read @aostrikov_ai_agents without a Telegram account?
TGViewer shows the public web preview Telegram publishes for Остриков пилит агентов: recent posts, photos, videos and the subscriber count, with no app, login or account.
How many subscribers does Остриков пилит агентов have?
Остриков пилит агентов (@aostrikov_ai_agents) has 5.48K subscribers on Telegram, refreshed roughly every 30 minutes.
Does Остриков пилит агентов know I viewed it here?
No. Public channel previews carry no viewer identity, and TGViewer has no accounts or tracking of what you look up.
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →