TGViewer
Channel Public Channel
Системная лаборатория AI

Системная лаборатория AI

@keeperblog

Стоик R&D в автономных агентах: личные ассистенты и видеопродакшен. Рутина, находки, грабли - без хайпа.
Subscribers
86
Photos
95
Videos
27
Links
86
Recent Posts 14 shown
Post #157 110
Очеловечивание ИИ

Несколько раз мне скидывали визуализацию работы агентов из тиктока и инсты - смотри как круто сделано. Видео вызывает вау-эффект. Хотя, казалось бы, технически просто, но чувства делают свое дело.

Fleetbox - мой основной проект, запускает десятки изолированных доработанных hermes агентов. Это не разные сессии Claude Code или Codex, а отдельные сущности со своими ролями, базами данных и доступами. Система ловит обращения к LLM и визуализирует их через 3D сцену.

Каждый агент имеет свое рабочее место. Когда агент получает задачу - он бежит к этому рабочему месту. В остальное время агент гуляет по офису, зоне отдыха и кухне. У них есть small talks, кофе, танцпол и даже кальян.

Неожиданной фишкой агентов оказалась односессионность. Каждый курс или видео по ИИ будет говорить - заводите разные сессии под разные задачи, не ведите диалог в одной сессии, а то оно тупит, создавайте проекты для разных проектов, кеп. Но с моими агентами общаются только через telegram и один диалог. Какой-то обрезанный агент, да?

Нет. Только недавно стал понимать - это отдельный класс агентов. Индустрия идет многосессионным путем. Но это противоречит концепции ИИ сотрудника. С сотрудником не общаются в 10 сессиях. Сотруднику дают должностные обязанности и в этих рамках он учится работать. Мало кто любит работать за 10 сотрудников, может ли быть с ИИ сотрудниками так же?

Hermes из коробки умеет самообучаться - после беседы он обновляет свои skills автоматически. Со временем начинает перенимать tone of voice своего пользователя - если к нему обращаться "зайка", то он начнет так же отвечать. Поэтому стремлюсь к схеме 1 агент на одного человека, не насиловать гермеса всем отделом.

Шаг дальше - иметь несколько специализированных агентов, а не одного Claude Code / Codex, который меняет шляпы через скилы - сейчас психолог, а сейчас директолог, а потом проджект менеджер. Обучение на одном домене эффективней. Память тоже работает эффективно - в тикете по проекту не появится запись от психолога, потому что файлы вдруг оказались рядом. LLM нельзя строго научить, всегда есть опасность протечки контекста. Поэтому "Леша, научи агента отделять личное от работы" - не баг агента, а сигнал о том, что нужен второй.

Один диалог + свой tone of voice + рабочее место = тоже очеловечивание.

Получал замечание "общайся с моим агентом повежливее" от клиента. Несколько раз слышал, как люди учат агента общаться русским матом, каждый по своей причине. Как вы очеловечиваете ваших агентов?
  • ❤ 1
Post #156 84
Отклики на фрилансе может писать агент!

Еще один aha-момент. За последние пару недель оставил больше 20 откликов на fl.ru - фриланс-бирже. Лень было писать индивидуальный отклик по каждому клиенту, брал свой шаблон, немного правил и отправлял.

Сегодня дошло, что могу поручить это агенту. Можно поручить и просто ChatGPT - прикол, что мне нужно было до этого додуматься. Вот - додумался. Но агент делает это чуть лучше, потому что подключен к сайту iiworker.pro и вытаскивает актуальную информацию.

Все больше понимаю, что есть проблема в делегировании. Делегировать большую роль просто - есть стандартные роли, стандартные обязанности, нанимается человек, получает должностные инструкции и все (директолог). А вот с делегированием микрозадач - огромная проблема. Со времени поста о календаре все еще рефлексирую. Кажется "да тут пять минут, зачем мне агент", а на деле проходит 30-60 минут. Тут, там и день закончился, а самое важное не выполнено из-за таких микрозадач. Все еще не умею делегировать.

Какую пятиминутную задачу, которая на самом деле тридцатиминутная, забрал у вас агент?

〰️〰️〰️〰️〰️〰️〰️
@keeperblog
  • 🔥 4
  • 🤔 1
Post #155 146
Жизнь последние пол года в двух словах.
  • 😁 6
  • 🥰 1
  • 🤣 1
Post #154 166
Подожди-ка, у меня есть агент!

Делал визаран на днях и уже второй раз почти нарушил визовый режим. 3 месяца != 90 дней. В прошлый раз занес неправильно в календарь дату. В этот раз опять неправильно занес в календарь дату, но подруга спросила, когда еду и пересечемся ли как в прошлый раз на границе.

Сегодня в списке дел стояла задача сделать все правильно и занести в календарь. Открыть, прощелкать, сделать событие на последний день визы, сделать событие за неделю до визы. Подожди-ка, у меня есть агент!

Пишу голосовуху агенту. Не люблю голосовухи, но агенту их удобно отправлять. У меня виза заканчивается в такой-то день, за неделю нужно поставить 4ч большое событие заняться подготовкой и еще себе поставить напоминание, чтобы в тг напомнить. И можешь красным пометить? Может. Круто.

Делегировать нужно учиться… "просто начни делегировать" - не работает. Думаю теперь книжку по теме прочитать.

Есть у вас опыт делегирования?

P.S. Лет 8 назад заметил, что могу в сообщениях писать != - читается как "не равно", "отличается" и тп, но это из программирования. В матеметике . Писал так много и часто, а потом узнал, что не всегда это понятно. В этом тексте так же на автомате всплыло. Писать посты на одну тему все еще не получается.

〰️〰️〰️〰️〰️〰️〰️
@keeperblog
  • 👍 4
Post #153 145
Как дать агенту доступ к гугл-календарю?

Варианта два:
- oauth там где спрашивают разрешаете ли вы доступ на чтение и запись в любое время ко всем вашим календарям
- service account подобно тому как было описано в прошлом посте

Путь с сервис аккаунтом чуть сложнее, но позволяет выдать агенту минимальные права на календарь. Настройка выглядит так:
- создать сервис аккаунт и получить email
- дать права на free/busy на свой основной календарь - агент не будет видеть что именно у вас там даже если у него украдут доступ (а кража доступа у агентов это проблема следующего года, когда агенты будут у каждого)
- создать дополнительный календарь и дать полные права агенту на него

Детали описал в markdown - смотрите первый коммент.

Полтора года работаю с агентами и вот только сейчас делегирую ему ведение календаря. Договорился о созвоне, переслал агенту и забыл. Шаг за шагом продолжаю передавать даже мелкую рутину агентам. Чувствую как неумею делегировать и могу все сам делать 😁

Кто у вас управляет гугл календарем?

〰️〰️〰️〰️〰️〰️〰️
@keeperblog
  • 🔥 3
  • 👍 1
Post #152 134
Как дать агенту доступ к гугл-таблице?

Создайте сервисный аккаунт и расшарьте на него таблицу с правами редактирования - как расшарили бы обычному человеку. Сервисный аккаунт - это мини-аккаунт внутри вашего гугл-аккаунта со своим отдельным email вида xxx@xxx.iam.gserviceaccount.com специально для "робот-пользователей". Их можно создать сколько угодно и шарить доступ именно на них. Отдельно подготовил инструкцию для вашего агента, как это сделать.

ВНИМАНИЕ. Отправлять агенту инструкцию от незнакомого человека довольно опасно. Меня многие подписчики знают тут лично, поэтому так делаю. Но всегда будьте осторожны и читайте файл перед тем, как отдать его агенту.

P.S. Хотя думаю если агенту просто сказать: помоги мне сделать сервис аккаунт для редактирования гугл таблиц https://docs.cloud.google.com/iam/docs/service-accounts-create, то все будет отлично.

〰️〰️〰️〰️〰️〰️〰️
@keeperblog
  • 👍 2
  • 🔥 2
Post #151 198
Больно пользоваться своим продуктом.

Полтора года делал продукт, которым сам не пользовался - и почему теперь заставляю себя жить внутри своих продуктов.

Полтора года назад начал делать trip2g.com с идеей "делись знаниями из Obsidian по платной подписке".

Просто пошёл делать.
8 месяцев разработки.
Под монитором стикер: «получи $10/месяц на продукте».
Так и не получил стабильные $10/месяц.

В тот год боролся со славнопарнизмом - желанием помогать другим, жертвуя собой. Казалось, победил. А зараза пробралась в самое сердце: делал инструмент, чтобы _другие_ продавали _свои_ знания. Эээ… давай-ка свои продам.

Проект принёс в жертву Open Source: github.com/trip2g/trip2g.
До сих пор рад каждой звезде (байт на звезду).

Небольшая рамка, она дальше пригодится. Услуги бывают трёх видов:
DIY - сделай сам: продаёшь инструмент, работает клиент. Дешево.
DWY - сделаем вместе: работаешь рядом с клиентом. Пойдет.
DFY - сделаем за тебя: сдаёшь готовый результат. 💳

trip2g был DIY. И оказался никому не нужен: у людей нет гор знаний на продажу, а те, кто продаёт - давно нашли другие пути.

Ладно. Раз баз знаний нет - буду их делать. Человек пять лет ведёт канал и сам уже не знает, что у него есть. Прогоняю агентами, собираю базу - первый заход в DFY.

Для этого пришлось самому пользоваться trip2g. Каждый день. Как маленькой википедией. Для каждой собранной базы.

Оказалось УЖАСНО.

Несколько месяцев продавал продукт, от которого больно мне самому - автору. Полгода выгребаю баги. Каждый баг - мелочь на час-два. Но их тонны.

Всю жизнь думал, что делаю продукты «как для себя».
А сам ими не пользовался.

Продукт, которым не пользуется каждый день даже автор - не продукт. Иллюзия продукта.

Сейчас основное - hermes: агенты для автоматизации операционки. Разбираем рутину, находим тот самый час, садим агента. 1 час = 1 агент = $200/месяц. Это DWY - сделаем вместе. Работает. И честно - я от него уже подустал: каждый клиент - это моё время. $10/месяц на продукте до сих пор не знаю как заработать, а $200/месяц уже проверенная рутина.

Правило теперь железное: сначала живу в продукте сам - потом продаю. ЖИВУ КАЖДЫЙ ДЕНЬ, не рассказываю как это круто, а просто получаю результат.

Обкладываю себя агентами. Агент с моей экспертизой. Агент для публичных сайтов. Агент для недельных целей. Агент для контекста агентства. Задача на год - сотня автономных изолированных агентов вокруг себя. Но старт с 24 агентов - экономить себе каждый день 24ч. Как будто суть бизнеса - делать чужими руками то, на что не хватает собственных суток.

Почему маленьких и изолированных: за одним большим Claude Code легко спрятать нестабильный процесс. Сотня маленьких безжалостно показывает, какие процессы на самом деле живут.

Те, что выживут на мне - станут кирпичиками. DFY без кастомизации: готовый агент для бизнеса с понятной метрикой, результатом и ценой. Не «сделаем вместе за моё время», а «вот кирпич, он делает вот это, стоит вот столько».

Такой путь из найма. Перестать быть кирпичиком и начать строить процессы из кирпичиков. На людях или агентах. На агентах дешевле.

Что ваш агент делает хорошо каждый день без допила?

〰️〰️〰️〰️〰️〰️〰️
@keeperblog
  • 🔥 6
Post #150 157
Программисты больше не нужны

15 лет моя функция была простая:
написать код и проверить, что он работает.

Писал много.
Проверял не всегда.
Надеялся на авось.
И каждый раз, когда не проверял - заказчики ругались.

Пришла нейронка и забрала первую часть.
Код теперь пишется сам, в 100 раз быстрее.

А вторая часть осталась.
Проверить.

Нажать на каждую кнопку.
Понять что она действительно выполнила свою работу.
Автоматизировать проверку, потому что их тысячи.
Ответить на вопрос: как сработает кнопка,
когда на диске кончится место?
А оно кончится. Через пару месяцев. Ночью. Когда вы спите.

Так что да - программисты больше не нужны.
Профессия «писать код» закончилась.

Осталась профессия «отвечать за то, что оно работает».
Она была всегда. А как она называется? Хрен знает.

〰️〰️〰️〰️〰️〰️〰️
@keeperblog
  • 👍 2
  • 🔥 2
  • 🤔 1
Post #149 163
API, CLI, MCP на пальцах.

API - application programming interface
CLI - command line interface
MCP - model context protocol

Интерфейс проще всего представить как форму розетки. Если есть правильная вилка, то можно воткнуть её в розетку. Иначе нужен будет переходник. Интерфейс - широкое понятие:
- человек принимает заявки только по телефону - у него телефонный интерфейс
- государство принимает запрос через заполнение формы - тоже интерфейс

Протокол - правила разговора. Деньги утром, стулья вечером.

API - это интерфейс программы. Программа буквально говорит: пришли мне такой запрос - и вот так я отвечу. Какие именно запросы и как она отвечает, описано в документации.

CLI - это более узкий интерфейс для программ, работающих в терминале - то самое чёрное страшное окошко из фильмов про хакеров. Такой интерфейс проще оконного в разработке и в использовании. Сложен тем, что нужно сначала изучить и не получится наугад ткнуть мышкой в кнопку.

CLI также можно назвать API под конкретную среду - чёрный терминал. CLI чаще всего несёт документацию вместе с собой: например, есть GitHub CLI gh, и без проблем можно понять, как с ним работать, через gh --help, gh help или что-то такое. GitHub CLI - очень известный CLI, агент помнит его наизусть, но если что-то забыл - знает, как получить помощь. CLI можно обернуть в MCP как и любое другое API.

MCP - это API + документация. Протокол говорит: сначала получи документацию, как можно пользоваться API, и потом дёргай этот API. Подключение агента по MCP означает, что агент при старте запрашивает документацию "как пользоваться", и когда пользователь просит обработать связанный запрос, то дёргает сервер описанным образом.
Если у сервиса есть API, то всегда можно написать адаптер и получить MCP. API → MCP-адаптер → агент. Такие адаптеры агент легко пишет сам, и служат они для экономии токенов. Один раз просим агента разобраться, как работает API, и делаем MCP - в следующий раз агент просто получит API + доку и начнёт работу. Альтернатива - просто написать SKILL: вот так дёргай API, вот такой результат получишь.

На GitHub сейчас огромное количество таких поделок. Например:
- https://github.com/eduard256/ozon-mcp-server
- https://github.com/atomkraft/yandex-metrika-mcp

С первого взгляда кажется - ого, готовый MCP! На деле это вайбкодинг-адаптер, сделанный за 10-20 минут, непонятного качества, который может сломаться от любого чиха. Проще попросить своего агента написать такой под конкретную задачу или обратиться к разработчику с просьбой сделать хорошо.

Нужно больше таких разборов?

〰️〰️〰️〰️〰️〰️〰️
@keeperblog
  • 👍 2
  • 🔥 2
  • ❤ 1
Post #148 162
Первородный грех - гарантированный баг в системе и он гарантированно не даст нейронке писать без багов.

Что значит? 2000 лет назад рассказали о лучнике, который не может попасть в цель. Может попасть очень близко к цели, но не может попасть точно в цель. В ИТ можно сказать, что каждый гарантированно рожден с багом, который не позволяет дойти до цели. В лучшем случае будет где-то рядом.

Это больно. Каждый день ошибаются люди - все привыкли. Каждый день ошибаются нейронки и такое количество негатива ощущается… постоянные попытки допилить свой харнес, постоянные попытки добавить еще один скилл, постоянные поиски лучшей комбинации моделей, циклы самопроверок. Кто-то даже прикладывает русский мат https://github.com/smixs/pohuy - ИМХО крайняя форма отчаяния.

Все попытки про "дожать до конца", чтобы вот прям гарантированно заработало как нужно. Вот чтобы вообще было красиво. Как будто нет радости от того, что нейронка уже сделала все, на что способна. Результатом уже можно пользоваться.

А что делать? Смириться, что человек не может написать идеальный промпт, смириться что нейронка не может выдать идеальный результат. Извлекать выгоду из того, что получается в таких кривых условиях.

Все еще дожимаете до идеала?

〰️〰️〰️〰️〰️〰️〰️
@keeperblog
  • 👍 2
  • 🙈 2
Post #145 173
Зачем руками ведёшь таблицу лидов? У тебя же есть агент.

На этой неделе начал тестировать ЛидАгент. Звучит громко, но это всего лишь индексатор тг-групп и агент для поиска клиентов. Несколько часов беседы с агентом (обучение сотрудника), и машина сама отбирает самое интересное из сотен групп.

Пожаловался другу, что нудно собирать таблицу лидов в google docs. До большой CRM пока не дорос, а таблица нужна, чтобы считать конверсию и эффективность. И получил вопрос: а как же агенты? Да… слушай, попробую.

Полтора года занимаюсь агентами, а такую мелочь автоматизировать легко, заметить тяжело. Сам не додумался. Теперь буду чаще писать о таком в канале. Поделитесь похожими историями в комментах?

Вдогонку история о последнем ролике про ЛидАгента. В этот раз протестировал Seedance Pro, ещё одну нейросеть для генерации видео (тоже на fal.ai). Дешевле Kling, а результат лучше.

Смета по ролику:

- nano-banana-pro (кадры, ~15 шт с регенами): ~$2.0
- Kling i2v (мемы, выброшены): ~$1.5
- Seedance Pro/Lite (мемы + 7 кадров + сплит робот/семья + тесты, ~12 клипов): ~$5.2
- ElevenLabs озвучка (~28 перегенераций): ~$1.1
- ElevenLabs SFX (7 звуков): ~$0.56
- 2ч кожаного инженера: $200

Получается коробка за ~$210: на вход берёт голосовое, на выходе рилс. Дальше каждый такой ролик стоит уже ~$7 генерации. И это сложное видео. А второй ролик, с зайцами, делается из готовых персонажей плюс сценарий, генерация стоит меньше $0.1. Уже хочется попробовать тысячу таких роликов сгенерить и вылить просто для анализа того, залетит ли и что именно.

И какую близость чувствую с лисом в этом мире AI...
  • 😁 3
Post #144 348
Сегодня открыл для себя новый способ взаимодействия с заказчиками.

Уже несколько месяцев понимаю, что перестал писать код для людей, пишу для агентов MCP. А уже агент как-то там договорится с человеком. Текстовый интерфейс, ИМХО, удобнее, чем космические корабли с сотней кнопок.

В этот раз сделал так же.
Человек просил аналитику.
Сделал сложную часть на бекенде и дал его агенту MCP + скилл, как пользоваться. Мол, давай пока так, на коленке, и там видно будет…

Сегодня он мне показывает это.
Его агент навайбкодил фронтенд для моего MCP.
Прям такой, какой он хочет.
С каким хочет дизайном и с какими хочет кнопочками.
Позвонил и говорит "что-то мой агент какой-то ssh спрашивает".

Мне достаточно было сделать гибкий API - и работа выполнена. На стороне заказчика агент уже будет "играться со шрифтами".

Человек никогда не вайбкодил.
  • ❤ 6
Post #143 249
Антропики сегодня дали бесплатно 3 ultrareview на своих серверах. Каждый такой запуск стоит $5–25 по их плану.

Думал вогнать туда весь свой текущий проект как один PR, но есть ограничение на 500 файлов и 8к строк - халявы не получилось.

Но можно попросить клод собрать все последние изменения ровно под это ограничение и получить 3 бесплатных взгляда с высоты топового решения антропика на свой проект.

Запустил - нашёл несколько уязвимостей, которые просочились в код за последние пару недель разработки.

В комментах оставлю промпт "для друга". Теперь интересно, смогут ли энтузиасты разобраться, как именно это устроено внутри, и повторить открыто на том же уровне. Хотя даже так это выглядит как выгодное предложение.
  • ❤ 2
Post #139 210
Проблема:
- Kling Avatar делает сносный липсинк и движение персонажа, но не умеет анимировать фон
- Kling i2v генерит класные сцены, но без липсинка.

Попробовал собрать видео из 3 разных слоев:
- анимированный задний фон
- персонаж (зачем-то нейронка сделала его шагающим)
- дым перед персонажем

Получается как в играх на консолях - несколько разных слоев картинки, которые создают цельную картинку.

* каждое видео создается чисто промптами Claude Code, который вызывает fal.io и подобные сервисы через API.
  • 🔥 2
  • ❤‍🔥 1
Older posts →

About this channel

How can I read @keeperblog without a Telegram account?
TGViewer shows the public web preview Telegram publishes for Системная лаборатория AI: recent posts, photos, videos and the subscriber count, with no app, login or account.
How many subscribers does Системная лаборатория AI have?
Системная лаборатория AI (@keeperblog) has 86 subscribers on Telegram, refreshed roughly every 30 minutes.
Does Системная лаборатория AI know I viewed it here?
No. Public channel previews carry no viewer identity, and TGViewer has no accounts or tracking of what you look up.
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →