TGViewer
Channel Public Channel
AI и грабли

AI и грабли

@ai_grably

Строил HR продукты для американского бигтеха. Внедряю AI в бизнес, пишу про свои ошибки и находки

Моя студия: https://grably.tech
Наши с @max_about_ai конференции: https://entropy.talk

ЛС: @nikolay_sheyko
Subscribers
13.6K
Photos
210
Videos
22
Links
254
Recent Posts 11 shown
Post #569 1.42K
AI и грабли ⬆️ Расскажу про vscode moment для агентов и нативный способ дать клод коду оркестрировать кодекс агентов и наоборот
Стартуем
https://youtu.be/rQWGshpC1rc?t=661
  • 😁 9
Post #568 2.67K
Константин Доронин Что вы знаете про bb? Они называют себя "AI IDE that builds itself". Достаточно молодой проект, который из коробки закрывает целый спектр задач, где раньше приходилось велосипедить всем колхозом. В текстовом варианте можете почитать отличный обзор у Рефата.…
⬆️ Расскажу про vscode moment для агентов и нативный способ дать клод коду оркестрировать кодекс агентов и наоборот
  • 👍 19
Post #567 2.29K

Forwarded from Константин Доронин

Что вы знаете про bb?

Они называют себя "AI IDE that builds itself".

Достаточно молодой проект, который из коробки закрывает целый спектр задач, где раньше приходилось велосипедить всем колхозом.

В текстовом варианте можете почитать отличный обзор у Рефата.

Я же хочу предложить вам совместно изучить bb в формате практического стрима.

Вместе со мной разбираться в особенностях этой IDE будут:

1. Рефат, автор канала "Refat Talks: Tech & AI" (кстати, у нас с Рефатом есть классный стрим про фреймворк Mastra)

2. Коля, автор канала "AI и грабли"

Проходить стрим будет на моём YouTube-канале.

Дата и время: 21 сентября, 19:00 GTM+3

Ссылка для добавления события в календарь

p.s.: Почему парень из Сингапура назвал проект так, будто забыл переключить раскладку на русский язык, чтобы написать "ИИ"?
  • ❤ 9
  • 👍 2
Post #558 4.47K
Поспорил я тут на днях в баре с одной дизейнеркой интерьеров

Говорит, что ваши эти ИИшки не держат геометрию и помещают в комнату объекты, которые там физически не могут находиться. А я ей – что ИИшки могут 🤷‍♂️

Говорит, кто проиграет пари – оплачивает весь банкет. А я человек азартный, мне часто вообще пофиг на что именно спорить, да и выпендриваться я люблю. А тут еще и такая возможность Астру потестить в ее родных задачах, чего я до сих пор нормально не сделал

Входные условия достаточно неприятные – чертеж и 4 плохих фотки. Но у меня настроен remote коннект на ноут, который в апартах на столе стоит включенным и пару ресетов в запасе

В целом то она права – если просто сгрузить все в кодекс и сказать наложить дизайн, то он тупо вызовет imagegen и геометрия точно поедет

Но мы уже решали похожие задачи и знаем, что вся соль – в создании промежуточной детерминированной модели. В нашем случае – просто 3д сцены квартиры. Можно в каком-нибудь CAD'е или blender'е, но тут с этим даже не заморачиваюсь

Взяв чертеж и загуглив проектную документацию здания (чтобы найти высоту потолков), агент строит базовую модель. Тут все ок

Дальше осталось расставить 3д объекты мебели, подогнать виртуальные ракурсы под камеру и уже по 3д сценам запустить генерацию секси картинок в нужном стиле

Пока агент работает, я попиваю джин-тоник и рассказываю всратые истории про Таиланд

Подгонка камер оказалась сложнее чем я думал и важнее, чем я думал. Я то хотел просто красивые картиночки со слайдерами сделать (см выше), чтобы наглядно показать корректную геометрию комнат. А на самом деле это важно, чтобы определять точные размеры и положение других объектов в помещении

Например вон тот радиатор у окна сильно влиял на ширину "спальни" и было не понятно, влезет ли кровать – нужно было точно знать его расположение

Поэтому я немного упоролся и отправил агента сначала сделать детектирование углов и линий стен, а потом накинуть немного матмоделирования – по сути итеративную подгонку положения и углов обзора камеры, пока линии виртуального мира не сойдутся с линиями на фото

Получается такая цепочка:

чертеж
→ 3d сцена
+ детектирование линий стен
→ локация камер
+ детектирование контуров батарей
→ 3d сцена с батареями


Где-то в этот момент мы тоже занимаемся определением локации – локации следующего бара, так как предыдущий закрылся

Как только локация камер и бара установлена, мы делаем уже обратную процедуру по локализации батарей: зная положение стен относительно камеры и видя на ней радиаторы, можно точно определить их координаты на этих стенах

Не все проходит гладно: агент использует классический CV для определения линий стен и где-то он триггерится на пятна краски вместо реального угла, а из-за кривого освещения в 3d сцене imagegen не правильно распознает границы стен у потолка на паре кадров

Где-то в этот момент параллельная экспериментальная задача из другого проекта убивает мой ноут и коннекшн теряется. Через 20 минут и этот бар закрывается, я по-джентльменски закрываю счет, и заказываю такси до дома. К утру все готово, но у меня не сохранился ее контакт, так что делюсь ссылкой с вами:

Ссылка с интерактивными штуками

(история выше – художественный вымысел, а все совпадения с реальными людьми – случайность)
  • 🔥 68
  • 😁 30
  • ❤ 19
  • 🥱 7
  • 👍 6
  • 🤡 3
  • 🤔 2
Post #556 5.44K
Разбор аудиорежима в кодексе

Будет особенно интересно тем, кто сам разрабатывает что-то подобное.
Но и просто пользователям тоже постарался сделать полезным – чтобы понимать ограничения таких систем и лучшие практики взаимодействия с ними


Короче, я тут на днях делал себе компрессы для глаз (*звуки деда*), а они прям полностью глаза закрывают, там такая маска, типа как для сна

Ну и вместо того, чтобы спокойно посидеть и подумать о вечном, я врубил диалоговый режим кодекса и проболтал с ним пол часа вместо положенных мне 15 минут

Стало интересно, че это он такой умный, и я полез реверсить билд кодекс аппа – реализация оказалась одновременно и простой, и глубокой. А сам подход можно использовать не только для аудио (но об этом в конце поста)

В общих чертах – вы общаетесь не с самой gpt-5.6-sol в полноценном кодекс агенте, а с тупенькой моделькой gpt-realtime-1. Тупенькой, но быстрой. И заточенной под диалоговый формат с переживаниями – без этого естественности не добиться и любое общение будет мучением.

Так вот, пока у этой модельки хватает сил самой с вами общаться - она будет. Но как только нужно будет сделать что-то сложное, она побежит к кодекс агенту и даст ему задачку. В этот момент сразу же скажет вам что-то вроде «ну-ка дай подумаю» или «так, разбираюсь». Это важно, чтобы мы чувствовали непрерывность общения – как с людьми

Такой типа эффект Джарвис. И это реально работает!

Получается интересная система, очень похожая на ту, которая бывает в обычных айти командах:

- есть менеджер, который всегда онлайн и быстро отвечает, и который общается с заказчиком

- есть исполнитель (например, разработчик), который пилит фичу и отвечает по несколько часов в перерывах между сфокусированной работой

А менеджер ему еще по ходу докидывает задачки, если у заказчика появились новые хотелки

Что интересного из этого следует для нас как для пользователей:

1. Если в процессе выполнения слишком много докидывать новые хотелки, то результат получится плохим: если вы когда то пробовали отправлять steer сообщения в чат работающему агенту, то вы скорее всего замечали – они часто его слишком сбивают с начального пути (ну реально, все как с человеками)

2. Как и в реальных командах, если хотите рулить через одного менеджера несколькими процессами – нужен еще тимлид для команды. Поэтому можно просить выступать в этой роли и ничего не делать самому, а для всех задач на исполнение создавать либо отдельные чаты, либо субагентов. Тогда получится:

Менеджер
⬇️
Тимлид
↙️⬇️↘️
Исполнитель1, Исполнитель2, ..., ИсполнительN

Тогда выполнение одной задачи не будет блочить главного думающего агента и будет наш привычный опыт, когда в параллель работают несколько чатов, но только с голосом в качестве канала передачи инфы

Что тут полезного для тех, кто сам делает AI продукты/фичи

Мне кажется, можно забрать сам подход с тем, что сессия основного агента не видна пользователю напрямую, а есть какой-то прокси уровень коммуникации. И это не обязательно должен быть голос. Это может быть какой-то визуальный слой (скоро поделюсь своими экспериментами с Liquid UI), или даже обычный текстовый, но в привычном интерфейсе условного Slack, с быстро отвечающей моделью, которая подтягивает контекст из сессии умного, но долгого агента

Ну и если вы делаете голосовых роботов, то советую отправить агента посмотреть, в чем отличие вашей системы от кодекса – мб захотите что-то к себе перетащить

И последнее – если вы хотите лучше разбираться в том, как сейчас строить ИИ продукты, но еще почему-то не реверсите реализацию топовых кодинговых агентов – очень советую начать. Это прям кладезь лучших практик

P.s. я, конечно, очень сильно упростил работу менеджеров – на самом деле они делают гораздо больше, чем gpt-realtime-1. Это просто самая близкая и наглядная аналогия, которую я придумал. Если у вас есть лучше, прошу в комменты


@ai_grably
  • ❤ 32
  • 🔥 16
  • 👍 10
  • 🤔 3
  • 👎 1
Post #555 6.78K
↑ Cейчас разбирал с Фейблом system card gpt-6-astra и чет опять такими вайбами ai-2027.com повеяло, ух

Полтора года назад, когда она жестко зафорсилась в ИИ пузыре, ее мало кто реально прочитал, зато много кто высмеивал в нереалистичности (classic).

В целом не удивительно – тогда более-менее в теме актуальных возможностей ИИ были единицы, да и то скорее аккуратные скептики. Да и английский в статье не самый простой. Если кто пропустил, но хочет прочитать – напоминаю, что я тогда выложил перевод на хабр. Даже обе концовски сделал – можно выбрать свою

Перевод, кстати, уже тогда был полностью сделан нейронкой (даже картинки), хотя и с кучей хаков, чтобы это было комфортно читать

Есть всё-таки что-то ироничное в том, что текст про опасности ИИ полностью переведен самим ИИ


Время чтения – пару часов, ощущения – бесценны

https://habr.com/ru/articles/898622
  • ❤ 26
  • 🔥 13
  • 👍 5
  • 💩 1
  • 🤡 1
  • 🤣 1
Post #554 6.69K
Видел недавно интересный тейк, мол, все только хвастаются как внедряют ИИ, но конкретных успешных кейсов никто не показывает. Да и вообще, большая часть ИИ пилотов в компаниях – провалилась

Ну во-первых, большая часть пилотов и должны проваливаться по определению – это проверка гипотез

А во-вторых, я вижу, что реально успешные внедрения идут не от разработки кастомного решения, а от правильного онбординга уже готовых универсальных агентов (codex/cc) внутри компаний

Даже своих клиентов я сейчас отговариваю от кастома – вместо этого мы стали настраивать им агентную инфру с управлением скиллами, трейсиноом сессий и управлением доступами

Но это для среднего и малого бизнеса. Про крупняк я очень скептично настроен. Но на конфе от Community Sprints ребята обещают кейсы успешных применений в нетехнических командах известных компаний. Ну, посмотрим

Участие бесплатное и без подписок на спикеров (🫢)

Я там тоже как-то затесался – покажу один из своих любимых кейсов:

Продуктовый/маркетинговый рисерч агентами по одному из самых богатых, но наименее индексируемых хранилищ информации – ютубу

Еще будут крутые ребята из известных компаний (круто, что и РФ и международка). Весьма no-bullshit состав, на мой взгляд - многих знаю лично

8-10 сентября со стартом в 18:00 по мск

Бесплатная регистрация и подробности по темам – у ребят на сайте
  • 🔥 25
  • ❤ 10
  • 🤣 9
  • 👍 6
  • 🤡 3
  • 😁 1
Post #553 6.57K
Если вы давно в этом канале, то знаете, что я люблю делать диванные прогнозы на будущее. Один из новых прогнозов:

Скоро у openai появится агентная модель уровня sol+ с нативным audio инпутом как у gemini (ставлю на до конца года)


Что это будет значить для нас:

Для всех, кто работает с генераторами музыки, диалоговыми аудио ботами, монтажем подкастов и т.д. – это огромное подспорье.

Как нативное понимание image когда-то позволило сильно прокачать возможности агентов во фронтенде, дизайне и любом другом визуале – если агент "видит" результат работы, он сразу может найти косяки и исправить их. Тот самый feedback loop, где feedback – это сам результат работы

Так же будет и с аудио. Сейчас я работаю с локальными генераторами аудио и voice cloning, и этого прям жестко не хватает. Поэтому приходится использовать самодельную версию агента с модельками gemini по API. Из альтернатив есть Antigravity – они добавили это к себе буквально через пару недель после моего эксперимента, причем сразу и с поддержкой видео (это, кстати, единственная причина использовать Antigravity, которую я знаю)

Если кому интересно, на чем основывается предсказание про появление омни модельки от openai:

Примерно месяц назад я расковырял новый коммит в codex-cli, который добавляет audio как валидный тип результата для tool_calls (наравне с text и image). Так же они добавляют это в поддержку MCP. И даже в dynamic_tools (это тулы, которые можно инжектить в codex извне. Например, codex desktop, который под капотом запускает codex, инжектит туда тулы для управления встроенным браузером и соседними чатами.

Короче, раз поддержка добавлена в харнес, то и модели должны быть на подходе

Ваш диванный предсказатель, @ai_grably
Telegram AI и грабли Несуществующие агенты для аудио В последнее время много работаю с генерацией аудио. И удивляет, что в основном аудио пайплайны собираются в условном comfy – визуальном блочном редакторе. Удивляет, потому что это как писать код пайплайном в n8n вместо клода/кодекса…
  • 🔥 17
  • ❤ 10
  • 👍 5
  • 🗿 3
Post #551 6.22K
Недавно меня удивил один мой приятель: "Коля, а чем ты еще занимаешься, кроме курсов?"

В этот момент я пил чай и даже поперхнулся

Вообще, вся моя образовательная деятельность - это процентов 10-20 моей занятости, а с точки зрения денег - скорее благотворительная (не считая b2b воркшопов), учитывая, сколько денег и времени уходит на маркетинг

Деньги я зарабатываю тем, что с небольшой командой мы делаем разные сложные ИИ-автоматизации для бизнеса – от финансовой отчетности и агентов для авиации до авто-чаттеров онлифанс агентствам


Зачем тогда вообще делать какие-то курсы и портить себе репутацию инфоцыганством? Да хз на самом деле. Кажется, меня просто раздражает, как медленно происходит проникновение ИИ в русскоязычном обществе и хочется это хоть как-то компенсировать.

Знаете, что-то из серии: "да почему вы блин не понимаете, что это волшебная палочка"

На практике оказалось, что b2c курсы сейчас очень сложно продавать – и рынок эдтеха падает, и спецы часто видят скорее угрозу в ИИ, чем карьерный рост или возможности меньше времени заниматься нелюбимой частью работы, да и просто блин кризис и люди больше экономят. (Ну и я так себе инфоцыган, чего уж)

———

В общем, это будет последний такой широкий b2c поток. Дальше если что-то и будет b2c-шное, то только для руководителей и предпринимателей и только по предварительному отбору и сильно дороже

Для всех остальных сегодня еще можно запрыгнуть в последний вагон нашего марафона. В отличие от большинства курсов, он реально работает - до конца первого потока дошли 85% участников, что просто заоблачная цифра для любого онлайн обучения

Ну и люди, которые до этого пользовались ИИ как чатом (даже если делали это в клод коде) превратили его в своего личного ассистента, который почти не отличается по возможностям от того, что настроено у меня. В общем, получилось то, за что правда не стыдно.

- Начало 1 сентября
- Задачи по будням на 15-20 минут
- Задачи со звездочкой для тех, кто хочет упороться
- Вылет за несделанную домашку
- Вайбовый чатик
- Дошедшим до конца марафона – пак с топ-5 моих лучших отточенных скиллов


Узнать, подойдет ли марафон

Вот отзыв участницы нашего прошлого потока
  • 😁 21
  • ❤ 14
  • 🔥 9
  • 👍 3
  • 💩 3
  • 💯 3
  • 🗿 3
Post #550 5.31K
AI и грабли CLI → SDK Выше я писал про то, почему с MCP переходят на CLI (кроме некоторых ситуаций). Сегодня – про еще один переход, которы у меня случился пару недель назад Рассмотрим на примере коннектора к тг У меня самописный CLI тул, куда я понемногу добавляю…
Много скептицизма прилетело в комменты и даже мне в лс по посту про агентов, которые пишут код ad-hoc вместо использования готовых CLI

На самом деле очень рад – это значит, что подписчики вдумчиво читают посты и готовы делиться своим мнением. Ну и я так получаю перспективу, которую сам раньше не замечал, спасибо


А теперь еще один аргументом в сторону моей позиции, который вам может понравиться:

Понятно, что доверять какому-то экспериментальному подходу от Коли сложнее, чем официальному подходу от топовых ИИ-лаб. Так что просто посмотрите на встроенные скиллы того же кодекса. Подход, про который я пишу уже используется в большинстве из них:

Browser/Chrome – inline JS через Node REPL и browser-client
Computer Use – inline JS с @oai/sky
presentations
spreadsheets — генерируют .mjs с @oai/artifact-tool
documents
 – код через python-docx (но: есть готовые CLI-хелперы)
pdf
 – Python с reportlab/pypdf/pdfplumber

Понятно, что не нужно все переводить на этот подход

Но вот скинуть агенту мой прошлый пост и спросить, какие из ваших скиллов могут выиграть от этого подхода так же как выигрывают скиллы кодекса из этого поста – может оказаться полезным упражнением
  • ❤ 16
  • 👍 11
  • 🤯 1
Post #549 5.98K
Сколько нужно денег, чтобы было не нужно?

В этот раз меня позвали на совсем не типичную для меня конфу – про то, о чем почти не говорят на публике – личные бабки и стратегии выхода на пенсию (у меня её нет). Спикеры интересные, четырех я регулярно читаю

Я решил поиграть на эфире в бунтаря и рассказать, какой капитал важнее денег, как его растить и не продолбать

Когда: 3 сентября (ЧТ) в 18:00 мск
Стоимость: подписка на каналы спикеров

📱 Регистрация в боте по ссылке 

Кто будет на эфире кроме меня:

Владислав Носковец (CEO CareerStation, автор канала «Твой ментор», помогает IT-менеджерам находить работу) Поделится своими источниками дохода и расскажет, почему не планирует выходить на привычную всем пенсию

- Иван Глушенков (внедряет ИИ в финансовые организации, закончил физтех, выиграл 18 хакатонов) Расскажет, как 5 лет жил с бюджетами по книге «The Richest Man in Babylon» и разбогател, а потом 5 лет прожил без бюджетов и почему. Про 4 типа капитала, старость и финансовую безопасность на основе анализа успехов 250 человек ежегодно

- Глеб Кудрявцев (руководитель ИИ-лаборатории, ex-CPO Skyeng) Руководил более чем 200 людьми, а теперь пишет код и строит бизнес с ИИ. Расскажет, как рассчитывает дожить до сингулярности и жить при коммунизме

- Максим Романовский (Head of AI & Product Engineering) Расскажет, как ИИ помогает повышать финансовую грамотность, покажет свои примеры использования ИИ и какие задачи уже сейчас делегирует

- Таня Савельева (фаундер UplinkAI, 2 экзита, Forbes 30u30) Расскажет, почему не ведёт бюджет и вам не советует

- Катя Курашева (Founder & CEO R-Founders) Основатель глобального сообщества R-Founders для фаундеров и C-level. Поделится неожиданным выводом: почему у tech-предпринимателей личного капитала часто в разы меньше, чем у тех, кто строит физический бизнес

- Юлия Билинкис (основатель Strategicmove education) Расскажет, почему на старость нужно копить не капитал, а покупать будущие денежные потоки и уменьшать будущие обязательные расходы

Регистрация
  • 🔥 15
  • ❤ 9
  • 🤡 4
  • 💩 3
Older posts →

About this channel

How can I read @ai_grably without a Telegram account?
TGViewer shows the public web preview Telegram publishes for AI и грабли: recent posts, photos, videos and the subscriber count, with no app, login or account.
How many subscribers does AI и грабли have?
AI и грабли (@ai_grably) has 13.6K subscribers on Telegram, refreshed roughly every 30 minutes.
Does AI и грабли know I viewed it here?
No. Public channel previews carry no viewer identity, and TGViewer has no accounts or tracking of what you look up.
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →