TGViewer
Channel Public Channel
Agentic World

Agentic World

@anti_notes

Про AI, LLM, агентов, продукты и людей
Subscribers
1.21K
Photos
50
Videos
7
Links
37

Showing posts older than #72 · Back to latest

Older Posts 14 shown
Post #70 995
HIGH EFFORT и за все надо платить
Вчера Антропику поплохело - в их датацентр в ОАЭ что-то прилетело. Об этом я узнал достаточно интересным образом: я делал микро-задачку в вебе - вот прям буквально заменить пару блоков в верстке. Это была финальная микро-правка и поэтому режим "high effort" уже снимать не стал. Написал задачу, отправил, и переключился на дела в кодексе. Вернувшись минут через 10 я увидел до сих пор крутящийся слайдер. Обновил - крутится. Гугланул новости - "в aws что-то прилетело", ну ок, ждем, я никуда не спешил. Спустя еще какое-то время выдалось сообщение о проблемах с контейнером (на их стороне бэка), после чего слайдер опять начал безмолвно крутиться.

Я очень увлеченно делал дела с кодексом, и спустя, наверное, еще минут 20 решил проверить что же там было.

"Бро, у меня проблема с докером, проблему так и не починил, правки внести не могу и я их потерял, перепробовал все что мог. Кстати, я на эту микро-правку в процессе добил 30% твоего недельного лимита, приходи в субботу теперь"

P.S.: я нашел для вас эксклюзивные фотографии объекта, прилетевшего в ДЦ
  • 😁 9
  • 🤯 2
  • 🐳 1
  • 🤣 1
Post #69 1.03K
Context automatically compacted 🦾

Все мы знаем, что у модели есть контекстное окно, но это - очень непростая вещь. Заявляется, что оно, например, один миллион токенов, но на деле только около половины из них эффективны, поскольку после этого начинается контекстный дрейф или вообще деградация. Это ожидаемое поведение трансформеров, но замеры там очень интересные - у меня есть в бэклоге перевод классной статьи, где такое замеряли, скоро доберусь.

При работе с фанатичной кодогенерацией контекст забивается достаточно быстро, поэтому для продолжения работы требуется процесс, который называется компактизация - это когда все накопленное сжимается до определенного уровня. Существуют разные механизмы компактизации: вычленение фактов, суммаризация, скользящее окно, грубое обрезание и многие другие под задачу. Очень важно знать, какая именно компактизация происходит, а в идеале - не доводить до этого, либо контролировать процесс самостоятельно.

Когда мы заканчиваем задачу и переходим к новой, проблем зачастую не возникает, так как у нас нет предыдущего контекста. Самый жесткий случай компактизации, который у меня был, произошел, когда я так увлекся, что накидал много мелких задачек в чатике и затем дал делать сложную задачу про шифрование сообщений. Агент пыхтел 12 минут, дозабил все окно, затем сделал сжимание контекста, а затем благополучно продолжил работать над задачей еще 14 минут.

Он изменил 31 файл, но на выходе сообщил, что изменил цвет кнопки и увеличил шрифт. Я сначала не мог понять о чем речь, но потом все быстро понял: я действительно в самом начале чата просил это сделать и на сломе контекстного окна эта задача стала самой важной и приоритетной и в итоге получилось не шифрование, а мусор.

Поэтому лучше не доводить до компактизации, особенно до той, про которую мы детально не знаем как именно она делается.

P.S.: мем с собаками - один из моих любимых, обожаю вставлять его в серьезные презы 😀
  • 💯 3
  • 👍 2
  • 🤔 2
  • 🌚 1
Post #67 966
sam-hinkaltman.mp45.7 MB sam-khinkaltman.mp48.6 MB
Пока готовлю большой пост о своих экспериментах с промышленным агентик кодингом (будет интересно!), поделюсь забавностью - в какой-то момент ChatGPT-5.3-Codex решил частично перейти на грузинский. Эта штука зовется language leakage и случается из-за того, что трансформеры мультиязычны и в одном и том же эмбединг-пространстве живут одинаковые по смыслу слова из разных языков. В какой-то момент LLM решила ̶с̶ъ̶е̶с̶т̶ь̶ ̶х̶и̶н̶к̶а̶л̶е̶й̶ провалиться в грузинский, а потом резко вернулась обратно. Регулярно вижу китайский и прочий миссленгвидж во внутреннем ризонинге многих моделей, но грузинский - вижу первый раз.

Решил погенерить, что могло быть за кадром: Qwen-Image и Seedance 1.5 😅 Как же это все чертовски увлекательно, а 🤖💥
  • 🔥 6
  • 😁 6
  • ❤ 2
  • 🐳 1
  • 💅 1
Post #66 1.22K
Идеальный DX
Одна из самых мощных фичей агентов, за которую мы их так любим, - это планирование. Можно проектировать законченные по смыслу фичи (двигаясь итерациями) или же просто бабахнуть верхнеуровневое описание чего-либо и затем получить нечто готовое, что надо аккуратно довести до ума. Любой более-менее умный агент имеет функцию предварительной оценки поставленной задачи - "мне идти ее делать сейчас или сначала стоит немного подумать".

Как правило, с планом результат получается сильно лучше, но я люблю разрабатывать именно фичами, поэтому даже если планирование и включается, то требует лишь визуального ревью и с которым я сходу согласен.

Но тут я влез в большой рефакторинг и наткнулся на феноменальную фичу в Claude Code. CC разработал план, но в некоторых пунктах он засомневался над тем, как сделать лучше - и прерывается на обратную связь, предлагаю варианты и кратко описывания плюсы/минусы каждого из них.

Это очень круто само по себе, но я обратил там внимание на не самую заметную штуку "Chat about this" и это просто нереальный DX (это как UX, только именно developer experience): вот CC спрашивает у меня хочу ли я дропнуть какую-то таблицу в рефакторинге. А? Что? Какая таблица? Я вообще не помню что это за таблица и когда была заведена.

Мы переходим в "chat about this" без отрыва от производства и дальше временно создается отдельный чистенький тред, в который прокинута основная инфа и заполнен контекст по теме, и который готов к тому, что вы можете углубиться в данный вопрос вот прям сразу. Как только вопрос решен - тред удаляется, а решение по выбору следующего шага уже в сто раз более осмысленное.

Все это настолько круто, что возвращаться во времена IDE уже решительно не хочется. Но есть огромный минус - мы не заметили, как наше любимое программирование сделали платным, а на 23 февраля теперь хочется попросить уже не носки и бритву, а подписку на CC Max с безлимитным овердрафтом 🤩
  • ✍ 5
  • 😁 5
  • 🤔 3
  • 👨‍💻 2
  • ❤ 1
Post #65 953
Пятничное

p.s.: мое мнение таково, что какая именно циферка у opus, glm или gpt роли особо не играет, все это вкусовщина и достаточно минорные улучшения - у каждой флагманской модели есть свой вайб и "характер" и под него надо подстраиваться, но каждая из них хороша уже продолжительное время. Появление Cursor - вот это был феномен, появление Claude Code/Codex (т.е. нативки) - феномен, а посты "OPUS 4.6 ИЗМЕНИЛ ВСЕ" - индуцированный техношум и повод для отписки 😀

Всем хороших выходных и много хорошо сгенеренного кода 🤙
  • 👍 8
  • 😁 5
  • 👨‍💻 2
  • 👀 1
Post #64 944
Вчера просмотрел интервью с создателем Claude Code (крутым технарем по имени Борис с лицом чувака из соседнего подъезда). Интервью одновременно легкое и инженерное, но при этом очень емко упакованное смыслами.

https://www.youtube.com/watch?v=AmdLVWMdjOk

Свои полные заметки с комментариями хочу отрефлексировать и превратить в статью позже, но почти с первых минут была произнесена мысль, максимально резонирующая со мной и агентизацией. Борис говорит, что ему очень нравится работать с "универсалами". Сейчас в основном иерархия в мире построена на разделении ролей, и многие вообще не знают (и не хотят знать!) что делают парни в соседней комнате и их специфику. Универсалы же могут как поделать что-то в инфре, так и в продукте, да и в столовой покастдевить коллег. Да, за пределами ключевой компетенеции будет хуже, но это вообще не важно, тем более сейчас.

Я всю жизнь занимался всем подряд: и фронт, и бэк и продуктами и железо банкомата поковырял, и чего только не было. Когда-то лет 9 назад я захотел сделать еще и мобильную аппку, но вообще ничего про них не знал. Месяца за два кое-как разобрался, причем отфоркался от maps.me, где была как куча легаси из c++, завернутого в objective-c и java, так и бридж от них на свежий код на swift и многое другое. Мой код был очень так себе, а помимо него пришлось поделать ASO, юнитку, изучить аппстор, изучать картографию, писать тексты, искать иллюстраторов, переводчика и много всего неприятного, чего я не знал и не умел. Но аппка в итоге была сделана, даже Apple в свой московский офис на закрытую вечеринку позвал.

Я многое делал сам, но были вещи, которые невозможно было доделать самому просто в силу экспертных навыков. Сейчас "найти подходящие спецов" - уже больше не преграда и не стопер, а огромное количество задач агентизируются и смещаются из уровня "невозможно" на "ну да, придется позаморачиваться и посидеть недельку". При должной технической сноровке, желании и дисциплине, конечно же.

Иногда я все же задавал себе грустный вопрос "ну как у людей получается заниматься ТОЛЬКО Х столько лет, а я постоянный оркестр из всего и вся", но сейчас...Сейчас универсальность превратилась в супер силу, и я давно не испытывал такого воодушевления, это что-то феноменальное. А интервью - очень хорошее, рекомендую! Про сам Claude Code там не супер много, но майндсет у гостя интересный 👍
YouTube Boris Cherny (Creator of Claude Code) On What Grew His Career And Building at Anthropic Boris Cherny is the Creator of Claude Code but few people know his full career story. I interviewed him about everything he learned growing at Meta and for insights from his time building Claude Code at Anthropic. 𝗣𝗼𝗱𝗰𝗮𝘀𝘁 𝗹𝗶𝗻𝗸𝘀: • Transcript: https://…
  • 👍 8
  • 🔥 2
  • 🤔 2
  • ❤ 1
  • 🤡 1
  • 🌚 1
Post #63 1.29K
Недавно я писал, что хочу полностью пересобрать свой рабочий процесс. У меня почти получилось, я наконец-то дособрал и дотолкал до своего прода AI-ассистента, который работает по голосовухам.

Раскрыл все детали и процесс в статье на хабре, если у вас есть плюсики - буду им очень рад 🤗

Писать код голосовухами через тг - это невероятно круто 🤖🫡

https://habr.com/ru/articles/994454/
  • 🔥 13
  • ⚡ 5
  • ❤ 3
  • 😱 2
Post #62 1.2K
Когда лопнет пузырь AI?

Я написал драфт еще на новогодних, но решил, что статье нужно как следует "настояться" и полировал уже спустя время в более холодном настроении. Изначальным поводом к ней стало большое количество интервью и подкастов с макро-финансистами, которые неизбежно затрагивали тему AI и были совершенно не так радужно настроены, как кажется внутри индустрии.

Всем очевидно, что мы внутри большого пузыря. Но лопнет ли он? Или в этот раз все будет по другому? Я попытался разобраться в технологических маниях и переложить это все на AI.

Получилось шесть вайб-школ разных отношений, 4 слоя AI со своими рисками и экскурс в железные дороги, электричество и доткомы.

Приятного чтения! Если у вас есть лайки на хабре, буду раз принять их в статью 🥰

https://habr.com/ru/articles/993078/
  • 👍 12
  • ❤ 5
  • ⚡ 4
  • 🔥 1
  • 🤔 1
Post #60 1.39K
Всем доброе утро и хорошей продуктивной недели

2014 - Синьор
2020 - Техлид
2025 - Вайб-кодер
2026 - Мастер-погонщик AI-агентов
2027 - Безработный
  • 🤣 16
  • 😢 7
  • 🤔 3
  • 💯 3
  • 🤡 1
Post #58
Channel photo updated
Post #56 1.04K
Привет! Канал не заброшен 🤩

Еще перед новым годом я вписался в личный Манхэттенский проект - хочу полностью переосмыслить свой рабочий процесс и максимально его агентизировать. Что-то типа того, чем является Claude Code, но персонально под себя и без жесткой привязки к конкретному вендору. Планировал закончить за новогодние, но (спасибо оливье и рому) что-то пошло не так 🥹 До результатов Манхэттена мы еще доберемся, а пока интересная заметка:

Cursor + ChatGPT 5.2:
Хотя я хотел отказаться от курсора, полноценно у меня не вышло, потому что мои хотелки выжрали целиком все платные лимиты claude code и тот отправил меня на недельку отдохнуть. Курсором пользуюсь, но уже не по любви 💔

Gpt 5.2 прекрасна в написании кода и по ощущениям в целеполагании/планировании/коде не уступает даже Опусу. Но все порет сам Cursor - для задач НЕ написания кода напрямую он под капотом делает слишком много оптимизаций, и я прям физически ощущаю, как он пытается сделать контекст поменьше - где-то недогрепать, где-то выйти из поиска раньше нужного, ленится посмотреть весь файл, хотя он небольшой. На масштабах курсора такие оптимизации экономят миллионы долларов, но проблемы ̶н̶е̶г̶р̶о̶в̶ ̶(̶н̶а̶ ̶с̶а̶м̶о̶м̶ ̶д̶е̶л̶е̶ ̶и̶н̶д̶у̶с̶о̶в̶)̶ не волнуют, мне дела надо делать 😅

Под такими не по написанию кода задачами я имею ввиду нечто вроде "вот у тебя csv, возьми из третьей колонки значения и переложи их в базу вот в такую таблицу" - все это у курсора вызывает проблемы. А Claude Code переваривает такое хорошо! Поэтому задумываюсь попробовать gpt5.2 в его нативном исполнении и, вероятно, что будущее все же именно за нативными кодописцами.

У меня накопилось огромное количество идей для контента, что-то уже даже начато и его нужно дооформить. Елку выкидываем, а с понедельника - на лыжи! 🫡🏂

Stay tuned, как говорится!
  • 👍 6
  • 🔥 5
Post #53 1.23K
Пока писал - понял, что не могу взять это и отпустить просто так 😀
  • ❤ 5
  • 😁 4
  • 👍 3
Post #52
Channel photo updated
Post #46 1.05K
Захотелось зановогодить аватарку, выкладываю бекстейдж со съемки 🍊🌲

Мне ооочень нравятся роботы, но не нравятся их исключительно избитые клише в футуристических картинках, а вот помещать их в обычный позднесоветкий быт со всеми его неидеальностями и колоритом - прям очень заходит.

Когда я делал свой туристический стартапчик (форк maps.me), то заказывал у иллюстратора большое количество изображений и разработка главного персонажа по ценам 2015 года стоила около 3 тыс рублей, а каждая следующая иллюстрация - около 1 тыс рэ. И на каждую картинку уходило несколько дней.

А теперь свои самые бешеные фантазии можно получить за 15 секунд и пару центов, внести в моменте самые отбитые пожелания по правкам (на одной из картинок я пробовал сделать добрую версию самого страшного робота моего детства из "ну погоди"), бесконечно экспериментировать, и я не могу назвать ни одной причины, почему я когда-либо теперь пойду платить деньги за иллюстрации людям. Учитывая, что все вот это вот можно проделать с любой своей или чужой фотографией, то нас ждет какое-то безумно интересно будущее.

Бесконечный ai-слоп и фейки? Жесткая регуляция генеративок?

What a time to be alive! 🔥
  • 😁 5
  • 👍 4
  • 🔥 1
  • 🤔 1
  • 🌭 1
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →