TGViewer
Channel Public Channel
Big Ledovsky | AI изнутри

Big Ledovsky | AI изнутри

@big_ledovsky

Александр Ледовский
Head of AI @ Listee, ex: Avito, Сбер, ШАД

@aledovsky
Subscribers
2.06K
Photos
244
Videos
18
Links
206
Recent Posts 17 shown
Post #526 519
Годный курс по AI для менеджеров

Меня довольно часто спрашивают, что я могу порекомендовать посмотреть по AI для менеджеров. И честно говоря я точно не знал, что ответить 😏

Появился хороший курс, который сделал мой друг Никита Зелинский вместе с коллегами в школе ML Inside.

Называется AI-агенты для продактов, первый поток в октябре. Обратите внимание)

PS. Не реклама, пишу чисто по-дружески 🙂 🤝
  • 🔥 5
  • ❤ 3
Post #525 720
Про Jev

1. Наконец-то! Появились LLM, которые отвечают не текстом, а сразу тем что нужно. В данном случае вероятностями классов. Модель явно очень удачная

2. Про Jev мы забудем через несколько месяцев. Топ-тир компании сделают свои аналоги

PS. Ждем когда появится ризонинг не через текст
  • ❤ 8
  • 💯 8
  • 🤨 4
Post #524 878
Что станет с поиском и рекомендациями в эпоху LLM

🦜 По следам дискуссии на Practical ML

Раньше было два способа как пользователь находит айтем: это поиск и рекомендации. Теперь к ним добавился ассистент. Что же будет дальше?

1. Веб поиск

На первый взгляд кажется, что веб-поиск скоро полностью вытеснится агентами. По факту, у обычного поиска остаются навигационные запросы, короткие частотные запросы, которые не исчезнут.

💎 Очень своевременный мув был сделан Гуглом, а затем Яндексом и другими классическими поисками с добавлением нейропоиска в UI веб поиска с невероятно быстрой скоростью ответа. Я думаю, что все несложные запросы они таким образом отбили. На внешних агентов останется только маленький хвост рисерчей, которые в любом случае долгие.

2. Поиск и рекомендации в маркетплейсах

Ни для кого ни секрет, что ассистенты пока ни у кого не взлетели. Там много проблем

🤯 Не получается найти хороший сценарий. «Подбери мне Х» оказался не очень удобным по сравнению с поисковым запросом.

В добавок, в UI агента неудобно смотреть айтемы. Я видел вариант где агент кидает по три айтема, чего мало. Либо виджет горизонтального скролла, который конечно плохо просматривается, но хоть что-то.

🔮 Мой прогноз. Традиционный поиск и рекомендации никуда не уйдут. В агента уйдет сценарий рисерчей.

- В этом кейсе агент принимает подробное задание от пользователя
- Его результат - это ссылки на поиски, может быть в виде виджетов

🏄‍♂ Например

«Под твои требования можно посмотреть недорогие новые Самсунги если хочешь android (ссылка) или БУ iphone (ссылка). Можем рассмотреть детально плюсы-минусы моделей»

Что думаете?

🐳 - агенты рано или поздно все заменят
🗿 - традиционный поиск и реки никуда не уйдут
  • 🗿 41
  • 💯 1
Post #523 1.13K
А еще в следующую субботу будет PracticalML. Одна из моих любимых конференций. Я на ней выступал 3 года назад с рассказом про VCG аукцион в продвижении Авито, который я же потом и выпилил 😂. Как давно это было..

На PracticalML, во-первых, очень хороший состав докладов, которые кропотливо собирает Петя Ермаков, один из создателей ODS, которому я пообещал сделать этот пост 🙂. Во-вторых, топовый афтепати и нетворкинг. В общем, нужно идти
Practical ML Conf 2026 Хардовая конференция для экспертов и практиков. Здесь будет всё о практическом применении ML: технические доклады ведущих специалистов отрасли, инженерные мастер-классы и много нетворкинга. Обсудим, как извлечь из машинного обучения реальную пользу для бизнеса.
  • 🔥 11
  • ❤ 5
Post #522 1.15K
Вчера был на E-CODE, на ML-треке

Там выступал парень, который автоматизирует поддержку Тбанка агентами. Фраза из доклада, примерно дословно: «Большинство внедрений агентов проваливаются, но, кажется, наша команда напала на след, как это всё-таки делать. Пока не точно, но кажется мы его почуяли». Вайб очень жизненный и религиозный одновременно 👌 очень его разделяю))

Мысли на самом деле у него довольно здравые
— дообучать LLM не нужно
— агенту нужна поддерживаемая база знаний
— поддержку самой базы тоже стоит автоматизировать агентами, через разные хитрости и фидбек-лупы

Например, прогонять LLM-судью по человеческим сессиям поддержки и спрашивать: есть ли в базе знаний информация, чтобы решить данное обращение
  • 🔥 12
  • ❤ 4
  • 😭 1
Post #521 1.1K
Data Driven пройдет 26 сентября

Data Driven от Яндекса - знаковая в конференция для аналитиков. Потому что на ней ежегодно рассказывают про аналитические кейсы очень серьезного уровня: про критичные бизнес процессы, про нагруженный продакшн, про сложные задачи, требующие и продуктовых, и технических знаний.

Как и в прошлом году, основной фокус остается на аналитике вокруг LLM. В том числе будет про аналитику Алисы, аналитику внутренних агентов, разметку с помощью LLM и многое другое.

Рекомендую сходить оффлайн, так как конференция - это не только доклады, но и живое общение.

👉 Москва + онлайн, 26 сентября. Регистрируйтесь по ссылке
Data Driven 2026 Поговорим про AI-first аналитику, data-driven подход и о том, как изменится роль аналитика в ближайшие годы.
  • 🔥 7
Post #520 1.33K
Написал гайд по подключению Google Workspace к агентам

Казалось бы, что проще, чем подключить агента к календарю? Выдал токен, дал его агенту и работай. Но в гугл так нельзя 🤯

Я потратил слишком много времени на то чтобы разобраться. И решил что нужно уберечь других от траты сил.

https://habr.com/ru/articles/1078890/

PS. Недавно возмущался политикой Хабра. Но идти больше некуда, увы 🤷‍♂️
  • ❤ 13
  • 🤣 3
  • 🔥 2
  • 😱 1
Post #519 1.8K
Про выход GPT-6 Astra и пришедший AGI

Во-первых, нужно ждать. Мб они затюнились под бенчмарки.

Во-вторых, то что модель умеет решать задачи на IQ, не обязательно приведет к улучшению "бытовых" навыков.

Субъективно, заметный качественный прорыв был прошлой зимой. А дальше было эволюционное улучшение, которое в моменте не ощущается.

PS. Вот, можете потыкать ARC-AGI-3 бенчмарк, где модель набрала 98%

https://arcprize.org/tasks/ls20
  • ❤ 8
  • 🔥 3
Post #518 1.89K
Про удаленку

Обсуждали с друзьями, что западные компании возвращают людей в офисы. И не только западные

Я в своей карьере собирал команды несколько раз. И лично придерживаюсь следующих принципов

1️⃣ Поддерживать как можно больший процент локальных сотрудников, которые могут ходить в офис

2️⃣ Фул ремоут нанимать только сильных и опытных

3️⃣ Поощрять гибридный режим. Иногда офис, иногда дом

Общение в офисе создает более глубокие отношения между людьми. Многие проблемы решаются за 5 минут. А полные удаленщики в ограниченном количестве хорошо вливаются за счет общей сплоченности коллектива

👨‍🦽Нанимать джунов на полную удаленку контр-продуктивно. А фул ремоут команды - это компромисс, а не благо

Хейтеры - можете расчехлять ружья 🏄‍♂️
  • 🔥 22
  • ❤ 10
  • 💯 6
  • 🤨 6
  • 😐 6
  • 😁 2
  • 🌚 2
Post #517 2K
Апдейты по моему прохождению cs336

Про который писал

Потратил на него примерно 40 часов. Сделал только одно задание. Ну.. это было жестко. Нужно было написать все с нуля: токенизатор, небольшую LLM с современными слоями, оптимизатор adam w (!) и код для обучения. И на всем этом провести десяток экспериментов

Учитывая что задание дают на 2 недели, я думаю люди отключают запрет на агентов

Признавать что я просто медленный я конечно не собираюсь 🗿

Да, и знаете что? Даже понимая внутренности современных LLM-ок и обучив все своими руками, я все равно поражаюсь что они все-таки работают 👁
  • 🔥 27
  • ❤ 8
  • 💯 4
  • 😁 2
Post #516 1.98K
Мнение про свежий гайд Claude Code

Как клодовод со стажем, могу вставить несколько копеек 😎

Выбор модели и уровня усилий

Абсолютно нереально этим управлять. Модели так часто меняются, даже в стеке антропика. Невозможно успевать вырабатывать интуицию, поставить фейбл или опус или соннет. Я тупо пользуюсь fable.

Уменьшение контекста и сабагенты

Ральф луп и контекст задачи в маркдаун файле - все еще лучшее решение на мой взгляд.

Управлять сабагентами сложно, потому что они включаются непредсказуемо. Теоретически можно аккуратно прописать правила когда и как их запускать в Claude.md, но я до этого не дошел. Сабагенты - это автоматический способ экономии контекста. Ральф луп - это ручной, но достаточно хорошо управляемый.

Совет запускать компактизацию когда уходишь от компьютера странный. Это требует огромной ментальной энергии, а в агентах наоборот хочешь ее экономить. Да и не доверяю я компактизации. Не понятно насколько она ухудшает качество контекста.

Совет тегать файлы через @ в моем случае работает плохо, потому что я читаю файлы из разных мест и работаю с несколькими репозиториям сразу.

Про часовое кеширование

А вот на этом хочу акцентировать внимание. Часовое кеширование - это самый важный геймченджер антропика. Это причина, почему если просто включить API на Гермесе через OpenRouter агенты становятся золотыми. Я плохо понимаю, как работает подписка кодекса. Но в обычных API у других провайдеров нет нормального предсказуемого способа кеширования. Обычно они говорят, что кешируют, но как и на сколько - не гарантируют. Обычно кешируют на несколько минут и часто мы отвечаем агенту с большим лагом. В подписке Claude часовое кеширование включено по умолчанию и именно это позволяет укладываться в лимиты на больших задачах.

https://claude.com/blog/maximizing-the-value-of-your-claude-code-sessions
Claude Maximizing the value of your Claude Code sessions | Claude by Anthropic Practical tips for how to run efficient sessions that get the most value from every token.
  • 🔥 8
  • ❤ 2
  • 💯 2
Post #515
Channel photo updated
Post #514 1.54K
Что я думаю про Conductor

Conductor - это приложение для оркестрации агентов, которое я периодически видел в разных ютубах. Это что-то среднее между UI Claude Code и Codex и полноценной IDE типа курсора. IDE вайбкодера короче 🤪

Основа рабочего процесса состоит из двух элементов. Традиционные сессии с агентами. И код ревью того, что наделал агент. Conductor сам не ходит в модели, как курсор, а подключается к уже установленным Claude, Codex итд.

Я посидел на нем над одним личным проектом. Тул прикольный, подойдет для неинженеров. Для инженеров скорее нерабочий.

Что понравилось

Conductor форсит свой подход к работе. Проект обязательно должен быть git репозиторием, подключенным к гитхабу или другой платформе с механизмом PR. Каждая новая задача агенту создается в виде workspace - 1 или более сессия с агентом + git worktree, который мерджится исключительно через PR.

Что не понравилось

В рабочих проектах вы не хотите плодить PR-ы на каждое изменение агента. Почему не поддерживаются локальные ветки и мерджи - я не понимаю. Вторая проблема - там нет полноценной поддержки синтаксиса - go to definition итд. Без этого раскапывать километры вайбкода очень больно. Третья проблема - нельзя делать фичу сразу в нескольких репозиториях. А в ds это постоянно (сервис + рисерч репозиторий)

Итого

Интересный инструмент, но моя перемотанная скотчем фабрика задачи решает лучше 😎
www.conductor.build Conductor - Run a team of coding agents in the cloud Run coding agents in isolated cloud sandboxes with Conductor Cloud.
  • 🔥 5
Post #513 1.7K
Post #509 1.77K
Правда жизни про поиск

После того, как на конференции вы вдохновились очередным докладом про супер-пупер нейронку для поиска, может сложиться впечатление, что поиск - уже решенная задача

Вот вам простой пример, что это не так 😄

Запрос: "гермомешок 50л". Можете посмотреть как с ним справляются крупные ecom площадки. Ozon, Avito, Amazon, Ebay. Все выдают гермомешки неправильных размеров (Авито кстати меньше всех!)

С числовыми параметрами справляется Lamoda, потому что у них относительно узкая область и есть разбор запроса и преобразование его в фильтры. Но на большом ассортименте это очень тяжело поддерживать.

Короче есть еще чем позаниматься в поиске 😎
  • 🔥 11
  • 💯 7
  • ❤ 3
  • 😁 1
Post #508 1.67K
Какое-то время сидел на Opus 5 как на основной модели в Claude Code. Понял, что страдаю 🦶

Агент тратит много времени на простые задачи, выдает полотна ненужной информации и прочее. В итоге, на сложных проектах переключился на Fable, на простых вернулся на Opus 4.8 (если не знаете как - /model claude-opus-4-8)

Пошел смотреть что пишут другие, у других людей 🫁 тоже много негатива раз два

Тем временем Boris Cherny в свежем выступлении на YC рассказал, что под каждую новую модель они на самом деле почти полностью переделывают систем промпт Claude Code.

Не факт, что Opus 5 правда настолько плох, думаю его допилят за счет систем промпта и он будет лучше ощущаться. У меня такое уже было, кажется, на Opus 4.6. Сперва страдал, а потом стало ничего 👌
YouTube Boris Cherny: We Cut 80% of Claude Code’s Prompt Fresh off the launch of Opus 5, Claude Code creator Boris Cherny joins Diana Hu at Startup School 2026 to talk about what the newest models can do, how Claude Code came to be, and what it means to build products when the underlying capabilities keep accelerating.…
  • ❤ 4
  • 🔥 2
  • 👾 2
Post #507 1.65K
Marimo побеждает Streamlit в нашей команде

К моему удивлению. Потому что сам я два раза пробовал пересесть на Marimo, и оба раза не выдерживал из-за неудобного UI

Вообще, marimo - это современная альтернатива jupyter ноутбукам. Еще у него есть режим публикации, который позволяет делать хорошие интерфейсы, по функционалу примерно как стримлит. Т.е. на нем можно сделать смотрелку предсказаний, или тестовый интерфейс для модели, или интерактивный дашборд.

Причем ребята говорят, что де-факто не работают в UI marimo и все делают через агента. Мне лично работая с агентами больше нравится комбинация python-скрипты + streamlit. Но мб нужно еще раз попробовать.
marimo.io marimo | a next-generation Python notebook Explore data and build apps seamlessly with marimo, a next-generation Python notebook.
  • 🔥 5
  • ❤ 1
Older posts →

About this channel

How can I read @big_ledovsky without a Telegram account?
TGViewer shows the public web preview Telegram publishes for Big Ledovsky | AI изнутри: recent posts, photos, videos and the subscriber count, with no app, login or account.
How many subscribers does Big Ledovsky | AI изнутри have?
Big Ledovsky | AI изнутри (@big_ledovsky) has 2.06K subscribers on Telegram, refreshed roughly every 30 minutes.
Does Big Ledovsky | AI изнутри know I viewed it here?
No. Public channel previews carry no viewer identity, and TGViewer has no accounts or tracking of what you look up.
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →