TGViewer
Channel Public Channel
Big Ledovsky | AI изнутри

Big Ledovsky | AI изнутри

@big_ledovsky

Александр Ледовский
Head of AI @ Listee, ex: Avito, Сбер, ШАД

@aledovsky
Subscribers
2.06K
Photos
245
Videos
18
Links
207

Showing posts older than #507 · Back to latest

Older Posts 14 shown
Post #506 1.57K
2-го августа будет конфа UrbanML. Собираюсь сам и могу порекомендовать вам.

—

18 докладов по RecSys, NLP, антифроду и агентным системам, выступления специалистов из MTS Web Services, ВТБ, «Звук», Wildberries, Альфа-Банка и других компаний. После основной части — спортивные активности (мастер-класс по баскетболу, настольный теннис и ИИ-шахматы) нетворкинг и афтепати.

Вход бесплатный, но нужна регистрация (на площадку необходимо взять с собой паспорт или права): ссылка

📅 2 августа, 11:00–21:00 (первый доклад в 12:00)
📍 Москва, офлайн
  • 🔥 4
Post #505 1.68K
Про Wispr Flow

Вот уже какое-то время пользуюсь Wispr Flow. Это приложение, которое ставится на Mac и на iPhone и распознаёт голос. Идея этого приложения в том, что оно добавляет ваш контекст 🧠

Не очень понимаю, как это работает, но по идее оно должно видеть, где вы пишете, что вы пишете, какие используете слова и использовать их при распознавании. Спойлер, все не совсем так

Я слышал про Wispr Flow и про его аналог Aqua в нескольких каналах и лично от нескольких людей, и все очень хвалили. В итоге мои впечатления смешаны 🙄

Сперва был восторг, что теперь можно всё вводить голосом. Потом я немного попользовался и столкнулся с реальностью, что все не так гладко. По итогу Wispr Flow - это офигенный инструмент для общения с агентами, потому что все грехи распознавания агент принимает легко.

Но если мы говорим про написание сообщений или написание документов, то тут всё сильно сложнее. Несмотря на то, что говорят, что Wispr Flow смотрит контекст, специфичные слова он не распознает. Получается довольно много ошибок и без редактирования такой текст отправлять нельзя 🩸

Вообще я сомневаюсь, что Wispr Flow проходится ллм-кой по выходу движка распознавания речи, как я думал вначале. Потому что мы делаем похожую историю у себя в приложении и таких ошибок не происходит.

Но по итогу все равно прикольно. Главная киллер 🔫 фича Wispr Flow: как удобно он интегрировал интерфейс, особенно в маке, где распознавание работает в любом приложении по нажатию кнопки.

Последняя мысль: что навык голосового ввода нужно развивать, как и навык использования LLM 😎

PS. Если будете пробовать, можете взять мою рефералку
wisprflow.ai Wispr Flow | Voice to Text Dictation & AI Notetaker Flow makes writing quick and clear with seamless voice dictation. It is the fastest, smartest way to type with your voice.
  • ❤ 5
  • 🔥 4
  • 💯 2
Post #504 1.65K
Бенчмарки - это как собеседования
Есть люди, которые их замечательно проходят, а потом нифига не работают 🙂
Посмотрим что будет с Kimi K3

PS. Если что, заявка очень серьезная. На данный момент открытые модели идут во втором эшелоне и заметно отстают
  • 😁 13
  • 💯 6
  • 🔥 4
  • 🤔 1
  • 🤯 1
Post #498 1.67K
Традиционно пишу в этом блоге про походы. В этом году пошел на сплав с Силой Территории. Очень хорошая компания. И главное у нее классное комьюнити тех, кто с ними ходит. Нетворк хороший короче 🙂

На самом деле для меня день дейоффа и три дня в байдарке - все что нужно для счастья. Прошли в районе Ржева по Волге, немного, километров 50. Ну, много и не нужно.

Читайте также

Прошлогодний байдарочный поход в Киргизии
  • 🔥 34
Post #497 1.82K

Forwarded from Старший Авгур

Вот такую писюльку получил 5 минут назад.

Нахуй Хабр. Не пишите туда, не читайте его.

Датасет я не закрою, пока они не соизволят написать нормальное письмо.

После этого сделаю приватным, если кому-то будет нужен - пишите в личку. А лучше скачайте сейчас.
  • 😱 12
  • 🤔 1
  • 🤯 1
Post #496 1.77K
Сомнительные действия со стороны Хабра 🤔

Непонятно зачем. От каких рисков они хотят защитится, удаляя неофициальный датасет на котором люди учат модели. Только негативно настроят против себя сообщество, которое их хлеб.

Кто-нибудь кстати Хабр читает еще?

Его репутация как места, где с позором выгоняли за плохие статьи, уже очень давно потеряна 🏄‍♂
Post #495 2.27K
Люблю Дорофеева за философский подход к продуктивности. Для меня он как-то пропал из инфоповестки последнее время. Рекомендую свежий подкаст, если вам тоже такое заходит.

Джун: не использует техники продуктивности, вокруг пожары

Мидл: обмазан миллионом техник продуктивности, пожаров нет, но очень тревожный и результаты не выдающиеся

Мастер: не использует никаких техник, достигает выдающихся результатов естественно и спонтанно (на первый взгляд)


https://youtu.be/7Ipt0a43U4Q?si=lVkky-fdeqqz0X2q
YouTube Джедайские техники Максима Дорофеева: продуктивность, созвоны, выгорание и главный миф о времени #86 🔹 Присоединяйся к курсу «ИИ для разработчиков» https://ru.hexlet.io/programs/ai-for-developers?utm_source=youtube В этом выпуске у меня в гостях Максим Дорофеев — автор «Джедайских техник», книг, которые для многих стали первой серьёзной попыткой разобраться…
  • ❤ 8
  • 🔥 3
  • 💯 1
Post #494 11.8K
Прохожу новый курс

Начал проходить Стэнфордский курс Language Modeling from Scratch

Моя цель - проходить по два курса в год. Зимой я проходил курс по программированию на CUDA, теперь вот учусь обучать LLM с нуля.

➡️ Мысль за этим следующая. Во-первых, чтобы хорошо делать свою работу, нужно иметь знания на 1-2 уровня глубже чем используешь в повседневной деятельности. Во-вторых, в части задач я все-таки рассчитываю, что мы начнем использовать легкие зафайнтюненные LLM-ки. Чтобы сэкономить, снизить лейтенси и главное - быть менее зависимыми от внешних API. Но тут хз, непонятно, что будет с областью через пару лет 🤷‍♂️

Прикольный курс. Я пока не смотрю лекции, только делаю домашки. Лекции буду смотреть по факту, когда сделаю. То, что ты не трогаешь руками - не откладывается. На этом курсе абсолютно шикарные домашки с хорошими тестами. Курс рассчитан в том числе и на самостоятельное прохождение.

Уже написал и обучил токенизатор с нуля, сейчас пишу компоненты LLM на торче.

➡️ Из интересного, с домашками идут настройки Клода и Кодекса, которые не дают агенту напрямую писать код за студента, но дают отвечать на вопросы и помогать искать ошибки. Супер полезно.

Буду делиться впечатлениями!
Stanford CS336 Stanford CS336 | Language Modeling from Scratch Official course website for Stanford CS336: Language Modeling from Scratch (Spring 2026), including logistics, schedule, assignments, and course materials.
  • 🔥 50
  • ❤ 4
  • 🌚 1
Post #493 2.23K
Коллеги прислали. Говорят про меня 🤷‍♂️🙈
  • 😁 31
  • 💯 13
  • 🤣 7
  • 😱 1
Post #492 2.44K
«Это Гулаг» - что происходит в Мете*

Эту историю на прошлой неделе мне рассказал один знакомый. Я честно говоря поделил на 10, но тут новости просто взорвались.

Мета принудительно отправила 6.5 тысяч инженеров размечать данные для AI на фул-тайм. Люди бунтуют.

Выглядит ооочень плохо. Принудиловка требует либо большой кредит доверия у компании, либо хорошую компенсацию взамен. Учитывая ситуацию с волнами сокращений, ни того ни другого нет.

Мета очевидно отстанет в AI гонке и хочет это изменить. Но вместо камбека пока получается саморазрушение 🏌️

* запрещенная организация в РФ

https://techcrunch.com/2026/06/12/metas-months-old-ai-unit-is-a-soul-crushing-gulag-say-the-engineers-stuck-inside-it/
TechCrunch Meta's months-old AI unit is a soul-crushing gulag, say the engineers stuck inside it | TechCrunch A new report suggests the unit, which employs 6,500 people, is on the verge of revolt.
  • 🤯 15
  • 😁 5
  • 😱 3
  • ❤ 1
Post #491 1.7K
Я заметил, что мало у кого в итоге прижились OpenClaw, Hermes и похожие агенты 🦀

Проблема OpenClaw как класса агентов, что люди им играются и бросают. Почему, можно описать одним примером.

Допустим, человек просит вести за него задачи и планировать время. Но до этого он что-нибудь делал? Есть ли у него привычка записывать задачи? Умеет ли вообще придерживаться расписания?

Поставит ему агент с 6 до 8 утра слот учить data science, он все равно не проснется. Дело не в инструментах, дело в человеке 🤷‍♂️
  • 💯 16
  • 🌚 3
  • 🤨 3
  • ❤ 2
Post #490 2.13K
Какой алгоритм рекомендаций победил в Avito ML Cup

Пока на разных днях датафеста рассказывали про трансформерные рекомендации, интересно было посмотреть, что нарешали победители соревнования, про которое я писал. Напомню, что датасет был серьезный - 5kkk взаимодействий.

🔜 Как вы наверное догадались, это не трансформер. И самое интересное, что не ALS

Победил графовый кандидатогенератор. Базовая идея этого алгоритма очень простая. Это когда вы ходите по графу взаимодействий: юзер - айтем на который он кликал - другой юзер - новый айтем. И так при желании какое-то количество раз. Дальше у алгоритма есть усложнения, как ходить лучше, чем случайно. Примеры вариаций: Pixie от Pinterest аж 2017 года и RP3beta аж 2016 года.

🔜 Все топ решения использовали подобные кандидатогенераторы и ранжирование бустингом поверх

Интересно, почему получилось так? Может быть виной хитрая метрика, которая усредняет перформанс по разным вертикалям (товары, услуги итд). Может быть то, что оставили только прогретых пользователей, у которых был контакт. Может быть гэп в 12 часов между трейном и валидацией. А может быть было мало данных на такой объем пользователей и айтемов. Говорят, трансформер не выучивал item_id (хотя они уже были semantic id).

По итогу, соревнование показало пример, что хорошие рекомендации можно построить достаточно простым подходом.

YouTube - Запись разбора решений
Б/У ML - Канал Толи, автора сорева
YouTube 30 мая — Data Fest 2026 / Соревновательный трек AvitoTech х Data Fest 2026, день 8: офлайн в Москве 30 мая В программе данной трансляции доклады: • ML & Education от сообщества ODS • соревновательный трек AvitoTech ML CUP 2026 и не только! Полное расписание: https://ods.ai/events/fest2026-avito-msc/schedule…
  • 🔥 14
  • ❤ 5
Post #489 1.83K
Удивился решению Майкрософта срезать косты на Claude 😏. Не смогли найти 100 долларов в месяц на разработчика? В ту же сторону отреагировал убер

💬 Мысли по теме

- Факт, что при неаккуратном использовании на агентах можно сжигать нереальное количество денег. Я недавно пробовал запускать Hermes на Opus 4.7. Расхотелось 😅

- Просто подписка на курсор или клод код многократно себя окупает. Это видно невооруженным взглядом без всяких аб тестов

💬 Чтобы AI не стал только лишь дополнительным финансовым бременем 🔫, нужно делать две вещи.

1. Вводить политики на траты сверх обычных подписок. Например, включать бюджет на AI в бюджет проектов. У меня вот есть такой бюджет на DS функцию и я трижды думаю на что его тратить.

2. Закладывать сокращение количества сотрудников на тот же объем работы. Иначе это правда все бессмысленно.

Майкрософту сложно быстро отреагировать на такую смену парадигмы. Я думаю, что кран прикрыт временно. Либо они будут просто использовать не Антропик.
Telegram Data Secrets После утренней новости про отказ Microsoft от Claude Code выяснилось, что они в своих идеях не одиноки Операционный директор Uber только что заявил, что «тяжелые траты на ИИ все сложнее оправдать, так как рост потребления токенов не показывает четкой отдачи…
  • 🔥 4
  • ❤ 2
  • 💯 1
Post #485 2.15K
Моя фабрика разработки на claude code, n8n и jira

Хочу в двух словах рассказать к чему я пришел очень плотно работая на claude code с января. Прочитав статью Harness Engineering от OpenAI и послушав других людей я понял, что нужно стремиться к увеличению автономности кодиногвых агентов. Я начинал с интерактивной работы с claude и в итоге дошел до создания своей фабрики.

Общая архитектура. С помощью n8n у меня подняты workflow с 3-мя агентами, которые запускаются каждую минуту. Два workflow впомогательные, нужны чтобы разворачивать и удалять рабочее окружение. И один workflow запускает основного агента, который выполняет задачу. Каждый workflow включает получение задачи из jira, сбор контекста и запуск команды claude code —agent agent-name

Основной агент использует 3 режима: PLAN, EXECUTE, FIX. Каждый запуск (который происходит раз в минуту) агент получает таску, выбирает режим, отрабатывает, обновляет Jira и засыпает

- PLAN декомпозирует задачу на сабтаски. PLAN вызывается в начале, либо в процессе, если в комментариях написать новые требования

- EXECUTE делает одну сабтаску за раз, т.е. реализует Ralph Loop

- FIX читает комментарии в джире и делает небольшие правки не входя в планирование

Jira используется для заведения требований и написания фидбека агенту. Для передачи контекста между запусками используется специальный MD файл.

Дополнительно я реализовал "ручной режим". Скилл, который позволяет запустить агента руками, прочитать контекст задачи и доделать что-то в интерактивном режиме.

По итогу, я могу паралелльно делать 4 задачи. Больше не получается - нужно писать требования в джире и ревьюить результаты.
  • 🔥 20
  • ❤ 6
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →