TGViewer
Channel Public Channel
AI да парень! / Sergei Notevskii

AI да парень! / Sergei Notevskii

@sergeinotevskii

Про AI с ноткой иронии

Контакты:
ЛС - сообщения чата
https://instagram.com/sergei_notevskii
https://ru.linkedin.com/in/sergeynotevskiy
Subscribers
4.94K
Photos
333
Videos
31
Links
250
Recent Posts 14 shown
Post #670 1.45K
#300tps
Не меняйте reasoning effort в агенте, пока не прочитаете это…
Ладно это кликбейт. Но вы же не поэтому кликнули, да?

Вы в курсе, что изменение уровня рассуждений в запросе инвалидирует префикс кэш?
Хотя казалось бы - поменял настройку "величины" ответа, какого черта кэш входящего запроса пропал?
Кто не в теме - дело в том, что настройка степени ризонинга чаще всего подставляется в input, те концептуально:
<internal_config>
thinking_effort = high
</internal_config>

<system>
...
</system>

<user>
...
</user>

Сами антропики в документации пишут что: "The resolved effort value is rendered into the prompt."
У всех опенсорс моделек, что довелось посмотреть, схема примерно та же.

На самом деле не всегда все так просто, но это дело для отдельной статейки (спойлер, да).

А теперь к хорошим новостям:
У Astra и у Fable 5.1 (не 5) появилась возможность изменить effort для продолжения треда, не переписывая исходную конфигурацию разговора. Короче - попадать в кэш, даже при смене степени ризонинга.

При этом делать это нужно через спец. конструкции configuration_update и output_config.

пример для Astra
{
"model": "gpt-6-astra",
"previous_response_id": "resp_...",
"reasoning": {"effort": "high"},
"input": [
{
"type": "configuration_update",
"reasoning": {"effort": "low"}
},
{
"role": "user",
"content": "Собери короткий итог без нового анализа."
}
]
}

пример для Fable 5.1
{
"role": "system",
"content": [],
"output_config": {
"effort": "low"
}
}

Причем и там и там настройка действует только до следующего user turn.

Работает ли это под капотом Codex и Claude Code?
Claude - да, начиная с версии 2.1.260
Codex - да, но на сегодняшний день, только через явное включение фичи reasoning_effort_override.

П.с. в скилле audit-prompt-caching это уже учтено.
Пользуйтесь, экономьте денежки и TTFT.
GitHub GitHub - sernote/audit-prompt-caching Contribute to sernote/audit-prompt-caching development by creating an account on GitHub.
  • 🔥 18
  • ❤ 14
  • 👍 11
  • 🫡 1
Post #668 1.52K

Forwarded from Тимур Хахалев про AI Coding

show-me skill

Тут немного завирусился skill от humanlayer – show-me.

Суть – помочь пользователю понять diff'ы с помощью кратких диаграмм, псевдокода или HTML.

Я попробовал, мне понравилось, рекомендую и вам!

Установить:

npx skills add humanlayer/skills --skill show-me


📱 Ссылка на github

Пример на скриншотах.

Лайк, репост,
Тимур Хахалев про AI Coding, подписывайтесь!
  • 👍 18
  • ❤ 7
  • 💯 1
Post #667 1.72K
Вроде такой очевидный скилл (ака объясни по простому, через схему и тд), но мне тоже он зашел.
Не только для себя, но и для формирования понятного описания результатов задачи "широкому кругу лиц".

Главное, как подметили в комментах оригинального поста, за этими упрощениями не прохлопать важные нюансы.

Впрочем, это всегда актуально при работе с агентами)
  • 👍 11
  • 🔥 8
  • ❤‍🔥 5
Post #666 2.58K
AI да парень! / Sergei Notevskii Claude: *выпускают Fable 5.1* Тем временем OpenAI: *важные изменения в Codex (см пикч)*
Дорогой OpenAI.
Прости меня за мой сарказм.
Я был не прав.

Сайт с галактикой - это совсем другой уровень!

П.с. А если серьезно - ждем доступа и тестов.
Слишком много хайпа в нашем деле.

Никому верить нельзя (с) Макс Т., мой ментор в QA 10 лет назад.
  • 😁 19
  • 💯 13
  • 🤣 8
  • 👍 3
  • 🍓 2
  • 💅 2
Post #665 2.69K
Claude: *выпускают Fable 5.1*
Тем временем OpenAI: *важные изменения в Codex (см пикч)*
  • 🎉 46
  • 😁 36
  • 👏 5
  • 🍾 2
  • 👍 1
Post #664 4K
NVFP4, deepgemm, DSpark, P/D disaggr, CUDA 13.0
Это все для привлечения внимания, потому что:

Снова ищу инженеров в команду AI платформы Битрикс24

В прошлый раз из канала пришло много сильных ребят, так что заходим на второй круг.
Сейчас нанимаем LLM Ops - тех, кто будет отвечать за то, как модели живут внутри платформы.

Что за платформа?
Это основа, на которой строятся все AI фичи компании: от простых сценариев до агентов, управляющих Б24.По факту - мы внутренний провайдер моделей, а наши заказчики - продуктовые и внутренние команды, которые генерируют больше 20 млн запросов в месяц (и это только llm).

Мы отвечаем за модельки под капотом (для этого у нас больше 200 серверов с GPU от t4 до 8хH200 и B200), за их качество, доступность, производительность и эффективное использование. Плюс вот эти ваши лайтллмы, роутеры, кэши, эвалы, guardrails и прочие интересные штуки. Команда кросс-функциональная: разработчики, ML и *Ops инженеры.

Что за LLM Ops?
Всё, что связано с моделями, vLLM и инференсом: поднять, настроить, разогнать, обновить и отвечать за то, что оно держит нагрузку и не сжигает деньги впустую.

Чем предстоит заниматься:
- выжимать максимум из того железа и фреймворка, что уже есть;
- поднимать модели и готовить среду под тесты и прод - llm, stt, эмбеддинги и тд;
- следить за релизами vLLM и обновляться, потому что каждый релиз приносит фичи, которые нам реально нужны (ну или баги, которые чинить тоже иногда приходится нам);
- отвечать за производительность конкретных инстансов: смотреть метрики, ловить узкие места, реагировать;
- считать ёмкость и стоимость: 200 машин сами себя эффективно по моделям не разложат.

Что ждём от кандидата:
- практический опыт именно с vLLM(SGLang тоже котируется);
- продовый опыт эксплуатации LLM-сервисов;
- понимание, как устроены современные LLM: трансформеры, токенизация, контекстное окно, как и что влияет на latency и throughput;
- уметь работать и без кубернетисов;

Сильно в плюс:
- опыт с различными вариантами роутинга кэша (vllm-r, dynamo, LMCache. и тд);

Куда писать и что присылать?
Пишите мне в личку: @Ser_no

В сообщении лучше сразу прислать:
- CV / LinkedIn / GitHub;
- пару слов, в чём вы сильны или крутые кейсы которые решали в последнее время;
- любые артефакты, если есть: код, конфиги, бенчмарки, дашборды, отчёты, посты;

Про платформу рассказываю тут и про команду тут.

Перешлите тому самому, верю в силу телеграма)
  • 👍 15
  • 🔥 11
  • ⚡ 8
  • ❤ 2
  • ✍ 1
  • ❤‍🔥 1
  • 👎 1
  • 🦄 1
Post #663 2.2K

Forwarded from Егошин | Кеды профессора

Подкаст с AI-лидом в Битрикс24: как делать продукты на ИИ-агентах и не сломаться в проде

У меня в гостях Сергей Нотевский - руководитель AI-платформы в Битрикс24. Команда Сергея отвечает за ИИ-инфраструктуру из 100+ GPU, на которой работают он-прем модели и автономные агенты крупнейшего бизнес-сервиса страны.

А еще я называю Сергея "отцом кэширования контекста в России") Так как он разработал опенсорс скилл по этой теме, за который Anthropic подарили ему официально подписку MAX на 6 мес.

О чем выпуск:
• Как создавать ИТ-продукты, используя агентов, так, чтобы они были устойчивыми при эксплуатации;
• Как экономить на токенах за счет кэширования;
• Почему RAG остался в 2025 году и что пришло ему на смену сейчас;
• ИИ-внутрянка Битрикс24. Как и зачем оркестрировать собственный кластер на 100+ GPU.

🎧 Подкаст уже доступен на двух площадках:

📱 YouTube / 📱 VK видео
  • 🔥 16
  • ❤ 5
  • 👍 5
Post #662 1.93K
Привет, как ты?
Давно не виделись.

Сегодня первый рабочий день после отпуска, который полностью посвятил семье)
Специально ничего не писал, не кодил, толком не читал новости АИ и почти даже не думал о том как корабли бороздят распределенный кэш.
"Трогал траву" на слэнге 2026 года.

Что еще?
За это время провели гендер пати, и оказалось что кроме того, что вскоре я стану многодетным отцом, я еще и буду не только "папулей", но и "батей".
Перевожу - у нас с Кристиной будет сын! Поздравления - принимаются!)

Поднакопилось чего вам рассказать, постараюсь не сильно спамить (ну те не больше 1 поста в месяц 🙂).

Ну а для затравки (что за слово блин такое) - вышел наш с Костей Егошиным разговор про AI платформу, грант от Anthropic за мой скилл аудита кэша, Tiny Teams и другое.
Хорошего просмотра)
  • 🔥 25
  • 🎉 18
  • ❤‍🔥 7
  • 👍 6
  • ❤ 4
  • 🦄 1
Post #661 2.52K

Forwarded from ULYANOV.LIFE

Зачем Битрикс24 своя AI-платформа?

Сергей Нотевский — AI Lead в Битрикс24, руководит платформой, на которой работает весь AI компании: от транскрибации звонков до агента BitrixGPT. В новом выпуске обсуждаем, стоит ли компании разворачивать нейросети у себя или брать их как сервис (MaaS), как посчитать железо под открытую модель, почему бенчмаркам нельзя верить, что такое префикс-кэш, и при чём здесь четыре года работы фитнес-тренером.

Из выпуска вы узнаете:

▪️Чем разработка с AI похожа на менеджмент и кого из инженеров заменят первым?
▪️Что такое MaaS (Model-as-a-Service) и за что вы на самом деле платите в цене токена?
▪️Почему Битрикс24 развернул модели у себя и что это даёт клиентам?
▪️Зачем писать свои тесты для моделей и почему бенчмаркам из релизов верить нельзя?
▪️Что такое префикс-кэш и как он экономит до 95% стоимости входящих токенов?
▪️Почему большое контекстное окно не гарантирует качество и что такое «гниение контекста»?
▪️Какие роли нужны в команде AI-платформы и что такое Harness?
▪️Почему модели галлюцинируют и что с этим делать разработчику?
▪️Куда расти инженеру в эпоху AI и какой навык теперь важнее конкретных знаний?
▪️Сколько стоит свой AI и что выгоднее — аренда GPU или закупка железа?

Рекомендую выпуск особенно тем, у кого сейчас остро стоит вопрос, разворачивать ли нейросети внутри своего контура. В этом выпуске мы собрали подробный гайд по теме self-hosted AI.

Приятного просмотра и прослушивания!

🇷🇺 Смотреть на RUTUBE
📹 Смотреть на YouTube
🎵 Слушать в Яндекс Музыке
📺 Смотреть в VK Видео
🔉 Слушать в аудио

Мы с Серёжей когда-то просто стали читателями друг друга. Я уже не помню, кто на кого подписался первым, но его канал помню ещё с первой тысячи подписчиков (сейчас их почти пять, го добьем!). Из переписки в личке выросла договорённость о подкасте, а на записи я немало удивлялся. Битрикс помню со времён своей первой работы в студии, когда мы собирали на нём интернет-магазины, и по не самому приятному переезду с него на самописную платформу в МТС. То, как ребята прокачали продукт и адопшн AI сегодня, выглядит совсем иначе: даже захотелось снова попробовать Битрикс в работе и ощутить все эти фичи в каждодневном взаимодействии.


Ставьте реакции, жмите колокольчики, шерьте друзьям и коллегам, и конечно же, пишите обратную связь, потому что это все поможет мне продолжать и улучшаться. 🙏

#подкаст #кудаРасти #ai #битрикс24 | @ulyanov_life
  • 🔥 22
  • 👍 15
  • ❤‍🔥 7
  • ❤ 4
  • 👏 1
  • 🤩 1
  • 🦄 1
Post #660 2.18K
Вышел большой подкаст со мной у Макса.

Записывались в пятницу вечером, и вайб соответствующий (но в кружке у меня честно-честно чай).

Обсудили много всего, так или иначе связанного с ai:
- self hosted vs maas,
- мифы про контекст в 1млн токенов,
- «нюансы» аренды железок под llm,
- power rangers

Ну и конечно, как я до такой жизни докатился: как въезжал в трамвай, продавал матрасы и делал свой курс по QA.

Приглашаю к просмотру и жду коментов)
  • 👍 11
  • ❤ 6
  • 🔥 6
  • 😁 2
Post #659 2.52K
Доброе утро)

В тему повестки последних дней.
Взял у @etechlead
  • 😁 29
  • 👍 5
  • 🔥 3
Post #658 17.7K
Сижу в лобби отеля, за соседним столом сидят мужики, пьют беленькую, закусывают.
Спорят громко.

Прислушался.
«Петрович, да этих сеток тьма! Маленькие, большие! Для классификации какие хочешь! Можем у себя даже большие развернуть! Главное чтобы электричества хватило!»

Думаю: нифига себе адопшн у АИ!

Слушаю дальше: «Фракции…булыжники…тонны… золото…».

Понимаю что не адопшн, апрофдеформация.
  • 😁 63
  • 👍 10
  • 💯 7
  • ❤‍🔥 4
  • ❤ 1
Post #657 3.79K
AI да парень! / Sergei Notevskii С летним Converstations-AI у меня получилась незакрытая история. Должен был выступать там с докладом про self-hosted vs MaaS. На первый день успел прийти, застать несколько докладов и понетворкать с ребятами, а до своего выступления во второй день не добрался…
Что-же, это было очень сложно, но три самых интересных вопроса выбраны!
- Алина, с вопросом про ревью;
- Петр и вопрос про экономику инференса и кэширование;
- Олег, вопрошающий об абьюзерах)

Доступы к записям с конференции разосланы ребятам)
В ближайшем будущем разберу отдельно их вопросы.

Доброй ночи)
  • 🔥 8
  • 👍 6
  • 🙏 3
  • 🤣 1
Post #651 3.38K
С летним Converstations-AI у меня получилась незакрытая история.

Должен был выступать там с докладом про self-hosted vs MaaS.
На первый день успел прийти, застать несколько докладов и понетворкать с ребятами, а до своего выступления во второй день не добрался - заболел...

Зато успело случиться интервью для канала конференции @conversations_ai.
Ниже будет пост с карточками: там про экономику кэширования, отличия MaaS и self-hosted, неочевидные инженерные затраты на мелкие модели, и конечно evals.

Еще у меня есть три доступа к записям конференции. Случайный розыгрыш делать не хочу - отдам их за три самых интересных вопроса про LLM в проде.

Что в контексте llm в проде у вас сейчас болит сильнее всего?
Дорогой MaaS, медленный self-hosted, как развернуть k3 на ноутбуке, запары с кэшированием, не стабильные evals, хвосты latency - подойдет что угодно из реальной практики.

Пишите в комментариях. В пятницу вечером выберу три вопроса и отдам доступы авторам, а самые интересные потом разберу отдельными постами.

Записи можно купить и без конкурса: https://conversations-ai.com/tickets
  • 🔥 15
  • 👍 5
  • 👀 3
  • 🤷‍♀ 1
  • 🤗 1
Older posts →

About this channel

How can I read @sergeinotevskii without a Telegram account?
TGViewer shows the public web preview Telegram publishes for AI да парень! / Sergei Notevskii: recent posts, photos, videos and the subscriber count, with no app, login or account.
How many subscribers does AI да парень! / Sergei Notevskii have?
AI да парень! / Sergei Notevskii (@sergeinotevskii) has 4.94K subscribers on Telegram, refreshed roughly every 30 minutes.
Does AI да парень! / Sergei Notevskii know I viewed it here?
No. Public channel previews carry no viewer identity, and TGViewer has no accounts or tracking of what you look up.
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →