TGViewer
Channel Public Channel
AI Dev Broadcast

AI Dev Broadcast

@ai_dev_broadcast

Всё про разработку с использованием AI технологий

Наш канал про Android - @android_broadcast
Видео как работать с AI - abdev.by/broadcast_ai_plus
Subscribers
2.39K
Photos
161
Videos
12
Links
142
Recent Posts 16 shown
Post #272 869

Forwarded from Nek.12 | AI, SWE, Tech [RU]

https://youtu.be/32zpk7tqs0M

Запись доклада уже доступна на ютубе!

Напомню, что я сравнил Kent и Codex по куче параметров на одной и той же задаче в Респавне, моем KMP-приложении, а также рассказываю про проблемные зоны в сфере, почему агенты не слушаются инструкций, как работает внимание у моделей, как делать хорошие агентные графы на примере.
YouTube Доклад "Android-разработка на авторежиме: от няньки к графам" / Никита Вайзин(Respawn) Я покажу, как вынести дисциплину из промпта в агентный граф, где человек остается только в точках, где нужно принимать решения. Разберём подход на примере моего харнесса и сравним обычного агента с агентным графом на одинаковых Android-задачах. Материалы…
  • 👍 9
  • 🔥 1
  • 👏 1
Post #270 1.26K
❤️ Яндекс открыл претрейн, который учили с нуля - AliceAI-Foundation-80B-A3B-Base

Сразу стоит сказать - это не конкурент ChatGPT или Claude. Base-модель: MoE 80B параметров, на токен активны 3B, контекст до 262k, лицензия Apache 2.0. Веса на Hugging Face, разбор пайплайна и замеров в техрепорте на Хабре.

Предыдущая модель Яндекса Alice AI LLM 235B была сделана на основе весов Qwen3-235B. Здесь чужих весов нет, да и архитектура своя. Для российского стека это уже не «докрутили чужой чекпойнт и назвали своим».

По коду цифры Яндекса среди open моделей выглядят нормально, но и это лишь первый релиз и важно как будут дальше развиваться модели компаний. Как минимум они дали новый фундамент, который можно дальше дообучать для разных целей.

#AI #LLM #Yandex
  • 👍 20
  • 🎉 3
Post #265 1.31K
⚡️⚡️AI-агент съел токены и потерял контекст. Что делать? Разберемся на Mobius 2026 Autumn.

Когда AI становится частью рабочего процесса, появляются вполне инженерные вопросы: сколько токенов уходит на задачу, где агент теряет контекст, оправдан ли MCP, как поделиться рабочими практиками внутри команды и где автоматизация начинает создавать больше проблем, чем решает.

Этим вопросам посвятят отдельный блок на Mobius 2026 Autumn — конференции по мобильной разработке. Восемь докладов, где AI-разработку рассмотрят с разных сторон: от оптимизации агентов и оркестрации до юридических ограничений и локальных моделей.

Подробности — в карточках и на сайте.

Конференция пройдет 21–22 октября в Санкт-Петербурге + онлайн. 

🔥С промокодом aidevbroadcast персональные билеты дешевле

Купить билет

Реклама. ООО «Джуг Ру Груп». ИНН 7801341446
  • 👎 7
  • 👍 5
  • ❤ 2
Post #264 1.43K
🤯 Вышла Grok 4.7

Модель прокачали во всем по сравнению с Grok 4.6 и соперничает с Fable 5.1 и GPT-5.6 Sol (GPT 6 далеко впереди всех). Цена по API доступу не менялась

Уже доступна в Grok, Grok Build и Cursor!

#SpaceXAI #Grok #Cursor
  • 👍 11
Post #262 2.4K
AGENTS.md теперь поддерживается в Claude Code 🤯 Дарио уже не тот

#ClaudeCode
  • 👍 27
Post #261 2.31K

Forwarded from AI Adopter | внедряю ИИ в жизнь

🤖 Сначала требования, потом код. Как это работает с AI на реальном проекте?

Идея Spec-Driven Development (SDD) простая: сначала фиксируем, что должно получиться, затем агент пишет код по спецификации.

Но сколько времени уйдёт на подготовку? И не придётся ли потом исправлять и код, и документы? 🙂

🔍 В блоге RuStore разбирают Spec Kit и OpenSpec на задачах реального Android-проекта. Интересный повод посмотреть, как SDD вписывается в повседневную разработку.

https://www.rustore.ru/developer/blog/spec-kit-i-openspec-v-realnom-android-proekte-testiruem-sdd-na-zadachah-rustore

Disclaimer Это не рекламный пост) Статья основана на реальном сравнении работы spec-фреймворков на задачах нашего Android-приложения. И получились интересные, которые спешим с вами поделится 😉
www.rustore.ru Spec Kit и OpenSpec в реальном Android-проекте: тестируем SDD на задачах RuStore Команда Android-разработки RuStore протестировала Spec Kit и OpenSpec на реальных задачах: как SDD-фреймворки показали себя по стоимости, расходу токенов, объёму артефактов и автономности — и почему решили не мигрировать на них.
  • 👎 18
  • 👍 10
Post #260 1.76K

Forwarded from Кирилл Розов

🧠 Amodei призывает замедлить рост возможностей моделей, пока безопасность не будет иметь аналогичный темп, а сейчас и вовсе догонять

CEO Anthropic сегодня выложил эссе We Must Pace the Frontier. Ключевой тезис — перестать наращивать силу моделей быстрее, чем успевают за контролем поведения моделей и пониманием их внутренностей.

За последние месяцы уже были два опасных звоночка:
1. С лета модели ускорились ещё и тем, что сами помогают собирать следующее поколение.
2. Инцидент OpenAI и Hugging Face: рой агентов сам полез в кибератаки на цели вне задания, жертвовал собой ради группы и пытался взломать систему оценки. Никто не пострадал. Amodei пишет: при той же кривизне целей, но большей силе, через 6–12 месяцев такой рой мог бы удержать сеть ботов на весь интернет.

Практический шаг, который Anthropic делает сам: сторонние аудиторы внутри компании. Команда вроде METR получает почти тот же доступ, что сотрудники Anthropic. Они могут публиковать открыто находки без правки текста Anthropic (за исключением коммерческой тайны и перс данных).

Также эссе описывает, что делать с китайскими компаниями, предлагает варианты использования времени от замедления и другие идеи из его видения.

Идея правильная, но никто не будет останавливать эту гонку, кроме правительства, а там уже на решение влияет политика и нельзя дать Китаю захватить первенство. Не думаю, что кто-то остановится, пока не будет уже поздно, так как в этой гонке все хотят победить, и это уже вопрос контроля будущего и оправдания финансовых и других обязательств, которые взяли на себя лидеры. Чем-то вся эта ситуация напоминает мне ядерное сдерживание, но в AI моделях постоянно надо делать более мощную и эффективную бомбу, параллельно сдерживая конкурентов из других стран.

Вдруг GigaChat рванет, пока никто не верит в Россию в сфере AI? Только время покажет, как будет, но наблюдать точно интересно.

💬 Стоит ли ограничить уровень развития AI и сфокусировать на безопасности, контроле и цене/качество моделей? Делитесь в комментариях

#AI #Anthropic #ClaudeCode
  • 👎 9
Post #258 3.12K
🧠 Вышел GPT 6 от OpenAI. Король пал, да здравствует новый король бенчей, конечно же по замерам OpenAI. Ждем честных результатов!

#OpenAI #GPT
  • 👍 22
  • 👎 4
Post #257 3.11K
Халява Deep Seek V4 закончилась - цены подняли еще 14 августа от 1.5 до 5 раз 🤯 Цены на железо растут, периоды привлечения через низкую цену не могут длиться долго. Когда сделали качественный продукт - пора приводить цены в реальность!

#AI #DeepSeek
  • 👎 8
  • 👍 6
Post #256 2.98K
⭐️ Вышла Gemini 3.8 Flash и дает жару Claude моделям. По цене/качество в стандартных бенчах выдало хорошие результаты.

На самом деле становится очень интересно как легкие модели (та же GLM 5.3 Flash и Qwen3.8 Flash) показывают нетоповые но высокие результаты и для кодинга в руках профессионала уже могут много закрыть. Эпоха дорогих моделей будет отходить на второй план, так как никто не готов переплачивать и цена будет важным драйвером спроса!

#AI #Gemini
  • 👍 11
  • 👎 5
Post #255 2.42K
Ваши модели тратят более 80% средств на чтение и запись в кэш, тогда как реального нового контента они производят очень мало. Это не обман, а реальное устройство работы с LLM. Каждый ваш запрос в сессии отправляет всю историю переписки.

Это нужно просто принять и оптимизировать: плагины Caveman, context mode, RKT и другие подобные инструменты, которые влияют на размер выдачи.

🔗 Источник исследования

#AI
  • 👎 9
  • 👍 5
Post #254 2.66K
🧠 OpenAI отключает модели в Cursor после покупки SpaceX

OpenAI уведомила SpaceX, что сворачивает контракт на поставку своих моделей в Cursor. Предложенная дата отключения — 12 ноября 2026. Это крайний срок по изменению условий в договоре.

Причина официально не «конкуренция», а доверие. OpenAI пишет, что не уверена в том, что SpaceX будет соблюдать условия использования. Оно то по факту, история с X после покупки Маском и признание под присягой, что xAI нарушала правила OpenAI. Будущую модель Astra в Cursor тоже не дадут.

По словам CEO Cursor, модели OpenAI — это около 5% трафика пользователей. Свой API-ключ по-прежнему можно подключить. Anthropic уже заявила, что нарастит compute под Claude внутри Cursor.

Для тех кто использовал модели OpenAI явно в Cursor - это потеря, но в целом выбор альтернатив был большой, да и Compose с Grok уже на хорошем уровне решают задачи. Так что на режиме работы "Авто" не повлияет в качестве работы.

🔗 Источник: Reuters · пост OpenAI

#AI #Cursor #OpenAI #SpaceX
  • 👍 3
  • 👎 3
Post #253 2.33K
🧠 Claude Code увеличивает лимиты во всех планах личной подписки на 25% с сентября. До этой даты повышение будет 50%.

🔗 Источник - оф X Claude Code

Anthropic понимает что происходит и пытается исправить ситуацию. Все мои знакомые говорят как без замеров стало ощущаться меньшее кол-во работы после перехода на Sonnet 5 и Opus 5. Даже x1.5 лимита было мало, но а x1.25 малое утешение.

#ClaudeCode #AI
  • 👎 10
  • 👍 4
Post #252 2.62K
⚡️ AI Flash Day: вышли GLM 5.3 Flash и Qwen 3.8 Flash Next

Сегодня китайцы одновременно выкатили две модели с «Flash» в названии. И обе — не просто «дешёвые», а реально рабочие для кодинга и агентов.

Qwen3.8-Flash-Next
Это превью архитектуры будущей Qwen 4 (отсюда и Next в названии).
Контекст 262K, расширяется до миллиона. По SWE-bench Pro обходит Claude Opus 4.6 Max (62.5 против 53.4). Обучение обошлось в 9 раз дешевле предыдущего флагмана. Веса открыты, API $0.16/$0.47.

GLM-5.3-Flash
MIT лицензия, нативно мультимодальная, 1 миллион токенов контекста.
До релиза её гоняли как ox-alpha. Она сразу стала самой популярной моделью недели. И всё это крутилось на китайских чипах (это отдельно отметили при выпуске модели). В тесте DeepSWE 63.4 (у Claude Opus 4.8 — 58).

Обе модели уже можно брать и использовать.

Пока OpenAI и Anthropic выпускают очередной frontier за космические деньги, здесь просто кладут на Hugging Face то, что работает и стоит нормальных денег. Что тут добавить... Надо тестировать на реальных задачах

#AI
  • 👍 22
  • 👎 2
Post #251 2.92K
Vercel представил Agent Plugins 1.0.0 — открытый стандарт для плагинов, расширяющих AI-агентов

Те, кто делал плагины для ИИ-кодинг-агентов, знают про неудобство с поддержкой плагинов для всех инструментов. Теперь должно стать легче! Agent Plugins — это общий, вендор-нейтральный стандарт упаковки Agent Skills (инструкции и ресурсы) и MCP-серверов (инструменты и сервисы) в единый дистрибутив.

Как это работает?
Плагин — это директория с манифестом plugin.json и фиксированной структурой:
my-plugin/
├── plugin.json
├── skills/
│ └── summarize/
│ ├── SKILL.md
│ ├── scripts/
│ └── references/
├── mcp.json
└── com.example.client/

Клиенты проверяют plugin.json, находят Skills в skills/, а конфигурацию MCP — в mcp.json. Компоненты валидируются независимо — ошибка в одном не ломает другие.

Ключевые особенности:
📦 Один пакет для всех клиентов — больше не нужно переупаковывать компонент под каждый формат.
🎯 Small on purpose — стандарт определяет только контракт обнаружения и загрузки, оставляя клиентам свободу в UX, политиках и инновациях.
🔧 Гибкость для клиентов — через механизм неймспейсов можно добавлять клиент-специфичные расширения без загрязнения общего формата.
🏢 Открытый мультивендорный проект — инициатива Vercel, доработанная совместно с AWS, Anysphere (Cursor), GitHub, Microsoft и OpenAI. Технический комитет состоит из AWS, Cursor, Microsoft, OpenAI и Vercel.

Где уже поддерживается:
- ChatGPT и Codex
- Cursor
- GitHub Copilot
- Kiro
- VS Code

Плагины, упакованные по этому стандарту, автоматически работают во всех перечисленных клиентах.
Для авторов расширений (подключение) — документация и схемы JSON на agent-plugins.org.
Для разработчиков AI-агентов (интеграция формата) — чеклист соответствия в репозитории спецификации.

#AI
  • 👍 13
  • 👎 7
Older posts →

About this channel

How can I read @ai_dev_broadcast without a Telegram account?
TGViewer shows the public web preview Telegram publishes for AI Dev Broadcast: recent posts, photos, videos and the subscriber count, with no app, login or account.
How many subscribers does AI Dev Broadcast have?
AI Dev Broadcast (@ai_dev_broadcast) has 2.39K subscribers on Telegram, refreshed roughly every 30 minutes.
Does AI Dev Broadcast know I viewed it here?
No. Public channel previews carry no viewer identity, and TGViewer has no accounts or tracking of what you look up.
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →