TGViewer
Channel Public Channel
AI Dev Broadcast

AI Dev Broadcast

@ai_dev_broadcast

Всё про разработку с использованием AI технологий

Наш канал про Android - @android_broadcast
Видео как работать с AI - abdev.by/broadcast_ai_plus
Subscribers
2.39K
Photos
161
Videos
12
Links
142

Showing posts older than #210 · Back to latest

Older Posts 14 shown
Post #209 2.86K
🧠 Fable оставляют в подписке бессрочно на Max и Team Preimium тарифах, а других дадут компенсацию 100$ на токены (какого черта?)

Страх перед GPT 5.6 и KIMI K3 дает о себе знать. На мой взгляд, компания теряет уверенность в своих силах и подходах

#Claude #Anthropic #Fable5
  • 👍 19
  • 👎 3
Post #208 2.26K
Пример работы с Claude Code
  • 👍 35
  • 👎 2
Post #205 2.28K

Forwarded from Nek.12 | AI, SWE, Tech [RU]

Вышла Kimi K3 - опенсорсная китайская модель которая

• Сильнейшая в мире по фронтенд-дизайну
• Стоит как Sonnet, а по уровню превосходит Opus 4.8 во всём (который стоит втрое дороже)
• По уровню чуть ниже Fable, в ~половине бенчмарков побеждает 5.6 Sol
• На 20% меньше токенов тратит чем 2.6
• Контекстное окно 1М токенов

Это удар по антропик невероятного масштаба... Домашний Fable за 1/10 цены с открытыми весами и на своей инфре. Я хз как они от этого оправятся, если в реальном пользовании модель будет такая же, как по бенчам. Дистилляция не прошла даром.
  • 👍 23
  • 👎 2
Post #204 2.3K
🧠 Курсор выложили пачку скиллов для агентов, cursor-team-kit

Практически все там - обычная GitHub-рутина, которую любая команда и так закрыла себе через Actions и скрипты (CI, PR, конфликты, статус работы). Если у вас это уже настроено, открытий тут не будет.

Но пара штук реально цепляет:
✅ verify-this: агент не пишет "готово", а доказывает результат на паре baseline/treatment. Дисциплина вместо доверия на слово, принцип стоит утащить к себе независимо от Cursor.

⚠️ deslop: самое интересное название, но полез смотреть реальный файл скилла, там пять пунктов и три гардрейла, ни одного примера до/после. Без конкретики агент может резать не то что нужно, перед тем как тащить к себе, погоняйте на своём коде и проверьте.

Чего-то сокровенного вы не узнаете из наработок, это срез того, как команда Cursor вообще мыслит про то, что заворачивать в скилл. Смотреть как источник вдохновения.

#AI #Cursor #AIAgents #DevTools
  • 👍 6
  • 👎 4
Post #202 2.09K
От гонки OpenAI и Anthropic выигрвают пользователи - ночью с 15 на 16 июля снова сбросили лимиты!

#Claude
  • 👍 15
  • 👎 4
Post #201 2.44K
Почему самая маленькая квантизированная модель оказалась медленнее — разбор на бенчмарках

Chris Merrick прогнал MobileNetV2 в трёх квантизациях (FP32/INT8/INT4) на Pixel 10. Результат - самая лёгкая по весу INT4 на CPU оказалась медленнее INT8. Вывод: размер файла не главный критерий быстродействия.

Полезно, если делаешь on-device inference и оптимизируешь модели под мобилки.

#AI #Android #OnDeviceAI
  • 👍 6
  • 👎 5
Post #199 9.54K
AI Dev Broadcast ⚡️ SpaceXAI выпустила Grok 4.5 и это уже стоящий конкурент Claude Code с Sonnet/Opus Модель доступна уже сегодня в Grok Build, во всех тарифах Cursor и в консоли SpaceXAI. Цена: $2/млн входных токенов, $6/млн выходных — заметно дешевле Opus $5/$25 Главный…
😮 Так ли хорошо Grok 4.5 как про него говорит Маск?

Сразу после разбора сел с ним делать задачи и в целом он неплохо проявил себя. Решил дать не самую сложную, но и не самую простую задачу - миграция DI в многомодульном Android проекте. В целом справился, но без но не обошлось. Буду тестировать дальше и рассказывать про итоги.

🪙 Демо и мои впечатления в видео на Boosty

#AI #Grok #Android
  • 👍 12
  • 👎 6
Post #198 3.02K
🐱 dcg: хук, который блокирует деструктивные команды AI-агентов до их выполнения.

Rust утилита перехватывает shell-команды агента (Claude Code, Codex CLI, Cursor, Gemini CLI и других) через хук PreToolUse и блокирует выполнение команд вроде git reset --hard, rm -rf, DROP TABLE и подобных до запуска, а не после.

Из коробки включены только пакеты core.filesystem, core.git и system.disk — самые катастрофичные и невосстановимые. Всё остальное (Docker, Kubernetes, облака, базы данных, S3) — опционально, настраивается через конфиг:

[packs]
enabled = ["database.postgresql", "containers.docker", "cloud.aws"]


Нюанс, о котором в README не кричат: дизайн fail-open. Если анализ команды не укладывается в таймаут или парсинг падает, поведение по умолчанию — пропустить команду, а не заблокировать. Это осознанный компромисс, чтобы хук не тормозил работу, но это не полноценный security-барьер, а именно страховка от типичных ошибок агентов.

Если вы работаете с Claude Code и хотите подстраховаться от git reset --hard в 3 часа ночи, утилита устанавливается одной командой, но сразу включайте пакеты под свой стек, так как защита по умолчанию узкая.

#AI #ClaudeCode #AIDev
GitHub GitHub - Dicklesworthstone/destructive_command_guard: The Destructive Command Guard (dcg) is for blocking dangerous git and shell… The Destructive Command Guard (dcg) is for blocking dangerous git and shell commands from being executed by agents. - Dicklesworthstone/destructive_command_guard
  • 👍 11
  • 👎 7
Post #197 1.87K
🤯 GPT 5.6 раскрыл $HOME не туда и снёс файлы разработчика — живой пример, зачем нужен dcg

Мэтт Шумер (AI-инвестор, тестировавший GPT-5.6-Sol в Ultra-режиме по просьбе OpenAI) описал в X инцидент: ревью-субагент неправильно раскрыл $HOME в команде очистки и выполнил rm -rf /Users/<user>. Процесс успели убить, но часть данных потеряна безвозвратно.

Это ровно тот паттерн, от которого защищают core.filesystem/core.git пакеты dcg: деструктивная команда прилетает от агента без единого запроса на подтверждение у человека.

Далее Шумер добавил, что теперь доверяет Fable «в 1000 раз больше». Тут я бы не смешивал: сам факап реален, а вот вывод «модель X лучше модели Y» на основании одного инцидента — это уже реакция на инцидент, а не сравнительный тест.

Если гоняете агентов с доступом к файловой системе локально — хук вроде dcg, бэкапы или лучше оба.

#AI #AIAgents #AIDev"
  • 👍 6
  • 👎 6
Post #196 2.29K
AI Dev Broadcast 😂 Caveman обещал -65% токенов агенту. JetBrains проверили — вышло в разы меньше Популярный скилл Caveman заставляет агента отвечать в стиле "мало слов, много дело", код и команды не трогает. JetBrains прогнали его на реальных тестах с Claude Code: 😂 уменьшения…
Кстати, раз зашла речь про фильтрацию вывода для агентов — есть еще одно популярное решение, RTK. CLI-прокси на Rust перехватывает Bash-вызовы агента и переписывает git status, cargo test, grep и еще сотню команд в компактные версии, обещая экономить 60–90% токенов.

От него я отказался быстро, и вот почему. На синтетических тестах все работает красиво: git push в 15 строк превращается в ok main, тесты показывают только фейлы. Но RTK режет вывод по жестким правилам для команд, без понимания того, что агенту реально нужно для конкретной задачи.

Если он срезал важное, агент это чувствует и обходит: либо дергает исходную команду напрямую (Read/Grep/Glob у Claude Code вообще не проходят через Bash-хук, RTK их даже не видит), либо перевызывает с дополнительными флагами, чтобы дотащить недостающий контекст. В итоге токенов уходит больше, чем без фильтра вообще ⚠️

Можно форсить жестче, есть режим -l aggressive, который вообще режет тела функций, оставляя сигнатуры. Но тогда агент начинает реально хуже решать задачу. Обход или потеря качества, третьего не дано.

Идея правильная, но фильтровать вывод нужно с обратной связью от задачи, а не по статичным правилам для команд. Поэтому пока пользуюсь Context Mode. Там агент сам решает, что убрать в песочницу, а не теряет данные вслепую на входе.

#AI #ClaudeCode
GitHub GitHub - rtk-ai/rtk: CLI proxy that reduces LLM token consumption by 60-90% on common dev commands. Single Rust binary, zero dependencies CLI proxy that reduces LLM token consumption by 60-90% on common dev commands. Single Rust binary, zero dependencies - rtk-ai/rtk
  • 👍 8
  • 👎 5
Post #195 1.78K
🧠 В Claude Code появился checkup — самопроверка и уборка конфигурации

Борис Черны анонсировал команду, которая за один прогон делает то, что раньше руками: чистит неиспользуемые скиллы, MCP и плагины (экономит контекст), убирает дубли между локальным и закоммиченным CLAUDE.md, режет разросшийся корневой CLAUDE.md на вложенные файлы + скиллы, отключает медленные хуки, обновляет сам Claude Code, включает auto mode по умолчанию и заранее одобряет read-only команды, которые вы обычно отклоняете вручную.

В официальных release notes подтверждено: /doctor стал полноценным чекапом окружения с автофиксом, /checkup — его алиас.

‼️ ВАЖНО: пункты про auto mode и pre-approve команд — это не просто уборка, а изменение доверительных настроек сессии. Команда спрашивает подтверждение перед каждым шагом, но именно эти два пункта стоит прогонять осознанно, а не жать y на автомате.

Разросшийся CLAUDE.md и забытые MCP-серверы — знакомая боль всем, кто держит Claude Code в проекте месяцами. Здесь я, честно, буду смотреть на предложенные правки руками: авточистка конфигурации это не автопамять агента, ошибка тут стоит дороже, чем забытый факт.

#ClaudeCode #AIDev
  • 👍 8
  • 👎 6
Post #194 1.81K
😂 Caveman обещал -65% токенов агенту. JetBrains проверили — вышло в разы меньше

Популярный скилл Caveman заставляет агента отвечать в стиле "мало слов, много дело", код и команды не трогает. JetBrains прогнали его на реальных тестах с Claude Code:
😂 уменьшения потребления output токенов с 592k до 542k, то есть -8.5% и совсем далеко от заявленных цифр
👍 качество остается на том же уровне
💰 выигрыша по стоимости нету: в теории должна была падать на ~10%, но один таск перевалил за 200k-контекст и по итогу счет на $8.29

65% в рекламе Caveman честные только для чатов
. В агенте токены — это код, диффы и вызовы тулов, а не болтовня между ними, их скилл и не трогает.

#AI #ClaudeCode
  • 👍 15
  • 👎 6
Post #189 2.19K
Да заееее.... Meta выпустила модель для кодинга, которая на уровне Opus 4.8 и GPT 5.5. Мир AI притормози, дай перевести дух и адекватные цены за токены
  • 👍 12
  • 👎 5
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →