TGViewer
Channel Public Channel
very vibe coding

very vibe coding

@veryvibecoding

Канал Алексея Макрушина об экспериментах в области vibe coding и всего интересного, что есть в области AI, ML и тому подобного
Subscribers
120
Photos
460
Videos
126
Links
986

Showing posts older than #1238 · Back to latest

Older Posts 17 shown
Post #1237 41

Forwarded from Вайб-кодинг

Thariq из Антропик, поделился годным промтом, которым часто пользуется:

implement <SPEC> and while you do, keep a running implementation-notes.html file (or markdown) with decisions you had to make weren't in the spec, things you had to change, tradeoffs you had to make or anything else I should know


Мы просим у агента реализовать <SPEC> и при этом вести файл implementation-notes.html с заметками о решениях, которых не было в спецификации, изменениях, компромиссах, на которые пришлось пойти и тд.

Ведь, как бы тщательно вы ни описали спецификацию, всегда остаются неоднозначности и непредвиденные нюансы, которые всплывают в процессе. Этот подход даёт модели возможность принимать решения, но при этом держать вас в курсе.
Post #1235 37
У GitHub появилась стандартная документация для агентской разработки программ - https://github.com/github/spec-kit. Уже 102К звезд.

Берем этот подход, накладываем сверху Symphony от OpenAI для оркестрации, запускаем /goal - и разработка идет сама по себе, на основе заданных стандартов...

На практике все-равно надо будет кучу всего исправлять, но что сейчас происходит - это переход от кастомных сборок к построению работы на основе стандартных кирпичиков промышленного качества.
GitHub GitHub - github/spec-kit: 💫 Toolkit to help you get started with SDD or any other process! 💫 Toolkit to help you get started with SDD or any other process! - github/spec-kit
  • 👍 1
  • 🔥 1
Post #1231 37

Forwarded from Вайб-кодинг

Open Design теперь работает прямо внутри Codex.

Самое сложное в вайб-дизайне это не создать один экран, а сохранить замысел дизайна на всём пути: когда ты итеративно правишь, строишь и выпускаешь продукт.

Теперь ваш агент может работать напрямую с канвой. Дизайн → код → анимация, в одном рабочем процессе.

Вот короткая демонстрация:

1/ Сначала попросите Codex запустить Open Design локально:
«Помоги мне развернуть локально и запустить Open Design внутри Codex: https://github.com/nexu-io/open-design»

Codex поможет клонировать репозиторий, установить зависимости, запустить локальное приложение и открыть его в встроенном браузере.

2/ Затем опишите, что вы хотите спроектировать.
Вы можете писать прямо в чат, вставлять контекст продукта, загружать референсы или выбрать дизайн-систему/шаблон в качестве отправной точки.
Open Design даёт Codex визуальное полотно, с которым он может работать, а не только текст.

3/ Дальше просто продолжайте общаться с агентом.
Попросите его создавать экраны, изменять макеты, редактировать выбранные компоненты, генерировать варианты или превращать дизайн в код/анимацию.

Процесс дизайна превращается в диалог прямо внутри Codex. 🐈
Post #1230 36
Одной строкой:
Cursor хвастается новой моделью на уровне Opus 4.7;
К Zoom прикрутили Codex. Или наоборот?
Unsloth ускорили Qwen 3.6 раза в полтора;
Завтра Gemini 3.2? А может и новенький Claude?
  • 🤔 1
Post #1229 35

Forwarded from Tips AI | IT & AI

Месяц назад установил Impeccable, пока это лучший скилл, чтобы перестать генерить AI слоп в дизайне.

Это набор из 23 команд, который ставится в Claude Code, Cursor, Codex, Gemini CLI и др.

Примеры команд:
/impeccable audit — поиск проблем по вёрстке и контрастам
/impeccable polish — финальная зачистка перед релизом
/impeccable typeset — починить шрифты и типографику
/impeccable distill — убрать всё лишнее


Внутри 7 справочников: типографика, цвет, анимация, адаптивность и другое.

Загружаются они в каждую команду, а агент опирается на них и не придумывает свое.

Ещё есть CLI детектор: npx impeccable detect <папка или URL> — без API сканирует код и выявляет больше 25+ видов слопа в дизайне.

Так же Chrome расширение, можете проверять им любой сайт на эту же проблему.

Советую попробовать: Сайт | GitHub

@tips_ai #tools
  • ❤ 3
Post #1228 36

Forwarded from Data Secrets

CEO YCombinator Гэрри Тэн опенсорснул собственный модуль памяти для агентов

github.com/garrytan/gbrain

Гэрри пишет, что это продакшен-мозг, на котором работают его личные агенты OpenClaw и Hermes. Ну а на практике это что-то вроде живой базы знаний, которая сама себя обогащает.

Если обычные агенты не помнят контекст между сессиями или записывают что-то в MEMORY.md очень примитивным способом, то здесь предлагается многоуровневая архитектура построения глубокой памяти. Кратко:

– Вся база состоит из markdown файлов. Каждый человек, компания, концепция, встреча – это отдельный файл. Каждый файл – это саммари, которое перезаписывается при поступлении новых данных, и хронологический журнал упоминаний.

– По этой базе работает гибридный поиск. Когда агент что-то ищет, работают одновременно: векторный поиск, поиск по ключевым словам и поиск на графе.

– Граф связей, по которому осуществляется графовый поиск, тоже формируется автоматически и при этом даже без вызова LLM (с помощью регулярок и прописанных правил). То есть система сама себе рисует сеть: кто где работает, кто был на какой стрече, кто во что инвестирует и тд.

Обновляется все это с помощью одного файла RESOLVER.md, в котором прописаны 29 специальных скиллов. Например, meeting-ingestion: транскрипты митингов перерабатываются в режиме сна, чтобы обогощать файлы участников.

Конечно, пользоваться прямо всей этой махиной необязательно. Базовую версию можно поставить себе за 30 минут и использовать как MCP. Лицензия MIT.
Post #1227 33

Forwarded from Machinelearning

🌟 Raindrop открыла исходный код локального отладчика агентов Workshop

Инструмент интегрируется с Claude Code, Cursor и другими кодинг-агентами.

Raindrop - стартап из 9 человек, основанный в 2023 году, который позиционирует себя одним из первых, кто оформил мониторинг для ИИ-агентов как отдельный продуктовый класс.


При использовании Workshop модель получает прямой доступ к трассировкам выполнения, читает их, пишет оценочные тесты и правит код, замыкая цикл самовосстановления.

Если агент в проде отклоняется от ожидаемого поведения, разработчик вызывает кодинг-агента прямо в терминале. Тот читает трассу через Workshop, пишет оценку под падающий сценарий, правит код и перезапускает прогон.

Цикл повторяется автоматически, пока не пройдут все проверки.


Workshop работает локально и стримит данные в реальном времени. Каждый токен, вызов инструмента и шаг рассуждения попадает в интерфейс по мере выполнения, без поллинга.

Есть режим воспроизведение, который берёт трассу из продакшена и прогоняет её через ваш экземпляр агента, запущенный локально.

Заявлена поддержка TypeScript, Python, Go и Rust, а также фреймворков Vercel AI SDK, OpenAI Agents SDK, Anthropic SDK, Claude Agent SDK, LangChain, LangGraph, CrewAI, Mastra, Pydantic AI и DSPy.


📌 Лицензирование: MIT License


🟡Документация
🖥GitHub


@ai_machinelearning_big_data

#AI #ML #Agents #Workshop #RaindropAI
Post #1226 38
Post #1225 36
Режимом /goal на Codex пользуюсь уже две недели, и это потрясно. подробно объясняешь модельке что нужно, и она уходит колбасить проект. Может работать пару часов, может - пару десятков часов, пашет как проклятая. Понятно, что получается не всегда точно то, что задумывал, но работает очень хорошо. И даже лимитов хватает (видимо, только пока).

Еще в этот цикл встраиваю такие задачки - как получить обратную связь от Gemini и Claude - кодекс подключается к ним по протоколу acpx, те отсматривают созданный функционал и дают комментарии, что надо поправить. Тоже весьма полезно.

Удивительно, но чудеса с ИИ не заканчиваются. Судя по всему, только начинаются.

https://t.me/llm_under_hood/838
Telegram LLM под капотом Codex Desktop / CLI поддерживает режим "копать отсюда до обеда" Для этого нужно в ~/.codex/config.toml включить такой флаг: [features] goals = true и потом можно запускать задачу с режимом /goal и уходить заниматься своими делами. Например: /goal А…
  • 🔥 1
Post #1224 35
Теперь, когда надо разобраться в новой программке, статье, посте, я всегда бросаю ссылку в телеграмме OpenClaw, и он мне кратко описывает, что это и дает рекомендации. Очень к этому привык.

С утречка получил он него положительную рецензию на еще одну программку ClawPatch - буду ставить. Это тоже от создателя OpenClaw, так что положительный ответ меня не удивляет )
Clawpatch Clawpatch — Automated Code Review That Lands Fixes Automated code review that lands fixes. Maps codebases into semantic features, reviews for bugs and quality, and records explicit fixes.
Post #1223 42
Вторая история - поставил себе бесплатный внешний поиск для агентов TinyFish. Писал о нем раньше. Дает агентам более чистый результат, особенно, когда много страниц надо лопатить. Экономит токены - поработаю, расскажу подбробнее о впечатлениях.
GitHub TinyFish Scale your operations with leading web agents at TinyFish.ai - TinyFish
Post #1222 37
Из нового - что еще себе поставил. Во-первых, CodexBar - это проект, который делает создатель OpenClaw. Учитывая, что его команда палит на токены в OpenAI 1,3 млн баксов в месяц, а результаты - ложатся в опенсорс, продукты качественные. По смыслу - это простая иконка сверху, при клике на которую показываются лимиты Codex, Claude, Gemini. То, что нужно, когда сидишь на этих лимитах - Клода я использую активно, а при лимите в 20 баксов приходится за расходом токенов следить. Выглядит отлично, рекомендую.

Как мне эта панелька говорит, за сегодня, если считать токены по апи, а не по подписке, за вечер я сжег их на 130 баксов. А за месяц - на 3 тысячи. Люди, не пользуйтесь нейронками по апи. Разве что deepseek - он дешевый и унего других вариантов нет.
GitHub GitHub - steipete/CodexBar: Show usage stats for OpenAI Codex and Claude Code, without having to login. Show usage stats for OpenAI Codex and Claude Code, without having to login. - steipete/CodexBar
Post #1221 32
У меня сейчас в качестве пвмяти используется claude-mem - штука хорошая, работает, но на рынке появляются все более продвинутые продукты. Поставил себе попробовать agentmemory - работает со всеми агентами, на всех моих компьютерах, есть графовая база, рефлексия на полученный опыт. Посмотрим, как будет работать. Это есь и в том же Гермесе, но пока ланирую сидеть на Codex + Claude-code, так что отдельня память не помешает.
GitHub GitHub - rohitg00/agentmemory: #1 Persistent memory for AI coding agents based on real-world benchmarks #1 Persistent memory for AI coding agents based on real-world benchmarks - rohitg00/agentmemory
Post #1220 31

Forwarded from Machine learning Interview

Mythos обошёл защиту, в которую Apple вложила 5 лет и миллиарды

Три исследователя использовали Anthropic Mythos, чтобы собрать рабочий exploit для macOS kernel. По их словам, он обходит Apple M5 Memory Integrity Enforcement - систему защиты, которую Apple строила годами и продвигала как один из главных барьеров против memory corruption атак.

Таймлайн выглядит жёстко:

- 25 апреля нашли баг
- 1 мая уже был рабочий exploit
- отчёт понесли лично в Apple Park

MIE была флагманской security-фичей для M5 и A19. Apple описывала её как защиту, которая должна резко усложнить целый класс атак на память. По их же исследованиям, MIE ломала все известные публичные exploit chains против современных iOS-устройств.

Исследователи не «сломали» MIE напрямую. Они её обошли. По описанию, атака была data-only: без манипуляций с указателями, через стандартные syscalls, от обычного непривилегированного пользователя до root.

Проблема уже не только в том, что уязвимости всё ещё находятся. Проблема в том, что frontier-модели начинают ускорять самую сложную часть offensive security: связывать баги, проверять гипотезы, искать обходные маршруты и собирать рабочую цепочку быстрее, чем это делала бы обычная команда вручную.

55-страничный технический отчёт обещают выпустить после патча Apple.

Если всё подтвердится, это одна из самых важных cybersecurity-историй года.

https://blog.calif.io/p/first-public-kernel-memory-corruption
  • 🔥 1
Post #1219 36
В ближайшие дни нас могут ждать большие новости о создании новой архитектуры сетей от компании с говорящим названием SubQ - обещают, что будет решена проблема квадратичного роста компьюта при увеличении контекста. Все больше свидетельств, что это не фейк, а реальный прорыв

https://subq.ai/introducing-subq
Subquadratic Introducing SubQ: The First Fully Subquadratic LLM Subquadratic is a frontier AI research and infrastructure company building a new class of LLMs.
  • 🎉 1
Post #1218 41
Claude code постоянно обновляется, и работать с ним удобнее, чем с Codex. Как минимум, таблички нормально отрисовываются в диалоге - не понимаю, почему OpenAI с этим справить не может. А еще появилась опция отражать внизу диалога тех субагентов, которые работают - очень удобно и полезно для понимания процесса. На шаг впереди идут Антропики
  • 🔥 2
Post #1217 45
Сегодня все внимание соцсетей - на запуске мобильного приложения Codex. Но у нас оно не работает, да и кайфа в программировании с телефона, прямо скажем, маловато. Но в целом стремление иметь общую среду на всех устройствах - похвальное, так все и должно работать. В этом плане удивительно, что сессии в терминале и сессии в приложении никак не видят друг друга, ни у Клода, ни у Кодекса
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →