Привет, друзья! Вчера в ночи вышли две новые модели: у Anthropic вышел Opus 4.6 с 1М токенов, а у OpenAi — Codex 5.3.
Из статьи Anthropic следует, что на сегодняшний день Opus 4.6 — самая интеллектуальная модель, доступная широкой общественности.
Судя по их тестам, всё классно, но нужно, разумеется, потестировать в деле. Context Rot никто не отменял, к сожалению.
Помните концепцию «Standing on the shoulders of giants»? Мы строим продукты, которые базируются на постоянно растущем уровне интеллекта и становятся «умнее» без нашего участия. Ух…
Всё начало этой недели я был в командировке, поэтому ничего не писал, но есть пара моментов, которые я посмотрел и попробовал, хочу поделиться. Вдруг, есть время на выходных, либо вы уже настолько поглощены новинками Agent Coding, что вместо основной работы занимаетесь экспериментами и этого ещё никто не заметил :)
1. AutoForge (https://github.com/AutoForgeAI/autoforge) — проект нашего товарища Leon Van Zyl, раньше назывался Autocoder. Это практически автономная среда для кодирования, которая умеет разбивать проект на фичи и параллельно их создавать, попутно тестируя и проверяя функциональность. Мы с ребятами уже пару-тройку недель её терзаем, обычно флоу работы такой: ты создаешь 80% проекта через AutoForge, а потом остальные 20% добиваешь в Windsurf / Claude Code CLI. Вещица убойная, особенно для несложных задач. Идеально для PoC.
2. Sandboxed.sh (https://github.com/Th0rgal/sandboxed.sh) — окестратор для AI-coding-агентов, позволяет запускать, контролировать и мониторить AI-агентов (Claude Code, OpenCode, Amp, Codex) в изолированных окружениях (Docker). Если страшно запускать агентов на своей машине или хочется развернуть где-нибудь в облаке, это прекрасный продукт. Пока в активной стадии разработки, постоянно за ними слежу, ребята очень интересные. На базе Sandboxed можно создать автономную фабрику агентного кодирования, которая будет разворачиваться и работать в нужных окружениях практически с нулевыми затратами на настройку и запуск.
3. Claude-mem (https://github.com/thedotmack/claude-mem) — система постоянной памяти для агентного кодирования. Пользовался ею последний месяц. Фактически, она пытается решить задачу бесконечного контекста для моделей, у которых этот контекст ограничен + очень эффективно инициализирует сессии новых агентов, передавая им контекст проекта. Если вы знакомы с феноменом Context Rot, то это палочка-выручалочка. По моим ощущениям, повышает качество и точность работы процентов на 10-15 в большинстве сценариев.
Happy Coding!
Post #857
42
Forwarded from Anton Vdovitchenko — One Man Enterprise
