Привет, друзья! Вчера в ночи вышли две новые модели: у Anthropic вышел
Opus 4.6 с 1М токенов, а у OpenAi —
Codex 5.3.
Из статьи Anthropic следует, что на сегодняшний день Opus 4.6 — самая интеллектуальная модель, доступная широкой общественности.
Судя
по их тестам, всё классно, но нужно, разумеется, потестировать в деле. Context Rot никто не отменял, к сожалению.
Помните концепцию «Standing on the shoulders of giants»? Мы строим продукты, которые базируются на постоянно растущем уровне интеллекта и становятся «умнее» без нашего участия. Ух…
Всё начало этой недели я был в командировке, поэтому ничего не писал, но есть пара моментов, которые я посмотрел и попробовал, хочу поделиться. Вдруг, есть время на выходных, либо вы уже настолько поглощены новинками Agent Coding, что вместо основной работы занимаетесь экспериментами и этого ещё никто не заметил :)
1. AutoForge (
https://github.com/AutoForgeAI/autoforge) — проект нашего товарища
Leon Van Zyl, раньше назывался Autocoder. Это практически автономная среда для кодирования, которая умеет разбивать проект на фичи и параллельно их создавать, попутно тестируя и проверяя функциональность. Мы с ребятами уже пару-тройку недель её терзаем, обычно флоу работы такой: ты создаешь 80% проекта через AutoForge, а потом остальные 20% добиваешь в Windsurf / Claude Code CLI. Вещица убойная, особенно для несложных задач. Идеально для PoC.
2.
Sandboxed.sh (
https://github.com/Th0rgal/sandboxed.sh) — окестратор для AI-coding-агентов, позволяет запускать, контролировать и мониторить AI-агентов (Claude Code, OpenCode, Amp, Codex) в изолированных окружениях (Docker). Если страшно запускать агентов на своей машине или хочется развернуть где-нибудь в облаке, это прекрасный продукт. Пока в активной стадии разработки, постоянно за ними слежу, ребята очень интересные. На базе Sandboxed можно создать автономную фабрику агентного кодирования, которая будет разворачиваться и работать в нужных окружениях практически с нулевыми затратами на настройку и запуск.
3. Claude-mem (
https://github.com/thedotmack/claude-mem) — система постоянной памяти для агентного кодирования. Пользовался ею последний месяц. Фактически, она пытается решить задачу бесконечного контекста для моделей, у которых этот контекст ограничен + очень эффективно инициализирует сессии новых агентов, передавая им контекст проекта. Если вы знакомы с феноменом
Context Rot, то это палочка-выручалочка. По моим ощущениям, повышает качество и точность работы процентов на 10-15 в большинстве сценариев.
Happy Coding!