TGViewer
Machine learning Interview Machine learning Interview @machinelearning_interview · 30.3K subscribers
Post #2689 4.69K
⚡️ Anthropic отвязала мозги агентов от рук, и это меняет всю архитектуру

Сегодня Anthropic выкатила в открытую бету Claude Managed Agents. Вы описываете задачи, инструменты и guardrails, а платформа хостит и запускает долгоживущих агентов за вас.

Ключевое архитектурное решение: декомпозиция агента на три изолированных интерфейса. Session (append-only лог событий), Harness (stateless оркестратор вызовов модели) и Sandbox (среда исполнения кода). Каждый компонент независим, при падении перезапускается без потери состояния. Harness обращается к sandbox как к обычному tool call: execute(name, input) → string. Контейнер больше не "питомец", а "скот")

Зачем это сделано: первая версия пихала всё в один контейнер. Падал контейнер - терялась сессия. Credentials лежали рядом с пользовательским кодом, что открывало вектор для prompt injection. Подключить клиентский VPC можно было только через пиринг сетей.

Теперь sandbox физически изолирован от токенов (Git-ключи прошиваются при инициализации, OAuth живет в vault за прокси). TTFT на p50 упал на 60%, на p95 - больше чем на 90%. Архитектура поддерживает "many brains, many hands": один агент рулит несколькими sandbox-ами, агенты передают окружения друг другу.

Самое любопытное в философии. Anthropic называет это мета-harness и намеренно не фиксирует конкретную оркестрацию, потому что она устаревает с каждым поколением моделей. Они уже наступили на эти грабли: workaround для "context anxiety" в Sonnet 4.5 превратился в мертвый код на Opus 4.5. Ставка на стабильные интерфейсы при сменяемой реализации - ровно как POSIX, где read() одинаково работает для диска из 70-х и современного SSD.
Notion уже в закрытой альфе: команды делегируют задачи Claude прямо из воркспейса, десятки задач параллельно.

https://www.anthropic.com/engineering/managed-agents
  • 🔥 14
  • 👍 7
  • ❤ 4
  • 💊 3
More from @machinelearning_interview
  1. Sep 25, 2026📋 Китай впервые обошёл США по числу ведущих ИИ-исследователей По данным нового исследован…
  2. Sep 25, 2026Пользователь смотрит видео, листает клипы, ставит лайки — каждое действие становится сигна…
  3. Sep 25, 2026🛡️ Microsoft открыла skill для автоматического поиска рисков в AI-агентах Новый run-asser…
  4. Sep 25, 2026✔️ OpenAI выпустила открытый бенчмарк для оценки ИИ в психологии Набор Mental Health Bench…
  5. Sep 24, 2026🤖 Microsoft открыла данные, на которых можно учить ИИ управлять роботом. Датасет libero-d…
  6. Sep 24, 2026Размер – не главное? У небольшой AliceAI-Foundation-80B-A3B-Base от Яндекса уже появились…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →