✳️Anthropic представили Claude Opus 4.7: Модель для «длинных» агентов 👍
Anthropic обновили свою флагманскую Opus до версии 4.7. Если предыдущие апдейты были про скорость и стоимость, то этот — про выносливость и логическую дисциплину на длинных дистанциях.
Что поменялось по делу:
1⃣Цикл «Self-Correction»: Главный упор сделан на самопроверку. Модель теперь сначала верифицирует свой план на наличие логических дыр и только потом переходит к исполнению. Это значительно снижает риск того, что агент уйдёт в бесконечный цикл или «галлюциногенный» тупик.
2⃣Длинные траектории: Opus 4.7 заметно лучше держит контекст и план на многочасовых задачах. По бенчмаркам она стала стабильнее в сложных агентных пайплайнах, где нужно не просто ответить на вопрос, а выполнить последовательность из десятков действий.
3⃣Код в реальных базах: Подняли качество фиксов. Теперь модель выдает меньше бессмысленных абстракций и обёрток, фокусируясь на работающем коде, который учитывает специфику всей кодовой базы, а не только отдельного сниппета.
4⃣Работа с «грязными» данными: Улучшили точность парсинга. Модель реже додумывает факты и аккуратнее работает с неоднозначными или противоречивыми кусками текста в документах.
5⃣Отдельный апгрейд — Vision:
Зрение дотянули до возможности работы с технической документацией и юридическими актами с мелким шрифтом. Это критично для агентов, которые «смотрят» в экран или скриншоты интерфейсов — модель теперь реально считывает детали, а не гадает по очертаниям элементов.
Цены и доступность:
Прайс остался на уровне 4.6: $5 за 1M токенов на вход / $25 на выход.
Доступна везде: API, Bedrock, Vertex и Foundry.
Будет интересно посмотреть, как 4.7 покажет себя в реальном автокодинге и многошаговых аналитических сессиях. Если уже успели потестить и словить странные кейсы или, наоборот, прорывные результаты — пишите в комменты, разберем.
📎https://www.anthropic.com/news/claude-opus-4-7
Post #62
212