🚀 Claude Opus 4.7 рвёт все бенчмарки!
Что нового:
• +13% на внутреннем 93-task coding-бенчмарке (решает задачи, которые не брали Opus 4.6 и Sonnet)
• SWE-bench Pro и Rakuten-SWE-Bench — огромный прирост в code quality и test quality
• Лучшая мультимодальность: видит изображения в 3+ раза выше разрешении (до 2576px)
• Идеально для long-running agentic задач, само-верификации и сложных рефакторингов
• Цена та же: $5/$25 per M tokens. Доступен в API, Claude Code, Bedrock, Vertex
Разработчики уже называют его "реальным coworker", который меньше галлюцинирует и лучше следует инструкциям.
Официальный релиз Anthropic
Кто уже перешёл на 4.7 в своих агентах — делитесь результатами и промптами 👇
#Claude #AICoding #SWEbench #AIagents
Post #416
61

- ❤ 4
- 💩 1