TGViewer
ИИволюция 👾 ИИволюция 👾 @ai_volution · 11.8K subscribers
Post #1724 3.83K
Sonnet 4.6

Недели 2 назад ходили слухи о скором выходе Sonnet 5, но пока нам выкатили Sonnet 4.6. Скорее всего не было потребности выпускать Sonnet 5 раньше обновлений конкурентов и просто придерживают монстра в клетке.

Полный апгрейд по кодингу, computer use, работе с длинным контекстом, агентному планированию и дизайн задач. Сразу стал дефолтом в Free и Pro тарифах.

Бенчмарки:

На 11 из 16 видах тестов Sonnet 4.6 обходит даже старый Opus 4.5.

– ARC-AGI-2 (нестандартные задачи): 58.3% против 13.6% у Sonnet 4.5 и 37.6% у Opus 4.5
– BrowseComp (агентный поиск): 74.7% против 43.9% у Sonnet 4.5 и 67.8% у Opus 4.5
– Office tasks GDPval-AA: 1633 против 1276 у Sonnet 4.5 и 1416 у Opus 4.5.
– Finance Agent: 63.3% против 54.5% у Sonnet 4.5 и 58.8% у Opus 4.5.
– Computer use OSWorld: 72.5% против 61.4% у Sonnet 4.5 и 66.3% у Opus 4.5.
– Terminal-Bench 2.0 (агентный кодинг в терминале): 59.1% против 51.0% у Sonnet 4.5. Opus 4.5 чуть выше - 59.8%
– SWE-bench Verified (реальные задачи на GitHub): 79.6% против 77.2% у Sonnet 4.5. Opus 4.5 - 80.9%

Цена $3/$15 за млн токенов, т.е. осталась без изменений, какая была у Sonnet 4.5. Доступен на всех планах Claude, в Claude Code, API и облачных платформах. Free тир обновили до Sonnet 4.6 по умолчанию.

Доступен контекст 1M токенов (бета), но только при оплате по токенам через API и в СС включении трат за токены (в подписке недоступен).

Как пишут Антропики, Sonnet 4.6 подходит для большинства повседневных задач: фронтенд, многошаговые задачи, работа с документами и финансовым анализом. Рекомендуют попробовать Sonnet 4.6 с разными уровнями thinking, чтобы найти баланс скорости и качества под свои задачи. Opus 4.6 оставить для рефакторинга больших кодовых баз, координации нескольких агентов и задач, где цена ошибки высока.

Я до этого вообще всё делал с Opus 4.6, но кажется простые задачи теперь надо делегировать на Соннет 4.6 и оркестрировать теперь эти модели. Не люблю это, всегда забывается про выбор модели перед запуском конкретной задачи, и скорее всего так и буду сидеть на опусе 4.6

Подробнее в блоге Антропик: https://www.anthropic.com/news/claude-sonnet-4-6
  • ❤ 13
  • 👍 6
  • 🔥 2
More from @ai_volution
  1. Sep 28, 2026Claude Code больше не бросает задачу на полуслове при достижении 5-часового лимита, он доб…
  2. Sep 27, 2026Opus 5.5 разучился ставить длинное тире, ну почти На Арене сравнили, как пишут тексты Opus…
  3. Sep 27, 2026OpenAI готовит always-on агента и тариф за $500 Уже в этот вторник, 29 сентября, у OpenAI…
  4. Sep 25, 2026ИИ-агенту мало дать доступ к корпоративным сервисам Подключить LLM к CRM, почте и базе док…
  5. Sep 23, 2026И тут же OpenAI накрывает козырями, выпускает GPT-6 Sol и Luna https://openai.com/index/in…
  6. Sep 23, 2026Итак, новый Opus-5.5, сводка: – Уровень, сопоставимый с Fable 5.1 и Astra. Превосходит обе…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →