Anthropic бахнули Claude Haiku 5.5
Новая младшая модель Claude 5.5 - самая быстрая и дешёвая модель Anthropic на стандартной скорости.
Основная ставка - массовые дешёвые задачи: суммаризация, классификация, extraction, routing, поддержка, voice agents, browser/computer use и работа субагентом для более крупных моделей.
Цены сильно зависят от размера промпта:
до 100K токенов - $0.10 input / $0.50 output за 1M токенов
свыше 100K - $0.50 / $2.50
Для сравнения, Haiku 4.5 стоила $1 / $5. То есть короткие запросы подешевели на 90%, длинные - на 50%. С учётом реального распределения запросов и изменения tokenizer Anthropic оценивает среднее снижение стоимости работы примерно в 75%.
Контекст - 1M токенов, максимальный output - 128K. При этом новый tokenizer считает тот же текст примерно на 30% длиннее, чем Haiku 4.5.
Haiku 5.5 стала первой Haiku с adaptive thinking и регулируемым effort - можно менять баланс между качеством, скоростью и стоимостью.
По собственным тестам Anthropic скачок относительно Haiku 4.5 особенно большой в агентных задачах:
OSWorld 2.1 - 72.4% против 15.7%
Terminal-Bench 4.0 - 39.2% против 0%
GDPval-AA v2.1 - 1620 против 735
FrontierCode 1.1 - 46.4%
При этом Sonnet 5.5 всё ещё значительно сильнее на сложных агентных задачах. Haiku предназначена скорее для большого количества быстрых и хорошо определённых операций.
Модель уже доступна в Claude, Claude API, AWS, Google Cloud и Microsoft Foundry.
API ID: claude-haiku-5-5
Заодно Anthropic вдвое снизила цену cache reads для Sonnet 5.5 - с $0.20 до $0.10 за 1M токенов. По оценке компании, это снижает стоимость типичной агентной работы на Sonnet примерно на 20%.
https://www.anthropic.com/claude/haiku
https://www.anthropic.com/claude-haiku-5-5
https://platform.claude.com/docs/en/models/haiku-5-5/overview
https://platform.claude.com/docs/en/about-claude/pricing
@cgevent
Post #16869
2.84K
- ❤ 15
- 🔥 7
- 😱 7