Опа, Anthropic выкатили Haiku 5.5
Не обновляли год, у конкурентов даже уже крутые маленькие модели, для обычных агентских задач: суммаризация, классификация, сабагенты, работа в браузере. Заодно самая быстрая модель Anthropic на сегодня.
Цены за 1M токенов (промпт до 100k / больше 100k):
– вход $0.10 / $0.50 (у Haiku 4.5 было $1.00)
– выход $0.50 / $2.50 (было $5.00)
– чтение кэша $0.01 / $0.05
Короче, если до 100000 токенов работа - все ок, если больше - начинаете тратить в 5 раз большею.
В среднем выходит примерно на 75% дешевле 4.5. Это уже с учётом нового токенизатора, который расходует чуть больше токенов на задачу.
Бенчмарки (Haiku 5.5 / Haiku 4.5 / GPT-6 Luna):
– OSWorld 2.1, computer use: 72.4% / 15.7% / 48.9%
– Terminal-Bench 4.0: 39.2% / 0.0% / 16.4%
– GDPval-AA: 1620 / 735 / 1437
– HLE без инструментов: 45.9% / 10.2% / –
Для сравнения, Sonnet 5.5 набирает 83.9% на OSWorld и 70.6% на Terminal-Bench.
Прикол, что у Haiku впервые появился регулятор effort. Теперь можно выбирать между ценой и мозгами, как у старших моделей.
Что ещё завезли:
– чтение кэша у Sonnet 5.5 подешевело вдвое, до $0.10, поэтому агентские задачи выходят примерно на 20% дешевле
– подписчики Max и Team получат ежемесячные API-кредиты: $100 на Max 5x, $200 на Max 20x и до $500 на команду, ура, этого сильно не хватало.
– в Python и TS SDK появились computer use и browser use в бете
Короче, для сложного кодинга это не замена Sonnet – Anthropic сами честно пишут, что для такого лучше брать старшие модели. Но для document intelligence, классификации, разбора заявок и сабагентов $0.10 за миллион входных токенов меняет экономику. То, что раньше не сходилось по юнит-экономике, теперь сходится. Должно быть даже дешевле Luna и Gemini Flash.
https://www.anthropic.com/claude-haiku-5-5
===
💬Это пост из ленты, которую читает Саша - автор канала Мальцев: Карьера. Маркетинг. AI. @maltsevprosto
Другие каналы по темам:
🤖 AI @maltsevdaily
🧑🎓 Карьеры @maltsevdailyc
🦹 Маркетинга @maltsevdailym
Post #117908
3
