Короче для Haiku чуда не случилось, слишком сильная конкуренция
Если брать сравнение с аналогичными по цене моделями:
Haiku 5.5
– В офисной агентной работе на уровне Sol, который в 3.5 раза дороже
– Галлюцинирует меньше всех из четырёх
– Но с тулами и SaaS почти не справляется: 35% против 60–69% у остальных
Короче, для всяких документов/экселек, извлечения данных, саммаризации, но с инструментами все плохо.
GPT-6.1 Sol
– Самая умная. При той же цене за задачу, что у Haiku, даёт 48 баллов индекса против 43
– Лучшая в коде, документах и знаниях о мире
– Отвечает за 16 секунд, а Haiku на max – почти за 6 минут(!)
Удивительно, но sol по цене-качеству оказывается лучше, чем хайку, которой выкрутили болтливость на максимум...
DeepSeek V4.1 Flash
– Лучше всех работает с тулами: 69%
– Но выдумывает почти всегда, когда не знает ответа: без галлюцинаций только 4% ответов
Gemini 3.8 Flash
– Хорошо знает мир и понимает картинки
– Но дорогая: $1.24 за задачу, в 10 раз дороже Haiku при том же индексе
Прикол, что max-режим у Haiku почти бесполезен: по сравнению с xhigh он даёт +2 балла индекса и стоит почти вдвое дороже.
Короче, кого брать:
– По умолчанию – Sol
– Агенты с кучей тулов – DeepSeek, но проверять каждый ответ
– Извлечение и сопоставление данных из контекста – Haiku на high
– Мультимодалка, разные языки – Gemini Flash
https://artificialanalysis.ai/models/claude-haiku-5-5
===
💬Это пост из ленты, которую читает Саша - автор канала Мальцев: Карьера. Маркетинг. AI. @maltsevprosto
Другие каналы по темам:
🤖 AI @maltsevdaily
🧑🎓 Карьеры @maltsevdailyc
🦹 Маркетинга @maltsevdailym
Post #117988
5
Мальцев Репостит Опа, Anthropic выкатили Haiku 5.5 Не обновляли год, у конкурентов даже уже крутые маленькие модели, для обычных агентских задач: суммаризация, классификация, сабагенты, работа в браузере. Заодно самая быстрая модель Anthropic на сегодня. Цены за 1M токенов…

