TGViewer
sh | ИИ sh | ИИ @shneural · 3.39K subscribers
Post #1419 1.37K
Пару слов про Sonnet 5.5 и Haiku 5.5

Sonnet 5.5 вышел уже полторы недели назад, а я про него так ничего и не написал. Просто не нашёл, куда его деть 🙂‍↕️

С Opus 5.5 многие уже привыкли к новому уровню интеллекта. У меня сейчас 99% задач это буквально промпты в стиле «скрин + пофикси» или вообще «отрефактори всё красиво и чтоб работало!!» (lol). И с каждым релизом новой умной модели требования к юзеру всё ниже и ниже. Год назад, чтобы получить нормальный результат, приходилось многое делать руками, писать развёрнутый промпт и следить за агентом. А сейчас просто надиктовываешь за 30 секунд, что хочешь, и всё

Так вот, Sonnet 5.5 после Opus ощущается несомненно более глупой моделью. Ему так уже не скажешь, нужны запросы подробнее. По цене он в 2 раза дешевле, но токенов тратит больше, так что реальная экономия выходит где-то в полтора раза. И после такого комфорта на Opus уходить ради этого на модель послабее, где к тебе снова больше требований, я не захотел

Ещё заметил у всех моделей 5.5 одну тенденцию. Бюджет размышлений на Max, похоже, выкрутили на запредельные значения, скорее всего ради бенчмарков. Модели ведь везде сравнивают именно на нём, а компаниям хочется красивых циферок в релизных табличках. Но в реальной работе Sonnet и Haiku на Max думают так долго и тратят столько токенов, что Sonnet часто выходит даже дороже Opus, который сделает то же самое быстрее и лучше. Так что их стоит использовать максимум на High

Как субагентов я пробовал и Sonnet, и Haiku, но на подписке чёт не особо вижу смысла их сравнивать. Вчера сидел с Explore агентами на Haiku 5.5, до этого на Opus 5.5, и сравнил 50 сессий. По цене Haiku обходился в среднем дешевле аж в 50 раз, да, но это разница между $0.02 и $1, а на подписке что то, что это — копейки. $1 даже на Pro за $20 это 0.1% месячного лимита. С задачей Haiku в целом справлялся, но основной агент на Opus после него сам перечитывал код в 25% случаев. Когда субагентом был Opus, основной агент делал это всего в 5% случаев. То есть тому, что нашёл Haiku, основной агент верит меньше. Короче, экономия на спичках непонятно ради чего

Но сами по себе модельки так-то не бессмысленные, я просто не нашёл им применения в агентной работе. Например, Haiku за свои $0.1/0.5 может быть отличной ультрабюджетной моделькой для общения и простых неагентных запросов, и конкурентов я ей тут не вижу. У DeepSeek V4.1 Flash сумасшедший уровень галлюцинаций, Gemini стоит сильно дороже, а 6 Luna очень паршива в общении

В общем, я пока везде остаюсь на Opus, и в основном агенте, и в субагентах. Но если вы нашли, где Sonnet или Haiku реально полезны в агентной работе, поделитесь в комментах, будет интересно!
  • 👍 27
  • ❤ 7
More from @shneural
  1. Oct 8, 2026Что там у наших друзей из OpenAI? — Вчера всем в обычном чате (ChatGPT) начали раскатывать…
  2. Oct 8, 2026Похоже, Gemini 4 Argon выходит в публичный доступ уже сегодня! Об этом написали сразу неск…
  3. Oct 7, 2026Anthropic уже начала раздавать подписчикам Max бесплатный API-баланс — $100 или $200 в мес…
  4. Oct 7, 2026Ещё из интересного: — Haiku 5.5 выдаёт ~210 TPS в Claude Code — Важно знать, что после 100…
  5. Oct 7, 2026Haiku 5.5 уже тут! Вышла Claude Haiku 5.5, самая быстрая и дешёвая модель Anthropic Цена у…
  6. Oct 6, 2026Post #1413
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →