Claude Haiku 4.5 сгенерировал 13 666 токенов кода — и всё равно провалился
Новая версия Haiku, вышедшая накануне, показала худший результат в тесте на рефакторинг WebSocket-клиента. Модель переписала задачу в лоб — толстым кодом, с дублированием и переусложнением.
Рейтинг по итогам:
🥇 GPT-5 — 93.4
🥈 Sonnet 4.5 — 89.0
🥉 Gemini 2.5 Pro — 86.6
…
Haiku — 74.4 при 13 666 токенах (7-е место).
Sonnet выдал лаконичный и поддерживаемый код. А Haiku — перегруженную абстракциями простыню, где полно фич, но много ошибок.
@your_tech
Post #10247
1.67K
- ⚡ 1