Claude Fable уделала GPT-5.6 в переписывании кода с нуля. И нет, это не опечатка
Чуваки из Epoch AI долили свежих результатов в MirrorCode — закинули туда топ-модели от Anthropic и OpenAI. Claude Fable 5 расхерачила 64% задач. GPT-5.6 Sol наскребла жалкие 20%.
Разрыв в три раза смотрится дико. На остальных тестах эти двое дышат друг другу в затылок, а где-то Sol вообще рвала всех. Официальный коммент никто не дал — ни Epoch AI, ни Anthropic. Но если поковыряться в данных лидерборда, оправдание этой порке найти реально. Читать далее
👉 Data Science | Machinelearning
Post #5797
2.37K

- ❤ 7
- 👍 1
- 👎 1