Opus 5.5 vs GPT-6 Sol и Luna – в один день!
Сегодня прям дуэль. Anthropic выкатила Claude Opus 5.5, OpenAI – GPT-6 Sol и Luna, облегчённые версии Astra. И обе продают одно и то же: почти флагман, но дешевле.
Opus 5.5:
– $4 / $20 вместо $5 / $25, кэш $0.20 вместо $0.50
– Artificial Analysis Index – 58, первое место. У Astra и Fable 5.1 по 53, для топа отрыв в 5 пунктов – это прям много
– Terminal-Bench 4.0 – 66.4% против 57.9% у Astra и 55.8% у Fable 5.1
– GDPval-AA – 1846 Elo, у Astra – 1542
– обещают починить «клодовский» стиль: главное в начале, меньше воды. Посмотрим :)
GPT-6 Sol и Luna:
– Sol – $2 / $10 (ровно как Sonnet 5). Вдвое дешевле GPT-5.6, контекст 1.05M. Luna – $0.10 / $0.50. Вообще какое-то копье, дешевле многих китайцев теперь.
– AA Index: Sol – 48, Luna – 37. Старый GPT-5.6 Sol – 47
– DeepSWE: Sol – 68.8% за $2.74 на задачу, Luna – 66.6% за $0.22. Разница 2 пункта, а цена в 12 раз ниже
– AutomationBench: Sol – 33.2% за $0.27 на задачу. Для сравнения Opus 5.5 – 40%, Astra – 41.4% за $1.73
У Anthropic есть подвох: токен подешевел на 20%, а думать модель стала больше. На индексе AA – 119K токенов на задачу против 73K у Opus 5 и 31K у Sol. CodeRabbit на код-ревью намерил +40–60% токенов. И thinking теперь вообще не выключается.
Честно сравнить сложно – каждый показывает свои бенчмарки, OSWorld у них вообще разный. На общем стенде AA Opus 5.5 на medium против Sol на max: кодинг 52.5% vs 43.9%, документы +159 Elo у Opus, бизнес-процессы вничью. Задача – $1.34 против $1.06.
Короче, Opus 5.5 сейчас самая умная модель, и в 2.5 раза дешевле Fable – кодинг и документы теперь туда. Luna – вот это прям новость для всех, кто гоняет классификацию и извлечение на потоке: в 10 раз дешевле Haiku. А Sol – такой середнячок по цене Sonnet, гонять для массовых задач. Ну и Sonnet 5.5, говорят, через пару недель.
https://www.anthropic.com/claude-opus-5-5
https://openai.com/index/introducing-gpt-6-sol-and-luna/
Post #16735
3.09K
