Привет! Я — Матвей Пак, шахматист, математик, основатель Metamentor — AI-стартапа для решения корпоративных задач.
В канале рассказываю про наши кейсы и мировую практику применения генеративного ИИ.
Aвтор: @bymotia
PR: @Spacely
Post #135
259
Forwarded from Шаляпин | про AI, хайтек
⚡️Сегодня сразу два больших релиза: Anthropic выпустила Claude Opus 5.5, а OpenAI — GPT-6 Sol и Luna.
Главное:
🟢Anthropic выпустила Opus, который почти дотянулся до Fable, но стал заметно дешевле и быстрее.
🟢OpenAI выпустила Sol, которая уже подбирается к топовым моделям, но стоит сильно дешевле их.
🟢То есть гонка не столько за мозги, сколько за соотношение цена/качество.
🦀Claude Opus 5.5: она заметно сильнее предыдущего Opus 5 и в большинстве задач уже примерно на уровне Fable 5.1. Писать она должна получше: яснее, короче, с главным в начале и без лишнего жаргона. В кодинге и длинных агентных задачах местами даже лучше. При этом типичная задача обходится примерно на 40% дешевле, чем на Opus 5.
Сами токены тоже подешевели: теперь $4 за миллион входных и $20 за миллион выходных. Плюс модель стала более чем на 30% быстрее.
Ещё важный момент: Opus 5.5, судя по тестам Anthropic, стала лучше именно в длинной самостоятельной работе — когда надо часами разбираться в большом проекте, мигрировать код, искать проблемы или последовательно выполнять много шагов.
Платным подписчикам заодно увеличили пятичасовые лимиты и бесплатно выдали одноразовый сброс лимита, который можно сохранить и активировать когда понадобится.
💬 А следом OpenAI выкатила GPT-6 Sol и Luna.
GPT-6 Astra всё ещё остаётся самой мощной моделью OpenAI. Sol и Luna — это попытка сделать почти фронтирное качество сильно дешевле.
Sol стоит $2/$10 за миллион входных/выходных токенов. Luna — вообще $0,10/$0,50.
При этом Sol по качеству уже подбирается к топовым Claude и Astra: в одних задачах она их обходит, в других немного уступает. Luna слабее Sol и Astra, но в ряде задач держится примерно на уровне гораздо более дорогих моделей прошлого поколения — при цене буквально в десятки раз ниже.
OpenAI ещё сильно прокачала кэширование: повторно используемый контекст теперь обходится гораздо дешевле, а изменение reasoning effort или набора инструментов больше не сбрасывает кэш. Для длинных рабочих сессий и агентов это довольно важная штука.
Главное:
🟢Anthropic выпустила Opus, который почти дотянулся до Fable, но стал заметно дешевле и быстрее.
🟢OpenAI выпустила Sol, которая уже подбирается к топовым моделям, но стоит сильно дешевле их.
🟢То есть гонка не столько за мозги, сколько за соотношение цена/качество.
🦀Claude Opus 5.5: она заметно сильнее предыдущего Opus 5 и в большинстве задач уже примерно на уровне Fable 5.1. Писать она должна получше: яснее, короче, с главным в начале и без лишнего жаргона. В кодинге и длинных агентных задачах местами даже лучше. При этом типичная задача обходится примерно на 40% дешевле, чем на Opus 5.
Сами токены тоже подешевели: теперь $4 за миллион входных и $20 за миллион выходных. Плюс модель стала более чем на 30% быстрее.
Ещё важный момент: Opus 5.5, судя по тестам Anthropic, стала лучше именно в длинной самостоятельной работе — когда надо часами разбираться в большом проекте, мигрировать код, искать проблемы или последовательно выполнять много шагов.
Платным подписчикам заодно увеличили пятичасовые лимиты и бесплатно выдали одноразовый сброс лимита, который можно сохранить и активировать когда понадобится.
💬 А следом OpenAI выкатила GPT-6 Sol и Luna.
GPT-6 Astra всё ещё остаётся самой мощной моделью OpenAI. Sol и Luna — это попытка сделать почти фронтирное качество сильно дешевле.
Sol стоит $2/$10 за миллион входных/выходных токенов. Luna — вообще $0,10/$0,50.
При этом Sol по качеству уже подбирается к топовым Claude и Astra: в одних задачах она их обходит, в других немного уступает. Luna слабее Sol и Astra, но в ряде задач держится примерно на уровне гораздо более дорогих моделей прошлого поколения — при цене буквально в десятки раз ниже.
OpenAI ещё сильно прокачала кэширование: повторно используемый контекст теперь обходится гораздо дешевле, а изменение reasoning effort или набора инструментов больше не сбрасывает кэш. Для длинных рабочих сессий и агентов это довольно важная штука.
- ❤ 8



