Этот пост чисто новостной и почти полностью написан Claude (извините! не было сил писать самому, но хотелось этим поделиться). А теперь добавлю несколько вещей от себя. Пишу про них не впервые, но раз опубликовали такое исследование, то упомянуть надо
1) Если считать по токенам, то разница между Sol и Opus не в 5 раз, а в 2,5. Просто Sol в 2 раза дешевле по API
2) При этом Sol заметно эффективнее по токенам, чем Opus. В итоге на всех подписках Sol даёт примерно такие же лимиты, как Opus, а может и побольше, как раз за счёт эффективности токенов
3) Astra по сравнению с Fable на подписках даёт больше лимитов и по $, и по токенам, и при этом ещё и эффективнее по токенам, поэтому по лимитам выходит раза в 4 больше. Но Fable тратит только 50% недельника, остаток ещё остаётся на Opus, это тоже надо учитывать
4) Напоминаю, что GPT 6.1 Sol до сих пор работает как черепаха (20–25 TPS), хотя OpenAI 18 часов назад обещали ускорение до 50 «в течение 2 часов». Чёт напиздели они, не опять, а снова. Opus на протяжении последних двух недель стабильно работает на 100–120 TPS
5) Ну и напомню, что Opus, как по мне, всё-таки приятнее в роли основной рабочей лошадки под все задачи, хотя Sol тоже неплох
Сейчас я плачу за Claude Max 20x, Claude Max 5x и ChatGPT Plus. Sol использую для ревью, и для этого лимитов Plus хватает с головой. И вообще я думаю, что сейчас лучшее время держать сразу две подписки, и на ChatGPT, и на Claude. Конкуренция между ними очень активная, и то одни, то другие дают какие-то бонусы. Причём необязательно брать самые дорогие, можно и по $20. Это круто, что сейчас за 20 баксов (ChatGPT Plus или Claude Pro) можно пользоваться лучшими моделями рынка с классными лимитами!
Исследование SemiAnalysis ещё было полезно, чтобы понять, почему Anthropic могут давать такие большие лимиты по $ (обычный юзер не приносит им убыток и тратит всего 20% лимита, а не 100%, как мы все тут), и какие маленькие лимиты дают китайцы
А OpenAI такие лимиты по долларам скорее всего дать не могут, потому что ChatGPT пользуются раз в 20 больше людей, чем Claude, и свободного компьюта у них сейчас меньше. Вот они и пытаются оптимизировать эффективность токенов и снизить цену на модели по API, а ещё замедляют модели на подписках
Post #1409
1.72K
sh | ИИ SemiAnalysis опубликовали большой разбор лимитов ИИ-подписок. Они отправляли через каждую подписку одинаковые запросы и смотрели, на сколько процентов вырос счётчик лимита. Так они посчитали, сколько токенов на самом деле влезает в каждую подписку и сколько…
- 👍 21
- ❤ 8
- 😁 5