А теперь про мозги AstraТут в чем фишка, главные возгласы про революцию, как я думаю, вызваны ровно двумя обманчивыми факторами.
1. ГПТ стал еще более человечным, эта тенденция явно наблюдается с версии 5.5 и у нее есть один неприятный факт, это все еще не Opus 4.6, вот так-то.
Я имею ввиду, что ГПТ изначально пошел по пути тупой прямой палки. Он делает буквально то, что сказано. А почти все вайбкодеры и энтузиасты промптят с таким высоким уровнем абстракции, что для чата гопоты их запрос буквально "сделай хуйню".
Отсюда и мнение, что клод во всем лучше. Просто для философии работы OpenAI предполагает, что вы мастер формальной логики, а не эмоциональный пубертатный билдер, который орет "ну ебани по красоте".
Но справедливо, для продукта такая себе отговорка. Вот они и работают над тем, чтобы их нейронка с полу-слова вас понимала. Чем когда-то всех и покорил клод.
И общаться в том же Hermes моделька стала еще лучше. Воды нет, бесконечных списков тоже. С этой точки зрения стало действительно лучше.
2. Ведь 5.6 был в усмерть урезан, помните?Если так подумать, то ГПТ не освоил новые грани возможностей, его планка работы не выросла. То есть он как раньше закрывал задачи, так и сейчас.
90% тех задач, что для вас отлично закрывала прошлая версия, текущая тоже будет так же закрывать. Ничего не поменялось.
Он не стал достаточно человечным, чтобы без множества прямых уточнений сразу нормально работать с 3D, которое ему прокачали.
Этот фокус ранее провели Антропики. У вас была провальная 4.7 версия, а до нее урезанная в хлам легендарная 4.6 и когда на их фоне выходит просто ровно работающая 4.8 — выглядит как новый скачок.
Вот это история про Астру. Просто стало получше. Все.
И они взяли собрали отдельный харнесс заточенный под тест, что дает прирост свыше 40% к эффективности (хозяйке на заметку) и выдают это как буст модели.
Но это буквально буст отдельного харнесса. Так еще и тест определяет работу в замкнутых игровых средах. И к общему людскому интеллекту имеет отношение уровня моего члена и рта Альтмана.
Как вы понимаете — Альтман мне не сосал. А сосал ли я ему, вы разумеете, вольны спросить в комментах. Но я оставлю его без ответа.
Жор токенов и другие конские залупыПожалуй, всегда самая интересная часть обзоров на новые модели. Че там вообще по токенам то, нормально или выжирает все лимиты?
Честно говоря, по чатикам увидел общие отзывы, что стало кушать побольше. То есть на Ultra не юзабельно. Но я что так, что так — живу на Xhigh, мне норм.
Тем более мне за 2 дня задержки выкатки для меня Астры, отдали обещанные ручные сбросы, так я еще перед релизом обновился до подписки на 200 баксов.
На сотке в прошлой я проблем с лимитами, честно, не замечал.
Проблема многих в том, что они из коробки юзают нейронку в максы, а потом удивляются, что она сделала 5 лишних агентов и за 40 минут потратила 30% лимита.
Я вот как
создал 3 месяца назад системные инструкции, так собственно ими и пользуюсь.
Еще Reza брадочек жаловался на удивительные лупы. А я на выходных прямо во время занятий с учениками у Кипа, столкнулся с такой залупой, что у нас у всех Астра отваливалась.
Либо делала простые таски по 30-50 минут на Normal мышлении, что просто Crazy. Полная хуйня.
В комментах увидел от моих смартиков билдеров, что на их как раз больших задачах лупы и огромный жор токенов.
Да, я знаю, что ГПТ долгий, но там явно у него обратный клин пошел и он из коробки слишком много думает, тестирует и проверяет. Это не было исправлено в новом релизе.
Движение 5.5 -> 5.6 было великимМоделька сол научилась сама решать множество задач, это перестало быть просто крутым и главным аудитором кода.
И я весь свой стэк перевел на гопоту, построив все вокруг продуктовой линейки сэра Pidoras Альтмана. И был тем доволен.
Но релиз Astra это скорее большая пиар акция и приятное улучшение прошлой модели, нежели реально чет новое.
Это ни плохо и ни хорошо, это нормально и вполне себе приятно. Но если так подумать, если реально будут проблемы с жором токенов на всех задачах — шило на мыло. Сол был лучше.
SOL MAXI. AVE SOL.
Такие вот дела.