🖕 мы не нерфили Astra, вам показалось
Пишут, что Astra стала раньше сдаваться, хуже доделывать задачи и меньше думать. Одинаковые промпты якобы дают заметно более слабые результаты. В одном из тестов Astra Max отработала 4:48 вместо 9:08.
⚪️ У OpenAI compute настолько перестало хватать, что пришлось остановить новые $200 Pro-подписки.
⚪️ Astra начинает работать быстрее.
Совпадение? Уменьшили reasoning budget, ужали precision и квантанули?
Хз, мощет померещилось, но не они первые и не последние, кто так делал и будут делать.
Вспомнилось журналистское расследование про автомобильные шины. Оказалось, что те шины, которые фабрики присылают на тесты в журналы, и те же модели, которые можно купить в магазинах - это асболютно разные шины.
На тесты отправляют специально подготовленные экземпляры с улучшенным составом и характеристиками, которые делают на отдельной линии. А в магазинах продаются более жесткие и дешевые.
before/after
Что думаете?
Post #171
262