TGViewer
Vibe Coding: OpenCode, Claude Code, Codex, Cursor, Kilo Vibe Coding: OpenCode, Claude Code, Codex, Cursor, Kilo @prog_ai · 4.49K subscribers
Post #1982 672
GPT-6 Astra на более высоких уровнях effort тратит меньше денег и получает более высокие результаты

Это прямо зафиксировал ARC Prize в контролируемом тесте.

Более высокий effort тратит больше вычислений на один ход, но Astra быстрее понимает задачу → делает меньше действий → меньше раз вызывается модель → меньше раз прогоняется огромный контекст → итоговый расход на задачу оказывается ниже.

Особенно хорошо заметно на standart harness, чтобы это ни значило.

Это особенно важно для Codex. Там цена задачи — не просто reasoning tokens. Если агент сделал 120 циклов посмотрел → подумал → вызвал tool → получил результат → снова подумал, каждый новый цикл может снова тащить через модель десятки/сотни тысяч токенов контекста.

В X сейчас обсуждают измерение, где Medium сделал 122 model responses, а xHigh — 65, то есть примерно вдвое меньше обращений к модели. Пользователь Pro 20x сообщал, что xHigh проработал около часа и снял всего 1–2% weekly allowance. Это пока пользовательское измерение, не официальный тест OpenAI, но механизм полностью согласуется с результатами ARC Prize.

Более того, сейчас нашел еще один очень показательный разбор Codex. Пользователь посмотрел локальную telemetry Astra и обнаружил, что Astra-parent 47 раз вызывала wait_agent каждые 30 секунд. Эти практически пустые проверки прогнали 7.13 млн input tokens, то есть 68% всего input родительской Astra. За 33 минуты 5-часовой лимит упал с 53% до 100%.

При этом OpenAI пока не говорит, что xHigh универсально дешевле. В официальной справке рекомендация по-прежнему обратная: Low — для экономии, Medium — баланс, High+ «может использовать больше allowance». Но там есть крайне важная оговорка: reasoning level не задает фиксированный расход для задачи.

И сам Tibo 6 сентября советовал переходящим с Sol High начинать с Astra Low/Medium. Но практически одновременно команда OpenAI выкатила оптимизации Astra для тяжелых пользователей, которые, по словам Tibo, могут давать до 3–4× меньшего списания subscription usage на длинных сессиях. То есть механизм учета/поведение harness явно еще активно меняются.

https://arcprize.org/blog/astra
  • 👍 3
  • 👏 1
More from @prog_ai
  1. Sep 25, 2026⁉️ Устал искать интересные каналы с новостями мира AI и IT? 📁 ПАПКА С КАНАЛАМИ В этой пап…
  2. Sep 25, 2026Ребята, ребята, а почему в 2026 году мы все еще измеряем производительность ИИ в цене гене…
  3. Sep 25, 2026В сети пошли слухи, что OpenAI делают подписку за $500 Почему именно за $500? Да от балды…
  4. Sep 25, 2026Давайте лучше обсудим за категорию < $0.6 В этой микрокатегории только: • qwen3.8-flash-ne…
  5. Sep 25, 2026Opus 5.5 на arena.ai набрал фантастические 1818 elo — новый мировой рекорд! Поздравляем Да…
  6. Sep 25, 2026photo post
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →