Видимо, они хотят хотя бы немного перебить хайп вокруг Gemini. Вот что в релизе действительно интересного:
1️⃣ Это первый Codex, обученный работать в Windows и, в частности, в Powershell. Теперь модель разбирается в особенностях Windows-окружения, структуре файловой системы и тд.
Также для Windows появился Agent mode, с помощью которого агент может работать в терминале автономно (доступы можно настраивать).
2️⃣ Заявляют, что модель может непрерывно самостоятельно работать над задачами более 24 часов! Невероятно, если правда (хотя Anthropic для своей Sonnet 4.5 вообще декларировали 30 часов).
«Претрейн и test-time не уперлись в стену» – написал Ноам Браун про релиз. Это он намекает, что масштабирование продолжается.
При этом благодаря новой фишке – «компакции» – Codex теперь может работать с огромными контекстами. Это как бы аналог краткосрочной и долгосрочной памяти. Когда лимит токенов контекстного окна близок, модель сжимает самую старую информацию, а затем вместе с этой выжимкой + последней актуальной информацией переходит в новое контекстное окно. Процесс может повторяться много раз.
3️⃣ Метрики. На SWE-bench Verified GPT-5.1-Codex-Max (xhigh) показывает 77.9% точности. Это лучше, чем у Gemini 3 и Claude Sonnet 4.5, то есть сота. При этом модель теперь еще больше экономит токены. На среднем уровне рассуждений она достигает результатов предыдущей версии, потребляя на 30% меньше токенов.
Уже доступно в IDE и Codex CLI, в API завезут «soon»
openai.com/index/gpt-5-1-codex-max/
