TGViewer
AI for Devs AI for Devs @ai_for_devs · 17.6K subscribers
Post #220 3.68K
⚡️ OpenAI выпустили GPT-5.2-Codex

Если 5.1-Codex-Max показывал максимум на SWE-Bench и SWE-Lancer, то 5.2-Codex подтверждает прогресс уже на agent-ориентированных бенчмарках:

• SWE-Bench Pro: 56.4% (против 55.6% у GPT-5.2)
• Terminal-Bench 2.0: 64.0%, уверенное лидерство в реальных CLI-задачах

Ключевое отличие — эволюция компакции. Теперь модель лучше удерживает план, корректирует стратегию после неудач и реже скатывается в повторные попытки. Это особенно заметно на больших рефакторингах и миграциях, где Codex теперь дольше работает автономно.

Вторая крупная ось апдейта — defensive cybersecurity. В отличие от 5.1-Codex-Max, GPT-5.2-Codex целенаправленно прокачан под security-workflow: анализ attack surface, воспроизведение уязвимостей, fuzzing и валидацию багов. На профессиональных CTF-оценках это уже третий подряд скачок качества для линейки Codex.

Карточка модели

@ai_for_devs
  • 👍 21
  • 🔥 6
  • ❤ 4
  • 😁 1
More from @ai_for_devs
  1. Oct 2, 2026⚡️ DeepSeek выпустили десктопный клиент: Deepseek Harness Вслед за ZCode и Kimi Code свой…
  2. Oct 1, 2026⚡️ Google представили Gemini 4 Argon По заявлениям компании, новая модель обошла флагманы…
  3. Sep 30, 2026⚡️ Anthropic опубликовали лучшую рекламу GLM Помните пост про abliterated-модели, у которы…
  4. Sep 29, 2026⚡️ DevDay 2026 подошел к концу Помимо главных новинок, также показали: • Тариф Pro Max за…
  5. Sep 29, 2026⚡️ OpenAI обновили GPT-6.1 Sol Параллельно с трансляцией всем стала доступна новая версия…
  6. Sep 29, 2026⚡️ OpenAI представили dots [DevDay 2026] Персональный агент на базе Astra, по сути OpenCla…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →