OpenAI випустила GPT-5.6 (але не для нас 😅)
На бенчмарках це новий рекорд
Але є кілка але. На Terminal-Bench (тест на роботу в терміналі: планувати, ітерувати, смикати тулзи) звичайний Sol дає 88.8%, а Claude Mythos 5 (котрий ми так і не бачили) - 88.0%
Справжній стрибок до 91.9% з'являється тільки в режимі ultra, коли під капотом запускається рій сабагентів. Та сама ідея, що вже працює в Claude Code (динамічні воркфлоу), тільки зашита прямо в модель (як я зрозумів з опису).
👉 Друге але. Реліз моделі пригальмував уряд США - через кіберспроможності (опять 25)
Тому зараз модель доступна тільки вузькому колу партнерів (близько 20), погоджених з адміністрацією, і лише через API та Codex. У ChatGPT та для звичайного юзера її ще немає. Ширший доступ обіцяють за кілька тижнів.
Виходить, вперше вийшла модель, яку показали всім, а дали - одиницям
Джерело: https://openai.com/index/previewing-gpt-5-6-sol/
Youtube | Instagram
Post #175
3.21K

- 👍 12
- ❤ 7
- 👀 3
- ❤🔥 1
- 💩 1