✴️ OpenAI разогнала GPT‑5.6 Sol до 750 токенов в секунду — это до 14× быстрее
Дождались: OpenAI официально показала Ultrafast — новый скоростной режим для GPT‑5.6 Sol на инфраструктуре Cerebras.
Важно: это не облегчённая версия и не новая модель. Интеллект остаётся тем же — радикально ускоряется сам инференс.
Что обещают:
🟡 до 750 выходных токенов в секунду;
🟡 до 14× быстрее стандартного режима Sol;
🟡 запуск сначала в OpenAI API;
🟡 те же сильные стороны Sol в коде, исследованиях и сложных агентных задачах.
Главная магия — в архитектуре Cerebras. При генерации каждого нового токена модели снова нужны её веса, и на обычных GPU скорость часто упирается не в вычисления, а в передачу данных из отдельной памяти.
В Wafer-Scale Engine вычислительные ядра и 44 ГБ быстрой SRAM-памяти находятся на одном огромном процессоре с пропускной способностью до 21 ПБ/с. Если модель не помещается на одной пластине, её слои распределяются между несколькими системами. В результате данные приходится намного меньше гонять между памятью и вычислительными блоками — отсюда и такая скорость.
И вот здесь 750 токенов/с действительно меняют правила игры. В обычном чате ответ просто появится почти мгновенно. Но для агента, который десятки раз пишет код, запускает инструменты, читает результат и исправляет ошибки, ускоряется каждый цикл. То, что раньше приходилось оставлять на ночь, потенциально превращается в интерактивную работу.
В официальном ролике OpenAI Ultrafast и Standard получают один промпт и параллельно собирают рабочий 3D‑симулятор склада. Быстрая версия уходит вперёд почти сразу и завершает задачу заметно раньше.
Но ещё эффектнее спидран Cerebras на Humanity’s Last Exam: все 2 500 вопросов Sol прошла за 11 часов 11 минут, а Claude Fable 5 — за 78 часов 27 минут. По полному времени это почти 7× быстрее.
Есть два важных нюанса.
Во-первых, «до 14×» и «до 750 токенов/с» — пиковые показатели скорости вывода, а не обещание, что любая задача целиком закончится в 14 раз быстрее. Поиск, внешние инструменты, сеть и ожидание первого токена никуда не исчезают — поэтому в реальном GDP‑Val получилось 5,6×, а не 14×.
Во-вторых, режим пока доступен только избранной группе API-клиентов. Публичного параметра для его включения, цены и сроков появления в ChatGPT или Codex OpenAI ещё не назвала. Для сравнения, обычный Sol стоит $5/$30 за миллион входных/выходных токенов — сколько попросят за Ultrafast, пока можно только гадать.
Подать заявку на доступ
🤑 ForgetMe | Boosty
💻 API нейросетей на 30-40% дешевле официалов
Приобрести подписку на любые сервисы
⏩ @forgetshop_bot
#нейросети #новости #chatgpt
Post #6283
5.2K



- ❤ 14
- 👍 8
- 🔥 4
- 👏 1