TGViewer
ForgetMe | Нейросети ForgetMe | Нейросети @forgetmeai · 17.5K subscribers
Post #6283 5.2K
✴️ OpenAI разогнала GPT‑5.6 Sol до 750 токенов в секунду — это до 14× быстрее

Дождались: OpenAI официально показала Ultrafast — новый скоростной режим для GPT‑5.6 Sol на инфраструктуре Cerebras.

Важно: это не облегчённая версия и не новая модель. Интеллект остаётся тем же — радикально ускоряется сам инференс.

Что обещают:

🟡 до 750 выходных токенов в секунду;
🟡 до 14× быстрее стандартного режима Sol;
🟡 запуск сначала в OpenAI API;
🟡 те же сильные стороны Sol в коде, исследованиях и сложных агентных задачах.

Главная магия — в архитектуре Cerebras. При генерации каждого нового токена модели снова нужны её веса, и на обычных GPU скорость часто упирается не в вычисления, а в передачу данных из отдельной памяти.

В Wafer-Scale Engine вычислительные ядра и 44 ГБ быстрой SRAM-памяти находятся на одном огромном процессоре с пропускной способностью до 21 ПБ/с. Если модель не помещается на одной пластине, её слои распределяются между несколькими системами. В результате данные приходится намного меньше гонять между памятью и вычислительными блоками — отсюда и такая скорость.

И вот здесь 750 токенов/с действительно меняют правила игры. В обычном чате ответ просто появится почти мгновенно. Но для агента, который десятки раз пишет код, запускает инструменты, читает результат и исправляет ошибки, ускоряется каждый цикл. То, что раньше приходилось оставлять на ночь, потенциально превращается в интерактивную работу.

В официальном ролике OpenAI Ultrafast и Standard получают один промпт и параллельно собирают рабочий 3D‑симулятор склада. Быстрая версия уходит вперёд почти сразу и завершает задачу заметно раньше.

Но ещё эффектнее спидран Cerebras на Humanity’s Last Exam: все 2 500 вопросов Sol прошла за 11 часов 11 минут, а Claude Fable 5 — за 78 часов 27 минут. По полному времени это почти 7× быстрее.

Есть два важных нюанса.

Во-первых, «до 14×» и «до 750 токенов/с» — пиковые показатели скорости вывода, а не обещание, что любая задача целиком закончится в 14 раз быстрее. Поиск, внешние инструменты, сеть и ожидание первого токена никуда не исчезают — поэтому в реальном GDP‑Val получилось 5,6×, а не 14×.

Во-вторых, режим пока доступен только избранной группе API-клиентов. Публичного параметра для его включения, цены и сроков появления в ChatGPT или Codex OpenAI ещё не назвала. Для сравнения, обычный Sol стоит $5/$30 за миллион входных/выходных токенов — сколько попросят за Ultrafast, пока можно только гадать.

Подать заявку на доступ

🤑 ForgetMe | Boosty

💻 API нейросетей на 30-40% дешевле официалов

Приобрести подписку на любые сервисы
⏩ @forgetshop_bot

#нейросети #новости #chatgpt
  • ❤ 14
  • 👍 8
  • 🔥 4
  • 👏 1
More from @forgetmeai
  1. Sep 29, 2026✴️ OpenAI тем временем тизерят свой аналог Grok bot Покажут его сегодня на DevDay в 20:00…
  2. Sep 28, 2026✴️ Claude Sonnet 5.5 вышел: быстрее, а тариф прежний По данным Anthropic, модель генерируе…
  3. Sep 28, 2026✴️ Уже в Клод коде, анонса пока нет 🤑 ForgetMe | Boosty 💻 API нейросетей на 30-40% дешев…
  4. Sep 28, 2026✴️ Антропики сейчас активно расширяют стелс тестирование нового Sonnet 5.5 Кто не знает, о…
  5. Sep 27, 2026✴️ Уснул вайбкодером, проснулся рецедивистом. Современные реалии 🤑 ForgetMe | Boosty 💻 A…
  6. Sep 27, 2026🔥 Это ЛУЧШАЯ Локальная Нейросеть Для Изображений БЕЗ ЦЕНЗУРЫ НА ДАННЫЙ МОМЕНТ ▶️ Видео -…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →