🤖⚡️ «Ультрафаст»: OpenAI ускорила GPT-5.6 Sol до 750 токенов в секунду
OpenAI 13 августа представила новый скоростной режим «Ультрафаст» для GPT-5.6 Sol. Он предназначен прежде всего для программирования, анализа больших объёмов информации и работы ИИ-агентов, которым необходимо многократно обращаться к модели в ходе одной задачи.
📌 Главная особенность – скорость формирования ответа до 750 токенов в секунду, что до 14 раз выше стандартного режима GPT-5.6 Sol. При этом отдельная облегчённая модель не используется – ускоряется работа самой Sol.
Для этого OpenAI задействовала вычислительные системы американской компании «Серебрас». Их особенность заключается в размещении вычислительных блоков и очень быстрой памяти на одном крупном процессоре. Благодаря этому при работе модели значительно сокращается время, необходимое для постоянного обмена данными между памятью и вычислителями.
Наиболее заметный эффект ожидается при работе ИИ-агентов. Такой агент не просто формирует один ответ, а последовательно изучает файлы, пишет программный код, запускает его, проверяет результат и при обнаружении ошибки повторяет работу. Поэтому сокращение времени каждого обращения к модели ускоряет выполнение всей задачи.
В испытаниях на практических заданиях GDP-Val режим «Ультрафаст» сократил полное время работы в среднем в 5,6 раза. Максимальные 14 раз получить невозможно во всех случаях, поскольку запуск программ, поиск информации и работа с внешними инструментами происходят отдельно от самой модели.
В другом испытании GPT-5.6 Sol обработала 2500 заданий Humanity’s Last Exam за 11 ч 11 мин. Для сравнения, Claude Fable 5 потребовалось 78 ч 27 мин. Эти результаты опубликованы самой «Серебрас».
🔺 Разработка является частью крупного проекта OpenAI и «Серебрас». В январе компании договорились о создании для OpenAI вычислительной инфраструктуры мощностью 750 МВт, которую планируется вводить поэтапно до 2028 года.
Таким образом, «Ультрафаст» предназначен не только для более быстрого появления текста на экране. Основной выигрыш достигается при длительной работе ИИ-агентов, когда модель за одну задачу десятки раз анализирует информацию, использует программные инструменты и проверяет собственный результат.
Справочно. «Ультрафаст» – до 750 выходных токенов в секунду, ускорение – до 14 раз. На начальном этапе режим доступен ограниченному числу пользователей OpenAI API. Стоимость и сроки его появления в ChatGPT пока не объявлены.
Post #1506
60

- 👍 1