TGViewer
Гостев из будущего Гостев из будущего @gostev_future · 1.41K subscribers
Post #391 747
OpenAI заявила, что GPT-5.6 Sol запускается на чипах Cerebras со скоростью до 750 токенов в секунду.

Для понимания масштаба: современные флагманские LLM в реальном использовании обычно выдают десятки токенов в секунду. 750 токенов/с для общей модели — это прорыв на новый уровень.

Cerebras много лет пытается обойти NVIDIA другой архитектурой. У них wafer-scale chip — огромный чип почти размером с кремниевую пластину. Идея простая: не гонять данные туда-сюда между кучей отдельных ускорителей, а держать вычисления, память и пропускную способность максимально близко друг к другу. Меньше возни с передачей данных — меньше задержка — быстрее инференс.

До сих пор такие истории часто упирались в привычное «ну да, быстро, но на чем именно?». На маленькой модели? На специально удобном сценарии?

А тут OpenAI говорит не о какой-то игрушечной модели, а о Sol — верхнем уровне новой линейки.

Cerebras впервые выглядит не как красивая инженерная экзотика, а как реальная альтернатива GPU-инференсу для frontier моделей.

Пользователю, конечно, не станет дешевле. Цена Sol заявлена как $5 за миллион входных токенов и $30 за миллион выходных. Скорость сама по себе счет не уменьшает. Миллион токенов остается миллионом токенов — хоть вы сожгли его за минуту, хоть за десять секунд.

Но суть тут в другом: скорость и пропускная способность.

Для обычного чата это приятно, но не революция. Человек все равно не читает со скоростью 750 токенов в секунду. Зато для агентов это уже серьезно.

Агент не делает один большой запрос. Он работает циклами: подумал, вызвал инструмент, проверил результат, изменил план, снова подумал. Один вопрос пользователя легко превращается в десятки внутренних обращений к модели. В расследовании инцидента это логи, гипотезы, индикаторы, таймлайн, ложные версии и выводы.

Так что важно не то, что ChatGPT будет быстрее печатать текст. А что агент сможет выполнить больше внутренней работы до того, как человек вообще заметит задержку.

@gostev_future
  • 🔥 6
  • 👍 2
More from @gostev_future
  1. Sep 23, 2026На прошлой неделе обнаружилась биолаборатория Anthropic, на этой неделе у лаборатории уже…
  2. Sep 22, 2026Помните исследование о том, как ИИ играет в Civilization? А вот мой однофамилец Питер Гост…
  3. Sep 20, 2026Я уже писал о недавнем аресте австралийца Рубена Томсона из TeamPCP, который, при всех сво…
  4. Sep 20, 2026У президента с высочайшим IQ есть любимое занятие — что-нибудь переименовать. Мексиканский…
  5. Sep 19, 2026Сегодня в России проходят выборы, и в этой связи для цикла «Гостев из прошлого» у меня тож…
  6. Sep 18, 2026На этой неделе много обсуждали, как руководители крупнейших американских ИИ-лабораторий вд…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →