Qwen3.8 27B теперь доступна на общем тарифе Cerebras и работает примерно на скорости 1500 токенов в секунду.
Это настолько быстро, что на написание запроса ушло больше времени, чем у модели на анализ и краткое описание всей кодовой базы.:
Post #3812
26.8K
Вайб-кодинг Cerebras начнёт хостить Qwen 3.8 27B с 3 сентября. На Cerebras она, скорее всего, будет работать на скорости 2000+ токенов в секунду. Разрыв огромный. Для сравнения, ChatGPT обычно выдаёт около 50–100 токенов в секунду, а быстрый режим Codex — примерно 150–200.…