Чип спроектирован с нуля под инференс больших языковых моделей. Производит его TSMC. Разработка от дизайна до отправки финального проекта на фабрику заняла 9 месяцев — рекордный срок для сложных современных чипов, по словам компаний.
В отличие от Cerebras, которые делают один гигантский кристалл с памятью прямо на чипе (на котором GPT-5.3-Codex-Spark выдаёт больше 1000 ток/с), Jalapeño — чип обычного размера.
Нужную мощность получают не размером кристалла, а количеством чипов: тысячи Jalapeño соединяют в кластер через сетевые чипы.
Первый коммерческий запуск обещают до конца 2026 года.
Google, Amazon, Microsoft, Meta и OpenAI уходят от Nvidia к своим чипам, а Маск наоборот: у xAI уже 555 тысяч GPU, цель — миллион. Может, зря?)
@ai_for_devs
