США, как сообщается, рассматривают ограничения на поставки в будущем трансиверов китайского производства, что может сместить следующий цикл развития ИИ-сетей в сторону американских и других локальных поставщиков.
Предполагаемые ограничения, по данным автора, могут начаться с оптики 3,2 Тбит/с, не затрагивая текущий этап развёртывания ИИ-инфраструктуры на решениях 800G и 1,6T. И это важно: основная возможность, возможно, ещё впереди.
Следующему поколению ИИ-кластеров потребуется существенно большая пропускная способность. Масштаб систем растёт: от десятков GPU — к сотням и, в конечном счёте, тысячам графических процессоров, работающих как единая машина.
Jefferies на графике показывают, насколько быстро это меняет экономику одной ИИ-стойки.
Причина проста: соединить 576 GPU гораздо сложнее, чем 72. Во время обучения и инференса каждый GPU должен постоянно обмениваться данными с остальными. Если сеть не способна передавать эти данные достаточно быстро, GPU простаивают, ожидая информацию.
В результате сеть становится частью самого компьютера.
Больше GPU означает больше коммутаторов, оптоволокна, трансиверов, лазеров и высокоскоростных оптических соединений. Оборудование, связывающее GPU между собой, становится почти столь же критичным, как и сами GPU, выполняющие вычисления.
Текущий цикл строительства ИИ-инфраструктуры сосредоточен на оптике 800G и 1,6T. Следующая фаза движется к 3,2T — именно в этом сегменте потенциальные ограничения на китайский импорт могут оказаться гораздо важнее для локальных поставщиков.
Следующим узким местом станет сетевая фабрика, позволяющая большому количеству GPU работать как единое целое.
#AI
Post #8371
773

- 👍 5
- ✍ 3
- ❤ 2