Илон Маск объяснил, зачем кластер Colossus 2 изначально получил 110 тысяч ускорителей Nvidia GB200 и зачем предусмотрено пополнение по графику на 110, 220, 330 и 440 тысяч GPU. По его словам, стартовая конфигурация и последующие шаги должны синхронизировать вычислительную мощность проекта с инфраструктурными возможностями и целями развития, а темпы ввода новых ускорителей зависят от графика работ.

Ключевым фактором ограничения становится не чистая вычислительная мощность, а число оптоволоконных кабелей, которые можно физически подключить к центральному коммутатору. Увеличение количества чипов Nvidia кратно 110 фиксирует предел по кабельной доступности — максимальное число оптоволоконных соединений, которое допускается к узлу управления, и именно он ограничивает темпы расширения кластера.

Ранее Маск сообщал, что Colossus 1 располагал 150 тысячами GPU Nvidia H100, 50 тысячами H200 и 30 тысячами GB200. У Colossus 2 другая конфигурация: здесь задействованы 110 тысяч GB200 и 440 тысяч GB300, что иллюстрирует иной подход к компоновке модулей по сравнению с первым поколением.

Строительство кластера продолжается: в текущем этапе ещё 220 тысяч ускорителей GB300 должны стартовать в полной эксплуатации на следующей неделе, а дополнительные 220 тысяч — в ноябре. По плану, если всё пойдёт по графику, к концу декабря может быть введена в эксплуатацию ещё одна партия из 220 тысяч GB300.