Z.ai, le laboratoire d'IA chinois anciennement connu sous le nom de Zhipu, a achevé la construction d'un centre de données de classe 1 gigawatt bâti entièrement sur des puces de fabrication chinoise et a commencé à l'exploiter partiellement, a rapporté Bloomberg. C'est le premier cas rapporté d'un géant technologique chinois construisant une installation de cette échelle exclusivement sur du silicium domestique.

L'échelle est substantielle à tous les égards. Un gigawatt correspond à peu près à l'électricité nécessaire pour alimenter 750 000 foyers à un instant donné, et le site est conçu pour entraîner la famille GLM de modèles de frontière de Z.ai. L'entreprise exploite déjà plusieurs grappes de calcul comptant chacune plus de 10 000 puces.

Le problème plus difficile que d'acheter des puces domestiques est de les faire travailler ensemble. Faire tourner un modèle efficacement sur des accélérateurs de fournisseurs différents, comme Huawei et Cambricon, exige une couche logicielle que la plupart des laboratoires obtiennent gratuitement de l'écosystème de Nvidia et que les laboratoires chinois ont dû bâtir eux-mêmes. Z.ai s'y est attaqué directement en finalisant l'acquisition de Zhongke Jiahe, une entreprise de logiciels d'infrastructure fondée par des chercheurs de l'Académie chinoise des sciences, dont la technologie fait tourner le même modèle d'IA efficacement sur différentes puces de fabrication chinoise.

L'activité derrière cette expansion croît rapidement. Z.ai dit s'attendre à atteindre 1 milliard de dollars de revenus annuels récurrents, ayant déjà atteint en juillet son objectif de ventes pour 2026, et ses modèles GLM figurent parmi les poids ouverts les plus largement adoptés au monde.

Les contrôles américains à l'exportation ont été conçus pour ralentir le développement de l'IA chinoise en limitant l'accès au silicium de Nvidia. La réponse qui prend forme est la substitution à grande échelle. Les accélérateurs domestiques restent derrière Nvidia puce pour puce, mais un gigawatt de ces puces, reliées par un logiciel inter-puces, constitue une réponse de capacité, et elle arrive la semaine même où la capacité de service, et non la qualité des modèles, est devenue le goulot d'étranglement déterminant de la vague des modèles ouverts.