Z.ai, le laboratoire d'IA chinois anciennement connu sous le nom de Zhipu, a acheve la construction d'un centre de donnees de classe 1 gigawatt bati entierement sur des puces de fabrication chinoise et a commence a l'exploiter partiellement, a rapporte Bloomberg. C'est le premier cas rapporte d'un geant technologique chinois construisant une installation de cette echelle exclusivement sur du silicium domestique.

L'echelle est substantielle a tous les egards. Un gigawatt correspond a peu pres a l'electricite necessaire pour alimenter 750 000 foyers a un instant donne, et le site est concu pour entrainer la famille GLM de modeles de frontiere de Z.ai. L'entreprise exploite deja plusieurs grappes de calcul comptant chacune plus de 10 000 puces.

Le probleme plus difficile que d'acheter des puces domestiques est de les faire travailler ensemble. Faire tourner un modele efficacement sur des accelerateurs de fournisseurs differents, comme Huawei et Cambricon, exige une couche logicielle que la plupart des laboratoires obtiennent gratuitement de l'ecosysteme de Nvidia et que les laboratoires chinois ont du batir eux-memes. Z.ai s'y est attaque directement en finalisant l'acquisition de Zhongke Jiahe, une entreprise de logiciels d'infrastructure fondee par des chercheurs de l'Academie chinoise des sciences, dont la technologie fait tourner le meme modele d'IA efficacement sur differentes puces de fabrication chinoise.

L'activite derriere cette expansion croit rapidement. Z.ai dit s'attendre a atteindre 1 milliard de dollars de revenus annuels recurrents, ayant deja atteint en juillet son objectif de ventes pour 2026, et ses modeles GLM figurent parmi les poids ouverts les plus largement adoptes au monde.

Les controles americains a l'exportation ont ete concus pour ralentir le developpement de l'IA chinoise en limitant l'acces au silicium de Nvidia. La reponse qui prend forme est la substitution a grande echelle. Les accelerateurs domestiques restent derriere Nvidia puce pour puce, mais un gigawatt de ces puces, reliees par un logiciel inter-puces, constitue une reponse de capacite, et elle arrive la semaine meme ou la capacite de service, et non la qualite des modeles, est devenue le goulot d'etranglement determinant de la vague des modeles ouverts.