A Z.ai, laboratorio chines de IA antes conhecido como Zhipu, concluiu a construcao de um data center da classe de 1 gigawatt construido inteiramente com chips fabricados na China e comecou a opera-lo parcialmente, informou a Bloomberg. E o primeiro caso relatado de uma grande empresa de tecnologia chinesa construindo uma instalacao dessa escala exclusivamente com silicio domestico.

A escala e substancial por qualquer padrao. Um gigawatt e aproximadamente a eletricidade necessaria para abastecer 750.000 casas em um dado momento, e o hub foi projetado para treinar a familia GLM de modelos de fronteira da Z.ai. A empresa ja opera varios clusters de computacao com mais de 10.000 chips cada.

O problema mais dificil do que comprar chips domesticos e faze-los trabalhar juntos. Executar um modelo com eficiencia em aceleradores de fornecedores diferentes, como Huawei e Cambricon, exige uma camada de software que a maioria dos laboratorios recebe de graca do ecossistema da Nvidia e que os laboratorios chineses tiveram de construir por conta propria. A Z.ai atacou isso diretamente, concluindo a aquisicao da Zhongke Jiahe, uma empresa de software de infraestrutura fundada por pesquisadores da Academia Chinesa de Ciencias cuja tecnologia executa o mesmo modelo de IA com eficiencia em diferentes chips fabricados na China.

O negocio por tras da expansao cresce rapido. A Z.ai diz que espera alcancar 1 bilhao de dolares em receita anual recorrente, ja tendo atingido em julho sua meta de vendas de 2026, e seus modelos GLM estao entre os pesos abertos mais amplamente adotados do mundo.

Os controles de exportacao dos Estados Unidos foram desenhados para desacelerar o desenvolvimento chines de IA limitando o acesso ao silicio da Nvidia. A resposta que toma forma e a substituicao em escala. Os aceleradores domesticos ainda ficam atras da Nvidia chip a chip, mas um gigawatt deles, unidos por software que atravessa chips diferentes, e uma resposta de capacidade, e chega na mesma semana em que a capacidade de servir, e nao a qualidade dos modelos, se tornou o gargalo definidor da onda de modelos abertos.