A T-Head, a divisão de desenvolvimento de chips da Alibaba, apresentou seu mais novo acelerador para treinamento e inferência de inteligência artificial — o Zhenwu V900. A apresentação ocorreu na conferência Apsara em Hangzhou, em 22 de setembro, de acordo com um comunicado de imprensa da Alibaba Cloud em inglês. O branding oficial do produto inclui Alibaba / T-Head / Zhenwu.
Esta análise foca no próprio chip — sua memória, interconexão e cronograma de produção, e não na arquitetura mais ampla do supernó V900 que utiliza ICN Switch, smart-NIC e controladores SSD, que foram abordados separadamente.
De acordo com os materiais da empresa, o Zhenwu V900 demonstra um desempenho aproximadamente três vezes superior ao Zhenwu M890, lançado em maio. Além disso, o novo acelerador é equipado com 216 GB de memória e oferece uma largura de banda entre chips de 1200 GB/s. O chip suporta nativamente várias precisões de dados, incluindo FP8 e FP4, permitindo seu uso tanto para treinamento de alta precisão quanto para inferência de baixa precisão.
A T-Head explica que o aumento da capacidade de memória no cristal ajuda a reduzir as sobrecargas de particionamento de modelos e movimentação de dados ao lidar com cargas de trabalho densas, enquanto um caminho de conexão mais amplo entre os chips é necessário quando múltiplos aceleradores devem funcionar como uma única máquina.
O lançamento em massa e comercial do Zhenwu V900 está previsto para o primeiro trimestre de 2027. Um relatório da TechNode, dentro da apresentação Apsara, acrescenta que o V900 é baseado na arquitetura patenteada de computação paralela da T-Head e é projetado para operar com a interconexão ICN Switch. Isso permite que mais de 1000 placas compartilhem semântica de memória nativa e endereçamento unificado.
A Alibaba também informou que a linha Zhenwu atendeu mais de 650 clientes em setores como indústria automotiva, finanças, grandes modelos de linguagem, inteligência incorporada, energia e manufatura. Esses dados de implementação são afirmações da própria empresa.
Para compradores que acompanham soluções de silício domésticas para IA, as informações chave são as seguintes: este é um acelerador Zhenwu de próxima geração com desempenho cerca de três vezes maior que o M890, 216 GB de memória, interconexão de 1200 GB/s e janela de produção no primeiro trimestre de 2027. Nenhum benchmark independente de terceiros foi apresentado na apresentação; o desempenho real do cluster dependerá da disponibilidade do silício fornecido e da pilha de software.
