De acordo com conhecidos membros da indústria de IA@iruletheworldmo no XFoi revelado que o DeepSeek, depois de conquistar o mundo da IA com seu modelo R1, agora está se preparando para lançar um novo modelo DeepSeek R2 com desempenho supostamente aprimorado. Alimentado por um cluster de chips Huawei Ascend 910B, potencialmente Huawei Atlas 900, e a estrutura de treinamento distribuída interna da DeepSeek, o R2 aumenta a utilização desses aceleradores para impressionantes 82%, equivalente ao desempenho do FP16 de 512 PetaFLOPS – metade do poder de computação dos exaFLOPs.
De acordo com o Huawei Labs, isso representa cerca de 91% do desempenho fornecido pelos clusters A100 mais antigos da NVIDIA, mas a DeepSeek afirma que reduz os custos de treinamento da unidade em 97,3%.
Por trás do DeepSeek R2 está um ecossistema de parceiros cuidadosamente cultivado. A Tuowei Information é o principal fabricante OEM da série Shengteng, atendendo mais da metade dos pedidos de hardware de supercomputação da DeepSeek, enquanto a Sugon fornece racks de servidores refrigerados a líquido com potência de até 40kW cada. Para controlar o consumo de energia,Transceptor fotônico de silício da InnoLight TechnologyEm comparação com soluções tradicionais, o consumo de energia pode ser reduzido em mais 35%.
Do ponto de vista geográfico, as operações estão distribuídas em vários centros importantes: a Runjian Co., Ltd. opera o Centro de Supercomputação do Sul da China, com um valor de contrato anual de mais de 5 mil milhões de yuan, e a Zhongbei Communications retém 1.500 PetaFLOP de capacidade de computação de backup na região noroeste para fazer face aos picos de procura.
Em termos de software, o DeepSeek R2 já suporta implantação privada e ajuste fino, fornecendo suporte para planos de cidades inteligentes em 15 províncias através da plataforma Yunsai Zhilian. O nó do Norte da China, supervisionado pela InBev Digital, uma subsidiária da Hongbo Co., Ltd., aumentará seu poder computacional em mais 3.000 PetaFLOPs.
Se o poder computacional for insuficiente, a Huawei está se preparando para implantar seu sistema CloudMatrix 384, que se posiciona como uma alternativa doméstica ao NVL72 de 200 GB da NVIDIA. Equipado com 384 aceleradores Ascend 910C, ele pode atingir 1,7x o petaFLOPS geral do cluster NVL72 e 3,6x a capacidade total do HBM - no entanto, seu desempenho de chip único fica significativamente atrasado e consome quase quatro vezes a energia do cluster NVL72.
