Resumo:
A Nvidia planeja investir na d‑Matrix, segundo três pessoas com conhecimento do negócio. Esta empresa com 7 anos concentra-se na pesquisa e desenvolvimento de chips de servidores para inteligência artificial e seu objetivo de produto é competir com a Nvidia. Este investimento proposto é uma iniciativa da Nvidia para promover a compatibilidade de sua própria tecnologia com designers de chips concorrentes e trazer concorrentes para seu ecossistema de hardware dominante, mesmo que a participação da Nvidia no mercado de chips de inferência de IA continue a aumentar.

Este também é o primeiro acordo da Nvidia com uma startup de chips de inferência de IA desde que ela assinou um acordo de licenciamento de tecnologia de US$ 20 bilhões com a Groq em dezembro do ano passado. Isso mostra que a Nvidia não pretende apostar apenas nesta empresa.
Há três meses, a Nvidia lançou um modelo de cooperação com seus concorrentes de chips, permitindo que os chips das duas empresas trabalhassem juntos e compartilhassem tarefas diferentes no mesmo conjunto de cargas de trabalho de inferência de IA. O objetivo é melhorar a eficiência operacional de tais tarefas computacionais.
É difícil para os concorrentes abalar a enorme liderança da Nvidia, por isso cada vez mais fabricantes estão optando por trabalhar com GPUs da Nvidia em vez de substituí-las completamente. A NVIDIA promove a conexão dos concorrentes ao seu próprio ecossistema e também pode beneficiar seus produtos de hardware de rede; esses produtos podem interconectar vários grupos de racks de servidores como um sistema geral para concluir cálculos de IA de alta carga. Esta solução técnica é a computação paralela.

Nos últimos 12 meses, a Nvidia concluiu investimentos multibilionários na Intel e na Broadcom, dois outros grandes concorrentes de chips de IA, em parte para promover a integração das GPUs da Nvidia com esses dois chips empresariais. Não está claro quando essas integrações estarão disponíveis em larga escala. Pessoas de várias empresas iniciantes de chips revelaram que a Nvidia também promoveu soluções para várias outras startups de chips, esperando que seus chips possam ser compatíveis com GPUs equipadas com tecnologia de rede Nvidia.
Em agosto deste ano, a Amazon também propôs uma ideia de integração semelhante: permitir que a GPU Nvidia e o chip Trainium AI desenvolvido pela Amazon coexistam e sejam executados simultaneamente no mesmo data center usando um rack de servidor com uma arquitetura unificada; ao mesmo tempo, o chip Trainium também pode chamar o hardware de rede e memória da Nvidia.
A SambaNova Systems, outra start-up de chips, também demonstrou em junho uma solução para interconectar seus próprios chips com GPUs NVIDIA para executar modelos de IA juntos. Ao promover a integração heterogênea mencionada acima, a NVIDIA também está desenvolvendo de forma independente um sistema de chip que combina GPU com o chip de inferência de IA dedicado da Groq. Anteriormente, a NVIDIA também absorveu a equipe fundadora da Groq e muitos funcionários por meio desta transação de licenciamento de tecnologia de US$ 20 bilhões.
O Departamento de Justiça dos EUA está investigando se a Nvidia planejou o acordo com a Groq de forma a contornar uma investigação formal do Departamento de Justiça sobre o impacto do acordo no mercado de chips, de acordo com fontes familiarizadas com a investigação. A notícia foi divulgada pela primeira vez pelo New York Times.
Chamar chips de diferentes fabricantes para processar conjuntamente a mesma tarefa de IA é um conceito relativamente novo da indústria, chamado de
inferência desagregada
neurônio AWS. Embora a NVIDIA esteja desenvolvendo ativamente soluções de inferência dissociadas com rivais menores, a NVIDIA declarou publicamente que ainda pode lidar com quase todas as cargas de trabalho de IA de forma mais eficiente apenas com seus próprios chips.Mesmo assim, os provedores de serviços em nuvem e as principais empresas de desenvolvimento de IA, como a Anthropic e a OpenAI, não querem depender inteiramente de um único fornecedor de chips. Além de comprar chips de outros fabricantes para reduzir sua dependência da Nvidia, essas duas empresas de IA também estão desenvolvendo seus próprios chips de inferência de IA.
O foco técnico do d‑Matrix é a
decodificação especulativa
, esta tecnologia pode melhorar a velocidade de execução dos modelos de IA. Neste sistema conjunto a ser lançado pela NVIDIA, o chip d-Matrix irá executar um pequeno modelo de IA e prever antecipadamente os resultados de saída que o modelo grande deve fornecer ao usuário; enquanto o modelo grande será executado na GPU NVIDIA para verificar os resultados esperados e confirmar sua adoção.O Information informou anteriormente que a d‑Matrix estava à procura de uma nova ronda de financiamento na altura, com uma avaliação pós-dinheiro alvo de 5 mil milhões de dólares; atualmente não se sabe se o financiamento da Nvidia será incluído nesta rodada de financiamento. A última rodada de financiamento da d‑Matrix ocorreu em novembro de 2025, arrecadando US$ 275 milhões, com uma avaliação pós-monetária de US$ 2 bilhões. A empresa concluiu a produção em massa de seus chips de primeira geração neste verão e atualmente está testando seus chips de segunda geração.
Comentários