O chip desenvolvido pela OpenAI alcançou um avanço importante: velocidade de resposta e eficiência energética superaram a Nvidia GB300

📅 2026-08-26

Resumo:

A OpenAI afirma que seu novo chip “Jalapeno” teve melhor desempenho nos testes do que a atual linha de produtos da Nvidia, destacando o progresso que a empresa fez no desenvolvimento de seus próprios processadores de IA. Richard, chefe de negócios de chips OpenAI Ho disse em entrevista que o chip foi comparado ao Nvidia GB300, teste que considerou o GB300 o produto mais avançado disponível. No teste, o Jalapeno levou vantagem em dois indicadores: a quantidade de carga de trabalho de IA que pode suportar por unidade de consumo de energia e a velocidade de resposta.

Desta vez, quando a OpenAI testou publicamente o Jalapeno, ela usou seu próprio modelo de código aberto menor, GPT‑OSS 120B, bem como modelos de terceiros da DeepSeek e Moonshot AI. No modelo Kimi K2.5 1T da Moonshot, as vantagens do Jalapeno são ainda mais óbvias.


A OpenAI afirmou que em testes internos, o Jalapeno também teve um bom desempenho ao executar alguns modelos avançados de grande escala que ainda não foram lançados. Isso sugere que o design do chip “aumentará ainda mais em valor” à medida que as cargas de trabalho se tornarem maiores e mais complexas.

A OpenAI colaborou com a Broadcom para desenvolver o Jalapeno. A empresa planeja usar o chip para dar suporte aos seus modelos de IA a partir do final deste ano. Isto faz parte do seu plano para construir a sua própria infra-estrutura de IA e promover a auto-investigação de chips em maior escala.

A Broadcom produz chips personalizados para muitos clientes. As duas empresas anunciaram a sua cooperação no ano passado e promoveram vigorosamente a velocidade de desenvolvimento deste processador em junho deste ano, afirmando que foi desenvolvido a uma velocidade recorde.

Atualmente, mais e mais empresas estão desenvolvendo chips de IA de desenvolvimento próprio, e a NVIDIA ainda domina esse campo.

Normalmente, alguns chips têm mais poder de processamento ao executar tarefas de IA, enquanto outros são melhores em responder rapidamente, mas o Jalapeno tem o melhor dos dois mundos, disse Ho.

A OpenAI decidirá quais modelos de IA serão executados no Jalapeno, permitindo que os clientes escolham soluções de menor custo ou maior desempenho com base em suas necessidades.

Ho disse: "Em testes de laboratório, o Jalapeno apresentou forte desempenho no campo de alto rendimento, o que significa que pode atender um grande número de clientes a um custo menor; ao mesmo tempo, também teve um bom desempenho no campo de baixa latência, o que significa que para clientes que valorizam a velocidade de resposta, seu tempo de resposta será muito, muito rápido." Para data centers, a eletricidade é um dos custos mais importantes.


Deve-se observar que o Jalapeno não foi testado com os chips Vera Rubin de última geração da Nvidia, que apenas começaram a ser comercializados. Além disso, o Jalapeno não foi projetado para treinamento de modelos de IA, e o treinamento é exatamente uma das áreas em que a tecnologia NVIDIA é melhor.

O Jalapeno é orientado principalmente para a etapa de inferência de IA, ou seja, após o modelo concluir o treinamento, ele gera respostas e executa tarefas com base nas solicitações do usuário. A vantagem em velocidade significa que a OpenAI pode usá-la para obter efeitos que no passado só poderiam ser alcançados por processadores que usam diferentes tipos de memória e arquiteturas de chip.

OpenAI ainda depende da tecnologia Cerebras para rodar alguns modelos, e esse tipo de chip é mais adequado para modelos menores. Em comparação, o Jalapeno é capaz de lidar com modelos muito maiores. Ho disse que a tecnologia da OpenAI não substituirá fornecedores como a Cerebras no curto prazo.

Ho disse: "Nossa demanda por poder de computação é muito grande, e é por isso que assinamos contratos com tantos fornecedores diferentes. Esta situação continuará por algum tempo." Ele disse que a OpenAI espera exibir publicamente seus resultados de pesquisa e desenvolvimento para promover a inovação na área de chips de IA.

Outras startups estão explorando direções semelhantes. A Etched disse na semana passada que garantiu uma avaliação de cerca de US$ 21 bilhões em uma rodada de financiamento e começou a enviar um chip de baixa tensão. A MatX, fundada por dois ex-funcionários de chips do Google, está atualmente desenvolvendo um produto semicondutor com o mesmo objetivo de combinar alto rendimento e baixa latência.

A OpenAI também disse que a empresa usou seu próprio modelo de IA para acelerar o processo de desenvolvimento de chips. O chip de segunda geração também entrou em um estágio de pesquisa e desenvolvimento mais aprofundado. Ho disse que a empresa espera concluir a remoção do chip “nos próximos meses”, quando o design do chip entra na fase de finalização.

Ao mesmo tempo, a OpenAI começou a projetar seus chips de terceira geração, na esperança de reduzir ainda mais o custo da infraestrutura de IA que está construindo em grande escala em todo o mundo. Ho disse: "Agora atingimos um nível de custo e consumo de energia que pode reduzir os custos de infraestrutura. Este é apenas o primeiro passo." Embora a OpenAI esteja promovendo ativamente chips de desenvolvimento próprio e comparando seu desempenho com os produtos da NVIDIA, Ho ainda enfatizou especificamente que a OpenAI ainda considera a NVIDIA como um importante fornecedor de chips.

"A NVIDIA é uma parceira muito boa e ainda precisamos usar muitos chips NVIDIA."

Tags relacionadas

Artigos relacionados

Comentários

0/500
验证码
Sem comentários