O CEO da NVIDIA, Huang Renxun, disse na sessão de perguntas e respostas do GTC que a tecnologia de processo de próxima geração baseada em transistores all-gate (GAA) pode trazer uma melhoria de desempenho de 20% para as GPUs NVIDIA. Claro, isso pode ser um assunto para a próxima geração de GPUs, que é a Feynman, com lançamento previsto para 2028.

De acordo com a tomshardware, Huang pareceu minimizar a importância das mudanças nos nós do processo em sua resposta, enfatizando que a desaceleração da Lei de Moore significa que novas tecnologias de processo no futuro só poderão trazer melhorias de cerca de 20% na densidade, potência e/ou eficiência. Ele também disse que embora as melhorias provenientes de tecnologias de processo de ponta sejam bem-vindas, elas não são mais transformadoras. “Aceitaremos isso”, disse ele, mas observou que outros fatores eram mais importantes. À medida que os sistemas de IA aumentam, a eficiência do gerenciamento de um grande número de GPUs se torna mais importante do que o desempenho bruto de cada GPU.

A NVIDIA geralmente não adota primeiro o processo mais recente da TSMC, mas escolhe um processo mais maduro. Eles estão usando o processo de 4 nm da TSMC para produzir GPUs AdaLovelace, Hopper e Blackwell para consumidores e data centers. O processo de 4nm da TSMC é essencialmente uma versão melhorada do seu nó de 5nm. O plano GPU RuBin da próxima geração da NVIDIA é usar o processo de 3 nm da TSMC, que pode ser N3P ou a versão personalizada da NVIDIA. Portanto, o primeiro processo GAA da NVIDIA deve ser o Feynman lançado em 2028.

A TSMC espera que o primeiro N2 baseado no processo GAA melhore o desempenho em 10% a 15% em comparação com o N3E. Claro, Huang Renxun não mencionou qual processo GAA será usado, então, em teoria, TSMC N2 ou processo semelhante da Samsung, ou mesmo Intel18A é realmente possível. E há uma grande probabilidade de que a NVIDIA não use a tecnologia de processo de primeira geração, então Feynman pode estar mais propenso a usar N2P, uma versão melhorada do N2, que irá melhorar o desempenho, reduzir a resistência e estabilizar o fornecimento de energia. Além disso, a TSMC espera que os processos N2P e A16 sejam colocados em produção em 2027. O processo A16 adicionará novamente a função de fonte de alimentação e o desempenho será 8% a 10% superior ao N2.

Se a NVIDIA usar o processo N2P ou A16 na GPU Feynman, espera-se melhorar o desempenho por watt em 20% em comparação com a GPU Rubin usando o processo N3P. A melhoria real do desempenho pode ser maior. No entanto, considerando a enorme demanda atual por computação de IA, a NVIDIA parece estar mais inclinada a buscar o mais alto desempenho em vez do melhor consumo de energia.