NVIDIA nova geração de chip de IA é 30 vezes mais eficiente que a anterior
A NVIDIA divulgou resultados de benchmark mostrando que seu novo chip Vera Rubin, dedicado a tarefas de agentes de IA, consome um quarto da energia para realizar o mesmo trabalho que a geração anterior.

A NVIDIA anunciou que sua próxima geração de chips para inteligência artificial, o Vera Rubin, é 30 vezes mais eficiente do que o modelo atual, o Blackwell, quando executamos tarefas complexas de agentes de IA. Agentes de IA são programas que, em vez de simplesmente responder perguntas, podem planejar, usar ferramentas e interagir em várias etapas para completar um objetivo — como um assistente que escreve código ou organiza uma viagem.
O resultado veio de um teste chamado AgentX, que simula sessões reais de agentes de IA. A métrica principal é “tokens por megawatt” — basicamente, quantas unidades de texto o sistema consegue processar para cada megawatt de eletricidade consumida. Quanto maior esse número, mais barato e sustentável fica rodar esses assistentes em escala. O Vera Rubin conseguiu até 30 vezes mais que o Blackwell, e o Blackwell já era 15 vezes melhor que gerações anteriores, como o H200.
Esse salto é importante porque o uso de agentes de IA está explodindo. Cada pedido para um agente pode consumir 15 vezes mais unidades de texto do que uma conversa comum, segundo relatórios do setor. Isso pressiona os data centers, que gastam muita energia. Com chips mais eficientes, as empresas podem oferecer serviços de IA com o mesmo orçamento de luz ou reduzir custos — a NVIDIA afirma que o custo por milhão de tokens caiu 10 vezes do H200 para o Blackwell.
Para o usuário final, essa tecnologia ainda não chega amanhã — o Vera Rubin está previsto para o futuro. Mas a tendência é que assistentes de IA mais inteligentes e que realizam tarefas longas se tornem mais acessíveis e rápidos, sem exigir que as empresas construam usinas de energia. No curto prazo, quem já usa ferramentas como GitHub Copilot pode esperar respostas mais consistentes e menor consumo de recursos nos data centers.
De onde veio esta notícia
Texto em português produzido com apoio de inteligência artificial a partir da publicação original de Nvidia. Os fatos, números e nomes são os da fonte — se quiser conferir, o link abaixo leva ao original.
Ler a publicação original em Nvidia