Todas as notícias
Nvidia2 min de leitura

Nvidia lança modelo de IA compacto e rápido para agentes autônomos

O Nemotron 3.5 Lightning é um modelo de 30 bilhões de parâmetros que usa apenas 3 bilhões ativos por tarefa, prometendo agilidade e baixo custo para executar chamadas repetitivas em sistemas de IA.

Nvidia lança modelo de IA compacto e rápido para agentes autônomos

A Nvidia apresentou nesta semana o Nemotron 3.5 Lightning, um modelo de inteligência artificial feito para acelerar a parte mais repetitiva do trabalho de agentes autônomos — aqueles programas que executam tarefas sozinhos, como buscar informações em ferramentas, validar resultados ou delegar subtarefas. Em vez de usar um modelo grande e caro para cada passo, a ideia é deixar o trabalho pesado e rotineiro com um modelo mais enxuto e rápido.

O Nemotron 3.5 Lightning tem 30 bilhões de parâmetros (os pesos que o modelo ajusta durante o treinamento), mas usa na prática apenas 3 bilhões deles a cada operação. Isso é possível graças a uma arquitetura chamada "mistura de especialistas" (MoE, na sigla em inglês), que ativa só os especialistas necessários para cada tarefa. O resultado é um modelo que entrega a capacidade de um sistema grande com o custo computacional de um pequeno, ideal para ambientes onde cada milissegundo e cada centavo contam.

O lançamento chega em um momento em que empresas de tecnologia estão dividindo o trabalho de IA entre modelos diferentes: um modelo de ponta, como o Nemotron 3 Ultra, cuida do planejamento e da coordenação, enquanto modelos menores e mais rápidos, como este Lightning, executam as chamadas de alto volume. A Nvidia também liberou o NeMo Switchyard, uma biblioteca que decide automaticamente qual modelo deve responder a cada requisição, otimizando custo e velocidade.

Para quem desenvolve agentes autônomos, o Nemotron 3.5 Lightning promete ser uma opção prática: é um modelo aberto (com pesos, dados de treino e receitas disponíveis), roda em máquinas modestas como o computador de mesa DGX Spark ou até em placas GeForce RTX 5090, e pode ser ajustado para tarefas específicas com menos esforço do que modelos gigantes. Para o usuário comum, a novidade não muda o dia a dia imediatamente, mas sinaliza que agentes de IA devem ficar mais rápidos e baratos de operar nos bastidores.

De onde veio esta notícia

Texto em português produzido com apoio de inteligência artificial a partir da publicação original de Nvidia. Os fatos, números e nomes são os da fonte — se quiser conferir, o link abaixo leva ao original.

Ler a publicação original em Nvidia