Pular para o conteúdo
← Todas as notícias

NVIDIA e Nscale detalham teste do DSX MaxLPS com mais GPUs no mesmo limite de energia

Avaliação técnica com Kimi K2.5 em GB300 NVL72 mostra como a redistribuição dinâmica de energia elevou a capacidade de 140 para 192 GPUs sem mudar o orçamento de 264,4 kW.

A NVIDIA publicou, com a Nscale, uma avaliação técnica do DSX MaxLPS, sistema que redistribui energia entre GPUs participantes para aproveitar melhor a margem disponível em ambientes de IA. O teste foi feito com cargas do Kimi K2.5 em sistemas NVIDIA GB300 NVL72 no data center da Nscale no campus da Verne, em Keflavík, na Islândia, com energia renovável.

NVIDIA e Nscale detalham teste do DSX MaxLPS com mais GPUs no mesmo limite de energia

A comparação foi entre um arranjo estático, com 35 nós de quatro GPUs, ou 140 GPUs, e a configuração com DSX MaxLPS, que usou 48 nós, ou 192 GPUs. Em ambos os casos, o orçamento de energia provisionado foi o mesmo, 264,4 kW. A taxa de transferência agregada por watt provisionado passou de 4,10 para 6,12 tokens por segundo por watt, alta de 49,2%.

A avaliação também observou os efeitos na latência. O desempenho por instância ficou praticamente igual na precisão mostrada, e a latência mediana e o percentil 75 ficaram dentro de 5% da linha de base. Já o tempo até o primeiro token no percentil 99 subiu 17%, a partir de 15,7 segundos, o que reforça a necessidade de olhar a cauda da latência junto com a capacidade total.

A própria NVIDIA destaca que isso não aumenta a oferta de energia do site: apenas usa melhor a margem que já existe. Por isso, recomenda que operadores testem cargas representativas e confirmem se a infraestrutura elétrica, de refrigeração e de rede comporta a capacidade que o sistema habilita.

← Todas as notícias