Liquid AI turbina seus modelos com truque que acelera respostas
Nova técnica chamada DSpark usa um modelo auxiliar pequeno para "adivinhar" tokens e reduzir o tempo de espera. Resultado: respostas mais rápidas em notebooks e servidores, sem perder qualidade.

A Liquid AI, empresa de inteligência artificial, anunciou uma atualização que promete tornar seus modelos de linguagem muito mais rápidos. A novidade se chama DSpark e consegue acelerar a geração de respostas em até 3,2 vezes — tanto em computadores potentes quanto em notebooks comuns.
O truque está em um problema técnico: quando um modelo de IA gera texto, ele gasta a maior parte do tempo não pensando, mas sim buscando informações na memória do computador. O DSpark resolve isso usando um modelo auxiliar bem menor (cerca de 300 milhões de parâmetros, contra bilhões do modelo principal). Esse ajudante "adivinha" várias palavras de uma vez, e o modelo principal só precisa conferir se elas estão corretas em uma única rodada de verificação.
A técnica não é totalmente nova — outras empresas já usam variações dela —, mas a Liquid AI a adaptou para seus modelos LFM2.5, que vão de versões leves (1,2 bilhão de parâmetros) até as mais robustas (8 bilhões). Os ganhos variam: em um MacBook Pro com chip M4 Max, o modelo menor chegou a 140 tokens por segundo (cada token é uma palavra ou pedaço dela), superando a velocidade de muitos serviços pagos na nuvem. Já em servidores com GPU H100, a aceleração média foi de 57% em testes com múltiplas ferramentas.
Para quem usa IA no dia a dia, a diferença prática é que as respostas vão aparecer mais rápido — especialmente em tarefas que exigem várias etapas, como programação ou análise de dados. A empresa já disponibilizou os modelos auxiliares para download e eles funcionam com ferramentas populares como llama.cpp (para rodar localmente) e SGLang (para servidores). O melhor: como o método apenas verifica sugestões, a qualidade do texto final continua exatamente a mesma do modelo original, sem erros extras ou invenções.
De onde veio esta notícia
Texto em português produzido com apoio de inteligência artificial a partir da publicação original de Hugging Face. Os fatos, números e nomes são os da fonte — se quiser conferir, o link abaixo leva ao original.
Ler a publicação original em Hugging Face