A Liquid AI, empresa de inteligência artificial, anunciou uma atualização que promete tornar seus modelos de linguagem muito mais rápidos. A novidade se chama DSpark e consegue acelerar a geração de respostas em até 3,2 vezes — tanto em computadores potentes quanto em notebooks comuns.

O truque está em um problema técnico: quando um modelo de IA gera texto, ele gasta a maior parte do tempo não pensando, mas sim buscando informações na memória do computador. O DSpark resolve isso usando um modelo auxiliar bem menor (cerca de 300 milhões de parâmetros, contra bilhões do modelo principal). Esse ajudante "adivinha" várias palavras de uma vez, e o modelo principal só precisa conferir se elas estão corretas em uma única rodada de verificação.
A técnica não é totalmente nova — outras empresas já usam variações dela —, mas a Liquid AI a adaptou para seus modelos LFM2.5, que vão de versões leves (1,2 bilhão de parâmetros) até as mais robustas (8 bilhões). Os ganhos variam: em um MacBook Pro com chip M4 Max, o modelo menor chegou a 140 tokens por segundo (cada token é uma palavra ou pedaço dela), superando a velocidade de muitos serviços pagos na nuvem. Já em servidores com GPU H100, a aceleração média foi de 57% em testes com múltiplas ferramentas.
Para quem usa IA no dia a dia, a diferença prática é que as respostas vão aparecer mais rápido — especialmente em tarefas que exigem várias etapas, como programação ou análise de dados. A empresa já disponibilizou os modelos auxiliares para download e eles funcionam com ferramentas populares como llama.cpp (para rodar localmente) e SGLang (para servidores). O melhor: como o método apenas verifica sugestões, a qualidade do texto final continua exatamente a mesma do modelo original, sem erros extras ou invenções.