Liquid AI lança modelos de IA que tomam decisões em milissegundos — e funcionam em celulares
Os novos d1-3B e d1-omni-600M conseguem analisar texto, imagem e áudio e dar respostas diretas em menos de 50 milissegundos, sem precisar de internet ou servidores na nuvem
A Liquid AI lançou dois modelos de IA que tomam decisões estruturadas em vez de gerar texto: o d1-3B (com 3 bilhões de parâmetros, que são os valores que definem o comportamento de uma IA) processa texto e imagens, e o d1-omni-600M aceita texto com imagem ou áudio. Ambos respondem em milissegundos e rodam localmente, sem precisar de internet.

A Liquid AI, uma startup de inteligência artificial fundada por ex-pesquisadores do MIT, acaba de lançar dois modelos que fazem algo diferente da maioria dos sistemas de IA: em vez de gerar textos longos, eles tomam decisões rápidas. O d1-3B (um modelo com 3 bilhões de parâmetros, que são os valores ajustáveis que definem o comportamento de uma IA) e o d1-omni-600M (versão experimental com 600 milhões de parâmetros) respondem perguntas diretas — como "o cliente está pedindo reembolso?" ou "quantos gatos há nesta foto?" — em uma única passagem pelos dados, sem gerar palavra por palavra como o ChatGPT faz.
O d1-3B consegue processar texto e imagens, enquanto o d1-omni-600M aceita texto com imagem ou texto com áudio. Segundo a empresa, o d1-3B obteve 48,57 pontos no Decision Index 0.2.1 (um ranking que mede a capacidade de tomar decisões estruturadas), superando modelos muito maiores, como o Decider 35B-A3B, que tem 35 bilhões de parâmetros mas ficou com 47,11 pontos. Em testes com sete conjuntos de dados públicos — que incluem compreensão de leitura, detecção de toxicidade, classificação de intenções e perguntas médicas —, o d1-3B alcançou média de 82,9%, acima do Decider 4B (81,1%).
A velocidade chama atenção porque esses modelos rodam localmente, sem depender da nuvem. Em testes feitos em parceria com a Nvidia, o d1-3B respondeu uma pergunta em 16 milissegundos no Jetson AGX Thor (um computador compacto feito para rodar IA em dispositivos como robôs ou drones), 26 milissegundos no Jetson AGX Orin e 50 milissegundos no Jetson Orin Nano, ainda menor e mais barato. Em placas de vídeo de consumo, como a Nvidia RTX 4090, o tempo cai para 8 milissegundos por pergunta e 17 milissegundos para processar uma imagem de 384 pixels.
Esses modelos não são feitos para conversar nem escrever textos criativos — a função deles é classificar, filtrar e decidir. A Liquid AI sugere usá-los em situações como triagem de atendimento ao cliente (identificar se um ticket é urgente ou para qual equipe enviá-lo), análise de imagens em tempo real (contar objetos, detectar anomalias) ou processamento de áudio (identificar comandos de voz). Como funcionam offline e são pequenos o suficiente para rodar em hardware acessível, podem ser úteis em aplicações que exigem privacidade ou não têm conexão estável com a internet.
Os dois modelos estão disponíveis no Hugging Face (uma plataforma onde desenvolvedores compartilham e baixam modelos de IA já treinados) com pesos abertos — ou seja, qualquer pessoa pode baixar, usar e modificar o código, desde que tenha a biblioteca Transformers versão 5.14 ou superior instalada. A empresa também criou uma demonstração interativa chamada System One Arcade, onde é possível testar os modelos diretamente no navegador. O d1-omni-600M ainda está em fase experimental e a Liquid AI não divulgou métricas de velocidade para ele nesta versão inicial.


