Ao vivo
[Pesquisa]Como o Ai2 resolveu a briga por GPUs com orçamentos em vez de fila de prioridade[Ferramentas]Como criar modelos de IA personalizados por menos de US$ 20 usando um agente automatizado[Modelos de IA]Liquid AI lança modelos de IA que tomam decisões em milissegundos — e funcionam em celulares[Modelos de IA]TII lança Falcon ASR, modelo de transcrição de áudio aberto que roda em hardware comum[Modelos de IA]Nvidia mostra que um único modelo de IA pode chegar ao pódio tanto em programação quanto em matemática avançada[Modelos de IA]Falcon-Emirati: o modelo de IA que aprendeu a falar árabe como um emiradense de verdade[Ferramentas]Hugging Face cria repositório central para ambientes de IA que aprendem por tentativa e erro[Ferramentas]O agente de IA disse que terminou. O banco de dados discordou.[Modelos de IA]Instituto Allen lança modelo de IA aberto para escrever relatórios científicos em segundos[Pesquisa]Como a ServiceNow cria dados de treino que ensinam agentes de IA a funcionar dentro de empresas[Pesquisa]Como o Ai2 resolveu a briga por GPUs com orçamentos em vez de fila de prioridade[Ferramentas]Como criar modelos de IA personalizados por menos de US$ 20 usando um agente automatizado[Modelos de IA]Liquid AI lança modelos de IA que tomam decisões em milissegundos — e funcionam em celulares[Modelos de IA]TII lança Falcon ASR, modelo de transcrição de áudio aberto que roda em hardware comum[Modelos de IA]Nvidia mostra que um único modelo de IA pode chegar ao pódio tanto em programação quanto em matemática avançada[Modelos de IA]Falcon-Emirati: o modelo de IA que aprendeu a falar árabe como um emiradense de verdade[Ferramentas]Hugging Face cria repositório central para ambientes de IA que aprendem por tentativa e erro[Ferramentas]O agente de IA disse que terminou. O banco de dados discordou.[Modelos de IA]Instituto Allen lança modelo de IA aberto para escrever relatórios científicos em segundos[Pesquisa]Como a ServiceNow cria dados de treino que ensinam agentes de IA a funcionar dentro de empresas
Transmitindo · —

Notícias.
Inteligência Artificial

Inteligência Artificial para Gente de Verdade · ES / PT-BR

Modelos de IAHugging Face Blog2 min

Liquid AI lança modelos de IA que tomam decisões em milissegundos — e funcionam em celulares

Os novos d1-3B e d1-omni-600M conseguem analisar texto, imagem e áudio e dar respostas diretas em menos de 50 milissegundos, sem precisar de internet ou servidores na nuvem

Por Redação2 min
Em resumo

A Liquid AI lançou dois modelos de IA que tomam decisões estruturadas em vez de gerar texto: o d1-3B (com 3 bilhões de parâmetros, que são os valores que definem o comportamento de uma IA) processa texto e imagens, e o d1-omni-600M aceita texto com imagem ou áudio. Ambos respondem em milissegundos e rodam localmente, sem precisar de internet.

Compartilhar
Liquid AI lança modelos de IA que tomam decisões em milissegundos — e funcionam em celulares
Modelos de IA · Hugging Face Blog

A Liquid AI, uma startup de inteligência artificial fundada por ex-pesquisadores do MIT, acaba de lançar dois modelos que fazem algo diferente da maioria dos sistemas de IA: em vez de gerar textos longos, eles tomam decisões rápidas. O d1-3B (um modelo com 3 bilhões de parâmetros, que são os valores ajustáveis que definem o comportamento de uma IA) e o d1-omni-600M (versão experimental com 600 milhões de parâmetros) respondem perguntas diretas — como "o cliente está pedindo reembolso?" ou "quantos gatos há nesta foto?" — em uma única passagem pelos dados, sem gerar palavra por palavra como o ChatGPT faz.

O d1-3B consegue processar texto e imagens, enquanto o d1-omni-600M aceita texto com imagem ou texto com áudio. Segundo a empresa, o d1-3B obteve 48,57 pontos no Decision Index 0.2.1 (um ranking que mede a capacidade de tomar decisões estruturadas), superando modelos muito maiores, como o Decider 35B-A3B, que tem 35 bilhões de parâmetros mas ficou com 47,11 pontos. Em testes com sete conjuntos de dados públicos — que incluem compreensão de leitura, detecção de toxicidade, classificação de intenções e perguntas médicas —, o d1-3B alcançou média de 82,9%, acima do Decider 4B (81,1%).

A velocidade chama atenção porque esses modelos rodam localmente, sem depender da nuvem. Em testes feitos em parceria com a Nvidia, o d1-3B respondeu uma pergunta em 16 milissegundos no Jetson AGX Thor (um computador compacto feito para rodar IA em dispositivos como robôs ou drones), 26 milissegundos no Jetson AGX Orin e 50 milissegundos no Jetson Orin Nano, ainda menor e mais barato. Em placas de vídeo de consumo, como a Nvidia RTX 4090, o tempo cai para 8 milissegundos por pergunta e 17 milissegundos para processar uma imagem de 384 pixels.

Esses modelos não são feitos para conversar nem escrever textos criativos — a função deles é classificar, filtrar e decidir. A Liquid AI sugere usá-los em situações como triagem de atendimento ao cliente (identificar se um ticket é urgente ou para qual equipe enviá-lo), análise de imagens em tempo real (contar objetos, detectar anomalias) ou processamento de áudio (identificar comandos de voz). Como funcionam offline e são pequenos o suficiente para rodar em hardware acessível, podem ser úteis em aplicações que exigem privacidade ou não têm conexão estável com a internet.

Os dois modelos estão disponíveis no Hugging Face (uma plataforma onde desenvolvedores compartilham e baixam modelos de IA já treinados) com pesos abertos — ou seja, qualquer pessoa pode baixar, usar e modificar o código, desde que tenha a biblioteca Transformers versão 5.14 ou superior instalada. A empresa também criou uma demonstração interativa chamada System One Arcade, onde é possível testar os modelos diretamente no navegador. O d1-omni-600M ainda está em fase experimental e a Liquid AI não divulgou métricas de velocidade para ele nesta versão inicial.

Fonte original
Hugging Face Blog
Mais em · Modelos de IA