Ao vivo
[Pesquisa]Como o Ai2 resolveu a briga por GPUs com orçamentos em vez de fila de prioridade[Ferramentas]Como criar modelos de IA personalizados por menos de US$ 20 usando um agente automatizado[Modelos de IA]Liquid AI lança modelos de IA que tomam decisões em milissegundos — e funcionam em celulares[Modelos de IA]TII lança Falcon ASR, modelo de transcrição de áudio aberto que roda em hardware comum[Modelos de IA]Nvidia mostra que um único modelo de IA pode chegar ao pódio tanto em programação quanto em matemática avançada[Modelos de IA]Falcon-Emirati: o modelo de IA que aprendeu a falar árabe como um emiradense de verdade[Ferramentas]Hugging Face cria repositório central para ambientes de IA que aprendem por tentativa e erro[Ferramentas]O agente de IA disse que terminou. O banco de dados discordou.[Modelos de IA]Instituto Allen lança modelo de IA aberto para escrever relatórios científicos em segundos[Pesquisa]Como a ServiceNow cria dados de treino que ensinam agentes de IA a funcionar dentro de empresas[Pesquisa]Como o Ai2 resolveu a briga por GPUs com orçamentos em vez de fila de prioridade[Ferramentas]Como criar modelos de IA personalizados por menos de US$ 20 usando um agente automatizado[Modelos de IA]Liquid AI lança modelos de IA que tomam decisões em milissegundos — e funcionam em celulares[Modelos de IA]TII lança Falcon ASR, modelo de transcrição de áudio aberto que roda em hardware comum[Modelos de IA]Nvidia mostra que um único modelo de IA pode chegar ao pódio tanto em programação quanto em matemática avançada[Modelos de IA]Falcon-Emirati: o modelo de IA que aprendeu a falar árabe como um emiradense de verdade[Ferramentas]Hugging Face cria repositório central para ambientes de IA que aprendem por tentativa e erro[Ferramentas]O agente de IA disse que terminou. O banco de dados discordou.[Modelos de IA]Instituto Allen lança modelo de IA aberto para escrever relatórios científicos em segundos[Pesquisa]Como a ServiceNow cria dados de treino que ensinam agentes de IA a funcionar dentro de empresas
Transmitindo · —

Notícias.
Inteligência Artificial

Inteligência Artificial para Gente de Verdade · ES / PT-BR

Modelos de IAHugging Face Blog2 min

IBM lança modelo de IA tão pequeno que roda em celular antigo

Granite 4.0 Nano tem apenas 419 milhões de parâmetros e consegue executar tarefas de linguagem em dispositivos com menos de 1 GB de memória.

Por Redação2 min
Compartilhar
IBM lança modelo de IA tão pequeno que roda em celular antigo
Modelos de IA · Hugging Face Blog

A IBM divulgou o Granite 4.0 Nano, um modelo de linguagem (LLM, sigla em inglês para os programas de IA que entendem e geram texto) extremamente compactado que consegue rodar em smartphones modestos, microcontroladores (chips simples usados em aparelhos do dia a dia) e até no Raspberry Pi Zero (um computador do tamanho de um cartão de crédito que custa cerca de 25 reais). Com 419 milhões de parâmetros (os valores que o modelo ajusta durante o treinamento para aprender padrões na linguagem), ele é cerca de 200 vezes menor que modelos populares como o GPT-4, mas ainda assim capaz de responder perguntas, resumir textos e executar instruções básicas.

Segundo informou a IBM na plataforma Hugging Face (um repositório online onde desenvolvedores compartilham modelos de IA já treinados), o Nano foi pensado para cenários em que não há conexão com a internet ou onde a privacidade é crítica — como assistentes pessoais que funcionam offline, dispositivos médicos portáteis ou sistemas embarcados em fábricas. O modelo ocupa menos de 500 MB de espaço e precisa de apenas 0,8 GB de RAM (memória de trabalho do computador) para funcionar, o que o torna viável em hardware de cinco anos atrás ou mais.

A IBM disponibilizou o Granite 4.0 Nano com pesos abertos (ou seja, qualquer pessoa pode baixar, modificar e usar o modelo sem pagar licença), sob a licença Apache 2.0. Nos testes internos da empresa, o Nano obteve desempenho comparável ao de modelos até três vezes maiores em tarefas como classificação de textos e resposta a perguntas simples, embora ainda fique atrás de LLMs maiores em raciocínio complexo ou geração criativa longa.

Para desenvolvedores, a novidade abre caminho para aplicações que antes exigiriam enviar dados para a nuvem (servidores remotos da internet) — um problema em ambientes com conectividade ruim ou restrições legais sobre compartilhamento de informações. A IBM sugere que o modelo pode ser refinado (ajustado com dados específicos de uma empresa ou domínio) para tarefas especializadas, como análise de logs técnicos ou triagem de mensagens, mantendo tudo dentro do próprio dispositivo.

Fonte original
Hugging Face Blog
Mais em · Modelos de IA