Ao vivo
[Pesquisa]Como o Ai2 resolveu a briga por GPUs com orçamentos em vez de fila de prioridade[Ferramentas]Como criar modelos de IA personalizados por menos de US$ 20 usando um agente automatizado[Modelos de IA]Liquid AI lança modelos de IA que tomam decisões em milissegundos — e funcionam em celulares[Modelos de IA]TII lança Falcon ASR, modelo de transcrição de áudio aberto que roda em hardware comum[Modelos de IA]Nvidia mostra que um único modelo de IA pode chegar ao pódio tanto em programação quanto em matemática avançada[Modelos de IA]Falcon-Emirati: o modelo de IA que aprendeu a falar árabe como um emiradense de verdade[Ferramentas]Hugging Face cria repositório central para ambientes de IA que aprendem por tentativa e erro[Ferramentas]O agente de IA disse que terminou. O banco de dados discordou.[Modelos de IA]Instituto Allen lança modelo de IA aberto para escrever relatórios científicos em segundos[Pesquisa]Como a ServiceNow cria dados de treino que ensinam agentes de IA a funcionar dentro de empresas[Pesquisa]Como o Ai2 resolveu a briga por GPUs com orçamentos em vez de fila de prioridade[Ferramentas]Como criar modelos de IA personalizados por menos de US$ 20 usando um agente automatizado[Modelos de IA]Liquid AI lança modelos de IA que tomam decisões em milissegundos — e funcionam em celulares[Modelos de IA]TII lança Falcon ASR, modelo de transcrição de áudio aberto que roda em hardware comum[Modelos de IA]Nvidia mostra que um único modelo de IA pode chegar ao pódio tanto em programação quanto em matemática avançada[Modelos de IA]Falcon-Emirati: o modelo de IA que aprendeu a falar árabe como um emiradense de verdade[Ferramentas]Hugging Face cria repositório central para ambientes de IA que aprendem por tentativa e erro[Ferramentas]O agente de IA disse que terminou. O banco de dados discordou.[Modelos de IA]Instituto Allen lança modelo de IA aberto para escrever relatórios científicos em segundos[Pesquisa]Como a ServiceNow cria dados de treino que ensinam agentes de IA a funcionar dentro de empresas
Transmitindo · —

Notícias.
Inteligência Artificial

Inteligência Artificial para Gente de Verdade · ES / PT-BR

Modelos de IAHugging Face Blog2 min

Google lança Gemma 4, modelo de IA que roda em celulares e reconhece imagens

Nova família de modelos de pesos abertos promete desempenho de ponta em dispositivos baratos, sem depender da nuvem.

Por Redação2 min
Compartilhar
Google lança Gemma 4, modelo de IA que roda em celulares e reconhece imagens
Modelos de IA · Hugging Face Blog

O Google acaba de liberar o Gemma 4, uma família de modelos de inteligência artificial de pesos abertos (isto é, cujo código e estrutura interna podem ser baixados e modificados por qualquer pessoa) que consegue rodar em computadores modestos e até em celulares. Segundo informou a Hugging Face (uma plataforma onde desenvolvedores compartilham e baixam modelos de IA já treinados), a novidade é que esses modelos são multimodais — entendem tanto texto quanto imagens — e mantêm qualidade próxima aos grandes modelos que só funcionam na nuvem, mas ocupam muito menos espaço e exigem muito menos poder de processamento.

A família inclui versões de tamanhos diferentes: a menor tem 2 bilhões de parâmetros (os "neurônios" do modelo, que definem sua capacidade), a média tem 9 bilhões e a maior tem 27 bilhões. Para ter ideia, modelos como o GPT-4 têm centenas de bilhões de parâmetros e precisam de servidores potentes para funcionar. O Gemma 4, por outro lado, foi desenhado para rodar em GPUs mais simples (as placas de vídeo que fazem os cálculos da IA) ou mesmo em chips ARM (o tipo de processador usado em celulares e tablets). A versão de 2 bilhões roda até no Jetson Nano (um computador pequeno e barato feito para rodar modelos de IA sem depender da internet).

Nos testes divulgados, o Gemma 4 de 27 bilhões ficou próximo ou acima de concorrentes conhecidos, como o Llama 3.3 (da Meta) e o Qwen 2.5 (da chinesa Alibaba), em tarefas de compreensão de texto, raciocínio lógico e até análise de imagens. A versão menor, de 2 bilhões, superou outros modelos compactos em vários benchmarks (os testes padronizados que medem a capacidade de um modelo). Isso importa porque, quanto menor o modelo, mais barato e rápido ele é para usar — especialmente em aplicações que precisam funcionar offline ou processar dados sensíveis sem enviá-los para a nuvem.

Para quem quer experimentar, o Gemma 4 já está disponível na Hugging Face e pode ser testado gratuitamente em plataformas como o Google Colab (um ambiente online para rodar código Python sem instalar nada no computador). O Google também disponibilizou ferramentas para adaptar o modelo a tarefas específicas — um processo chamado fine-tuning (ajuste fino), em que você retreina o modelo com exemplos do seu próprio domínio para melhorar seu desempenho em perguntas específicas. A empresa promete que versões ainda menores, otimizadas para celulares Android, chegarão em breve.

Fonte original
Hugging Face Blog
Mais em · Modelos de IA