Ao vivo
[Pesquisa]Como o Ai2 resolveu a briga por GPUs com orçamentos em vez de fila de prioridade[Ferramentas]Como criar modelos de IA personalizados por menos de US$ 20 usando um agente automatizado[Modelos de IA]Liquid AI lança modelos de IA que tomam decisões em milissegundos — e funcionam em celulares[Modelos de IA]TII lança Falcon ASR, modelo de transcrição de áudio aberto que roda em hardware comum[Modelos de IA]Nvidia mostra que um único modelo de IA pode chegar ao pódio tanto em programação quanto em matemática avançada[Modelos de IA]Falcon-Emirati: o modelo de IA que aprendeu a falar árabe como um emiradense de verdade[Ferramentas]Hugging Face cria repositório central para ambientes de IA que aprendem por tentativa e erro[Ferramentas]O agente de IA disse que terminou. O banco de dados discordou.[Modelos de IA]Instituto Allen lança modelo de IA aberto para escrever relatórios científicos em segundos[Pesquisa]Como a ServiceNow cria dados de treino que ensinam agentes de IA a funcionar dentro de empresas[Pesquisa]Como o Ai2 resolveu a briga por GPUs com orçamentos em vez de fila de prioridade[Ferramentas]Como criar modelos de IA personalizados por menos de US$ 20 usando um agente automatizado[Modelos de IA]Liquid AI lança modelos de IA que tomam decisões em milissegundos — e funcionam em celulares[Modelos de IA]TII lança Falcon ASR, modelo de transcrição de áudio aberto que roda em hardware comum[Modelos de IA]Nvidia mostra que um único modelo de IA pode chegar ao pódio tanto em programação quanto em matemática avançada[Modelos de IA]Falcon-Emirati: o modelo de IA que aprendeu a falar árabe como um emiradense de verdade[Ferramentas]Hugging Face cria repositório central para ambientes de IA que aprendem por tentativa e erro[Ferramentas]O agente de IA disse que terminou. O banco de dados discordou.[Modelos de IA]Instituto Allen lança modelo de IA aberto para escrever relatórios científicos em segundos[Pesquisa]Como a ServiceNow cria dados de treino que ensinam agentes de IA a funcionar dentro de empresas
Transmitindo · —

Notícias.
Inteligência Artificial

Inteligência Artificial para Gente de Verdade · ES / PT-BR

Modelos de IAHugging Face Blog2 min

Nvidia lança modelo de IA compacto que processa texto, áudio e vídeo ao mesmo tempo

O Nemotron 3 Nano Omni roda em dispositivos simples e entende documentos longos, chamadas gravadas e vídeos — sem depender da nuvem.

Por Redação2 min
Compartilhar
Nvidia lança modelo de IA compacto que processa texto, áudio e vídeo ao mesmo tempo
Modelos de IA · Hugging Face Blog

A Nvidia (fabricante de chips e software para inteligência artificial) anunciou o Nemotron 3 Nano Omni, um modelo de IA multimodal (capaz de processar diferentes tipos de dados, como texto, áudio e vídeo) e compacto o suficiente para rodar em dispositivos locais, como o Jetson Nano (um computador pequeno e barato feito para rodar modelos de IA sem depender da internet). O modelo aceita contextos de até 128 mil tokens (unidades de texto que o modelo consegue processar de uma vez, equivalentes a cerca de 96 mil palavras), o que permite analisar documentos extensos, chamadas de áudio longas ou vídeos completos em uma única rodada.

Segundo informou a Nvidia em seu blog oficial, o Nemotron 3 Nano Omni foi projetado para aplicações práticas em empresas e dispositivos de borda (edge devices, como câmeras inteligentes, robôs ou sistemas embarcados que processam dados localmente). Entre os casos de uso destacados estão agentes de IA (programas autônomos que tomam decisões e executam tarefas) para análise de documentos jurídicos ou médicos, assistentes que transcrevem e resumem reuniões em tempo real, e sistemas de monitoramento visual que interpretam vídeos de segurança ou controle de qualidade industrial.

O modelo está disponível na plataforma Hugging Face (um repositório onde desenvolvedores compartilham e baixam modelos de IA já treinados) com licença Nvidia Open Model License, que permite uso comercial mas impõe restrições sobre redistribuição. A Nvidia oferece versões otimizadas para inferência (processo de usar o modelo já treinado para gerar respostas) em chips como o H100 e a linha Jetson, com quantização (técnica que reduz o tamanho do modelo para acelerar o processamento) em 4 bits para melhorar a eficiência em hardware limitado.

A empresa também divulgou benchmarks mostrando desempenho competitivo em tarefas de compreensão de vídeo e documentos quando comparado a modelos maiores, embora não tenha detalhado comparações diretas com concorrentes de porte similar. O foco declarado é democratizar acesso a IA multimodal em cenários onde latência baixa (tempo de resposta rápido) e privacidade de dados são críticos — ambientes onde enviar informações para a nuvem não é viável ou desejável.

Fonte original
Hugging Face Blog
Mais em · Modelos de IA