En directo
[Investigación]Cómo dar prioridad a la investigación más valiosa sin dejar GPUs sin usar[Herramientas]Seis modelos de IA en una semana, sin escribir código: así funciona ML Intern[Modelos de IA]Liquid AI lanza dos modelos de IA que toman decisiones en 16 milisegundos[Investigación]Nvidia logra medalla de oro en dos olimpiadas científicas con el mismo modelo de IA[Modelos de IA]Un modelo de IA que habla árabe emiratí como un local[Herramientas]Hugging Face convierte su plataforma en un catálogo unificado de entornos para entrenar agentes de IA[Herramientas]Un benchmark de Microsoft exige que los agentes de IA funcionen bien veinte veces seguidas[Modelos de IA]Allen AI publica AstaBrief, un modelo abierto que redacta informes científicos con citas en un minuto[Investigación]ServiceNow crea un sistema que genera automáticamente tareas para entrenar agentes de IA empresariales[Investigación]Allen Institute publica Olmo-core 3, su infraestructura abierta para entrenar modelos gigantes de IA[Investigación]Cómo dar prioridad a la investigación más valiosa sin dejar GPUs sin usar[Herramientas]Seis modelos de IA en una semana, sin escribir código: así funciona ML Intern[Modelos de IA]Liquid AI lanza dos modelos de IA que toman decisiones en 16 milisegundos[Investigación]Nvidia logra medalla de oro en dos olimpiadas científicas con el mismo modelo de IA[Modelos de IA]Un modelo de IA que habla árabe emiratí como un local[Herramientas]Hugging Face convierte su plataforma en un catálogo unificado de entornos para entrenar agentes de IA[Herramientas]Un benchmark de Microsoft exige que los agentes de IA funcionen bien veinte veces seguidas[Modelos de IA]Allen AI publica AstaBrief, un modelo abierto que redacta informes científicos con citas en un minuto[Investigación]ServiceNow crea un sistema que genera automáticamente tareas para entrenar agentes de IA empresariales[Investigación]Allen Institute publica Olmo-core 3, su infraestructura abierta para entrenar modelos gigantes de IA
Transmitiendo · —

Noticias.
Inteligencia Artificial

Inteligencia Artificial para Gente Real · ES / PT-BR

Modelos de IAHugging Face Blog2 min

Nvidia lanza Nemotron 3 Nano Omni, un modelo de IA multimodal que cabe en tu ordenador

El nuevo modelo puede procesar texto, imágenes, audio y vídeo al mismo tiempo, funciona sin conexión a internet y está pensado para integrarse en asistentes locales y aplicaciones empresariales.

Por Redacción2 min
Compartir
Nvidia lanza Nemotron 3 Nano Omni, un modelo de IA multimodal que cabe en tu ordenador
Modelos de IA · Hugging Face Blog

Nvidia acaba de presentar Nemotron 3 Nano Omni, un modelo de inteligencia artificial multimodal (capaz de trabajar con varios tipos de datos a la vez: texto, imágenes, audio y vídeo) diseñado para funcionar en dispositivos locales, sin depender de la nube. Según informó Hugging Face en su blog oficial, este modelo destaca por su capacidad para procesar contextos largos —hasta 128.000 tokens, el equivalente a unas 300 páginas de texto— y por su eficiencia: requiere menos de 8 GB de memoria de vídeo (VRAM), lo que permite ejecutarlo en ordenadores personales o en pequeños servidores empresariales sin necesidad de hardware especializado.

El modelo forma parte de la familia Nemotron (una línea de modelos de IA desarrollados por Nvidia para aplicaciones empresariales) y está especialmente pensado para tareas que requieren entender documentos extensos, transcribir y resumir reuniones, o analizar vídeos completos. A diferencia de otros modelos multimodales recientes, como GPT-4o o Gemini (que funcionan principalmente a través de APIs en la nube), Nemotron 3 Nano Omni puede descargarse y ejecutarse en local, lo que resulta útil para empresas con requisitos estrictos de privacidad o conectividad limitada.

Nvidia ha liberado el modelo con una licencia de pesos abiertos (open weights), lo que significa que cualquiera puede descargarlo, usarlo y adaptarlo a sus necesidades, aunque no tiene acceso al código de entrenamiento ni a los datos originales. Está disponible en Hugging Face y puede ejecutarse en tarjetas gráficas de la serie RTX (las GPU de consumo de Nvidia, comunes en ordenadores de sobremesa) o en servidores con GPUs más potentes. La compañía también ha publicado una versión optimizada para inferencia (el proceso de usar un modelo ya entrenado para generar respuestas) mediante su tecnología TensorRT-LLM, que acelera las respuestas en hardware Nvidia.

El lanzamiento se produce en un momento en que varios fabricantes —desde Meta hasta Alibaba— compiten por ofrecer modelos multimodales eficientes que puedan funcionar fuera de la nube. Nemotron 3 Nano Omni se posiciona como una opción intermedia: no es tan pequeño como los modelos de menos de mil millones de parámetros (las unidades básicas de un modelo de IA, que determinan su complejidad) pensados para móviles, pero tampoco requiere los recursos de los modelos gigantes como Claude o GPT-4. Su ventaja está en el equilibrio entre capacidad multimodal, contexto largo y viabilidad técnica para ejecutarse en equipos accesibles.

Fuente original
Hugging Face Blog
Más en · Modelos de IA