En directo
[Regulación]¿Es legal entrenar modelos de IA con libros protegidos por derechos de autor?[Negocios]Una IA jefa despidió a su primer empleado humano, pero solo después de que le recordaran sus propias normas[Herramientas]Cómo una comunidad mexicana volvió al adobe para reconstruir sus casas tras el huracán Otis[Investigación]Recrean la materia del Big Bang con átomos más pequeños que nunca[Regulación]La empresa de cámaras de vigilancia Flock pide un 'acuerdo' con sus críticos tras la ola de rechazo[Herramientas]Los Nothing Ear (3a) demuestran que los auriculares baratos ya no suenan peor[Modelos de IA]Ox Alpha, el modelo de IA anónimo que nadie sabe quién ha creado[Investigación]Moderna logra resultados prometedores con una vacuna contra el melanoma diseñada con inteligencia artificial[Regulación]Estados Unidos presiona a sus aliados para que elijan bando en la carrera de la inteligencia artificial[Investigación]Cómo AlphaGo cambió la ciencia diez años después de ganar al campeón de Go[Regulación]¿Es legal entrenar modelos de IA con libros protegidos por derechos de autor?[Negocios]Una IA jefa despidió a su primer empleado humano, pero solo después de que le recordaran sus propias normas[Herramientas]Cómo una comunidad mexicana volvió al adobe para reconstruir sus casas tras el huracán Otis[Investigación]Recrean la materia del Big Bang con átomos más pequeños que nunca[Regulación]La empresa de cámaras de vigilancia Flock pide un 'acuerdo' con sus críticos tras la ola de rechazo[Herramientas]Los Nothing Ear (3a) demuestran que los auriculares baratos ya no suenan peor[Modelos de IA]Ox Alpha, el modelo de IA anónimo que nadie sabe quién ha creado[Investigación]Moderna logra resultados prometedores con una vacuna contra el melanoma diseñada con inteligencia artificial[Regulación]Estados Unidos presiona a sus aliados para que elijan bando en la carrera de la inteligencia artificial[Investigación]Cómo AlphaGo cambió la ciencia diez años después de ganar al campeón de Go
Transmitiendo ·

Noticias.
Inteligencia Artificial

Inteligencia Artificial para Gente Real · ES / PT-BR

Modelos de IAHugging Face Blog2 min

Nvidia lanza Nemotron 3 Nano Omni, un modelo de IA multimodal que cabe en tu ordenador

El nuevo modelo puede procesar texto, imágenes, audio y vídeo al mismo tiempo, funciona sin conexión a internet y está pensado para integrarse en asistentes locales y aplicaciones empresariales.

Por Redacción2 min
Compartir
Nvidia lanza Nemotron 3 Nano Omni, un modelo de IA multimodal que cabe en tu ordenador
Modelos de IA · Hugging Face Blog

Nvidia acaba de presentar Nemotron 3 Nano Omni, un modelo de inteligencia artificial multimodal (capaz de trabajar con varios tipos de datos a la vez: texto, imágenes, audio y vídeo) diseñado para funcionar en dispositivos locales, sin depender de la nube. Según informó Hugging Face en su blog oficial, este modelo destaca por su capacidad para procesar contextos largos —hasta 128.000 tokens, el equivalente a unas 300 páginas de texto— y por su eficiencia: requiere menos de 8 GB de memoria de vídeo (VRAM), lo que permite ejecutarlo en ordenadores personales o en pequeños servidores empresariales sin necesidad de hardware especializado.

El modelo forma parte de la familia Nemotron (una línea de modelos de IA desarrollados por Nvidia para aplicaciones empresariales) y está especialmente pensado para tareas que requieren entender documentos extensos, transcribir y resumir reuniones, o analizar vídeos completos. A diferencia de otros modelos multimodales recientes, como GPT-4o o Gemini (que funcionan principalmente a través de APIs en la nube), Nemotron 3 Nano Omni puede descargarse y ejecutarse en local, lo que resulta útil para empresas con requisitos estrictos de privacidad o conectividad limitada.

Nvidia ha liberado el modelo con una licencia de pesos abiertos (open weights), lo que significa que cualquiera puede descargarlo, usarlo y adaptarlo a sus necesidades, aunque no tiene acceso al código de entrenamiento ni a los datos originales. Está disponible en Hugging Face y puede ejecutarse en tarjetas gráficas de la serie RTX (las GPU de consumo de Nvidia, comunes en ordenadores de sobremesa) o en servidores con GPUs más potentes. La compañía también ha publicado una versión optimizada para inferencia (el proceso de usar un modelo ya entrenado para generar respuestas) mediante su tecnología TensorRT-LLM, que acelera las respuestas en hardware Nvidia.

El lanzamiento se produce en un momento en que varios fabricantes —desde Meta hasta Alibaba— compiten por ofrecer modelos multimodales eficientes que puedan funcionar fuera de la nube. Nemotron 3 Nano Omni se posiciona como una opción intermedia: no es tan pequeño como los modelos de menos de mil millones de parámetros (las unidades básicas de un modelo de IA, que determinan su complejidad) pensados para móviles, pero tampoco requiere los recursos de los modelos gigantes como Claude o GPT-4. Su ventaja está en el equilibrio entre capacidad multimodal, contexto largo y viabilidad técnica para ejecutarse en equipos accesibles.

Fuente original
Hugging Face Blog
Más en · Modelos de IA