En directo
[Investigación]Cómo dar prioridad a la investigación más valiosa sin dejar GPUs sin usar[Herramientas]Seis modelos de IA en una semana, sin escribir código: así funciona ML Intern[Modelos de IA]Liquid AI lanza dos modelos de IA que toman decisiones en 16 milisegundos[Investigación]Nvidia logra medalla de oro en dos olimpiadas científicas con el mismo modelo de IA[Modelos de IA]Un modelo de IA que habla árabe emiratí como un local[Herramientas]Hugging Face convierte su plataforma en un catálogo unificado de entornos para entrenar agentes de IA[Herramientas]Un benchmark de Microsoft exige que los agentes de IA funcionen bien veinte veces seguidas[Modelos de IA]Allen AI publica AstaBrief, un modelo abierto que redacta informes científicos con citas en un minuto[Investigación]ServiceNow crea un sistema que genera automáticamente tareas para entrenar agentes de IA empresariales[Investigación]Allen Institute publica Olmo-core 3, su infraestructura abierta para entrenar modelos gigantes de IA[Investigación]Cómo dar prioridad a la investigación más valiosa sin dejar GPUs sin usar[Herramientas]Seis modelos de IA en una semana, sin escribir código: así funciona ML Intern[Modelos de IA]Liquid AI lanza dos modelos de IA que toman decisiones en 16 milisegundos[Investigación]Nvidia logra medalla de oro en dos olimpiadas científicas con el mismo modelo de IA[Modelos de IA]Un modelo de IA que habla árabe emiratí como un local[Herramientas]Hugging Face convierte su plataforma en un catálogo unificado de entornos para entrenar agentes de IA[Herramientas]Un benchmark de Microsoft exige que los agentes de IA funcionen bien veinte veces seguidas[Modelos de IA]Allen AI publica AstaBrief, un modelo abierto que redacta informes científicos con citas en un minuto[Investigación]ServiceNow crea un sistema que genera automáticamente tareas para entrenar agentes de IA empresariales[Investigación]Allen Institute publica Olmo-core 3, su infraestructura abierta para entrenar modelos gigantes de IA
Transmitiendo · —

Noticias.
Inteligencia Artificial

Inteligencia Artificial para Gente Real · ES / PT-BR

Modelos de IAHugging Face Blog2 min

NVIDIA lanza Cosmos Reason 2, un modelo de IA que entiende el mundo físico

La compañía de chips presenta una familia de modelos capaces de razonar sobre vídeo y predecir consecuencias en el mundo real, pensados para robots y simulaciones

Por Redacción2 min
Compartir
NVIDIA lanza Cosmos Reason 2, un modelo de IA que entiende el mundo físico
Modelos de IA · Hugging Face Blog

NVIDIA ha presentado Cosmos Reason 2, una nueva familia de modelos de inteligencia artificial diseñados específicamente para entender y razonar sobre el mundo físico, según informó la compañía en el blog de Hugging Face (una plataforma donde desarrolladores comparten y descargan modelos de IA ya entrenados). A diferencia de los modelos de lenguaje como ChatGPT, que procesan texto, estos modelos trabajan con vídeo y pueden predecir qué ocurrirá cuando un objeto interactúa con otro — una capacidad crucial para robots, coches autónomos o simuladores industriales.

La familia incluye tres versiones con diferentes tamaños: 1.200 millones, 5.000 millones y 14.000 millones de parámetros (los valores internos que determinan el comportamiento del modelo). Todos ellos son modelos de pesos abiertos, lo que significa que cualquiera puede descargarlos, estudiar cómo funcionan y adaptarlos a sus propias necesidades sin pagar licencias. NVIDIA los ha entrenado usando una técnica llamada reinforcement learning (aprendizaje por refuerzo), donde el modelo aprende por ensayo y error, similar a cómo un niño aprende que soltar un vaso lo rompe.

Según NVIDIA, Cosmos Reason 2 destaca en tareas como predecir trayectorias de objetos, entender relaciones espaciales o anticipar el resultado de acciones físicas. Por ejemplo, si le muestras un vídeo de alguien empujando una caja hacia el borde de una mesa, el modelo puede inferir que la caja caerá. Esta capacidad de razonamiento espacial es lo que la compañía llama "IA física" (Physical AI), un término que agrupa modelos pensados para interactuar con el mundo real, no solo con datos abstractos.

Los modelos están disponibles en Hugging Face y pueden ejecutarse localmente en ordenadores con GPUs NVIDIA (procesadores gráficos especializados en cálculos de IA), lo que permite a desarrolladores probarlos sin depender de servidores en la nube. NVIDIA también ha publicado herramientas para evaluar el rendimiento de los modelos en tareas de razonamiento físico, incluyendo métricas (medidas de calidad) específicas para vídeo. La compañía no ha especificado con qué datos entrenó los modelos, aunque menciona que usaron vídeos sintéticos generados por su plataforma Cosmos, un simulador capaz de crear escenas realistas del mundo físico.

El lanzamiento llega en un momento en que varias empresas trabajan en IA para robótica — desde startups como Figure hasta gigantes como Tesla con su robot Optimus. La apuesta de NVIDIA es que los robots del futuro necesitarán modelos capaces de razonar sobre causa y efecto en el mundo real, no solo seguir instrucciones programadas. Cosmos Reason 2 es, en ese sentido, un intento de dar a las máquinas algo parecido a intuición física.

Fuente original
Hugging Face Blog
Más en · Modelos de IA