Nvidia entrena una IA para simular cirugías robóticas en tiempo real
El modelo Cosmos-H-Dreams genera vídeos realistas de operaciones quirúrgicas a partir de los movimientos de un robot, permitiendo entrenar sistemas sin necesidad de pacientes reales.

Nvidia ha presentado Cosmos-H-Dreams, un modelo de inteligencia artificial capaz de generar simulaciones realistas de cirugías robóticas en tiempo real. El sistema, desarrollado en colaboración con investigadores de la Universidad Johns Hopkins, crea vídeos que muestran cómo se vería una operación mientras el cirujano maneja los controles de un robot quirúrgico, sin necesidad de estar operando a un paciente real. Según informó Hugging Face en su blog oficial, el modelo funciona como un «gemelo digital» (una réplica virtual que imita el comportamiento del mundo real) del sistema quirúrgico Da Vinci, uno de los robots más utilizados en hospitales.
La clave del proyecto es que permite entrenar a cirujanos y a sistemas de IA sin riesgos. Tradicionalmente, los robots quirúrgicos aprenden observando cientos de operaciones reales, un proceso lento y costoso que depende de datos muy limitados. Cosmos-H-Dreams invierte la lógica: en lugar de grabar cirugías, genera vídeos sintéticos a partir de las acciones del robot. El modelo recibe como entrada la posición de los instrumentos quirúrgicos y produce un vídeo de alta calidad que muestra cómo interactuarían con el tejido humano, incluyendo detalles como sangrado, cortes o suturas.
El modelo se basa en Cosmos (una familia de modelos de Nvidia diseñados para generar mundos virtuales a partir de datos físicos) y fue entrenado con grabaciones de cirugías reales del sistema Da Vinci. Los investigadores utilizaron un conjunto de datos llamado JIGSAWS, que contiene vídeos de ejercicios quirúrgicos básicos como hacer nudos o pasar agujas. A partir de esos ejemplos, Cosmos-H-Dreams aprendió a predecir cómo se vería cada fotograma siguiente en función de los movimientos del cirujano, logrando generar secuencias fluidas a 30 fotogramas por segundo en una GPU Nvidia H100 (un procesador gráfico potente diseñado para entrenar y ejecutar modelos de IA).
El sistema no solo sirve para entrenar humanos. Nvidia plantea que estos vídeos sintéticos pueden usarse para entrenar agentes de IA (sistemas autónomos que toman decisiones y ejecutan tareas) capaces de asistir en cirugías o incluso realizarlas de forma autónoma en el futuro. Al generar millones de escenarios quirúrgicos virtuales, los desarrolladores pueden crear bancos de datos mucho más grandes y diversos que los disponibles en hospitales, acelerando el desarrollo de robots quirúrgicos inteligentes sin comprometer la seguridad de los pacientes.
El proyecto forma parte de un esfuerzo más amplio de Nvidia por aplicar IA generativa a la simulación de entornos físicos complejos, desde robots industriales hasta vehículos autónomos. Aunque Cosmos-H-Dreams aún es una demostración técnica y no está aprobado para uso clínico, demuestra cómo los modelos de generación de vídeo pueden ir más allá del entretenimiento y convertirse en herramientas de entrenamiento en campos donde los datos reales son escasos o imposibles de obtener de forma segura.


