En directo
[Investigación]Cómo dar prioridad a la investigación más valiosa sin dejar GPUs sin usar[Herramientas]Seis modelos de IA en una semana, sin escribir código: así funciona ML Intern[Modelos de IA]Liquid AI lanza dos modelos de IA que toman decisiones en 16 milisegundos[Investigación]Nvidia logra medalla de oro en dos olimpiadas científicas con el mismo modelo de IA[Modelos de IA]Un modelo de IA que habla árabe emiratí como un local[Herramientas]Hugging Face convierte su plataforma en un catálogo unificado de entornos para entrenar agentes de IA[Herramientas]Un benchmark de Microsoft exige que los agentes de IA funcionen bien veinte veces seguidas[Modelos de IA]Allen AI publica AstaBrief, un modelo abierto que redacta informes científicos con citas en un minuto[Investigación]ServiceNow crea un sistema que genera automáticamente tareas para entrenar agentes de IA empresariales[Investigación]Allen Institute publica Olmo-core 3, su infraestructura abierta para entrenar modelos gigantes de IA[Investigación]Cómo dar prioridad a la investigación más valiosa sin dejar GPUs sin usar[Herramientas]Seis modelos de IA en una semana, sin escribir código: así funciona ML Intern[Modelos de IA]Liquid AI lanza dos modelos de IA que toman decisiones en 16 milisegundos[Investigación]Nvidia logra medalla de oro en dos olimpiadas científicas con el mismo modelo de IA[Modelos de IA]Un modelo de IA que habla árabe emiratí como un local[Herramientas]Hugging Face convierte su plataforma en un catálogo unificado de entornos para entrenar agentes de IA[Herramientas]Un benchmark de Microsoft exige que los agentes de IA funcionen bien veinte veces seguidas[Modelos de IA]Allen AI publica AstaBrief, un modelo abierto que redacta informes científicos con citas en un minuto[Investigación]ServiceNow crea un sistema que genera automáticamente tareas para entrenar agentes de IA empresariales[Investigación]Allen Institute publica Olmo-core 3, su infraestructura abierta para entrenar modelos gigantes de IA
Transmitiendo · —

Noticias.
Inteligencia Artificial

Inteligencia Artificial para Gente Real · ES / PT-BR

Modelos de IAHugging Face Blog2 min

Waypoint-1: el primer modelo de IA que genera vídeo interactivo en tiempo real

Overworld presenta un sistema que permite controlar escenas generadas por inteligencia artificial mientras se reproducen, sin esperas ni renderizado previo.

Por Redacción2 min
Compartir
Waypoint-1: el primer modelo de IA que genera vídeo interactivo en tiempo real
Modelos de IA · Hugging Face Blog

La empresa Overworld ha lanzado Waypoint-1, un modelo de difusión de vídeo (un sistema de IA que genera imágenes en movimiento a partir de descripciones de texto o señales de control) capaz de crear escenas interactivas en tiempo real, según informó Hugging Face en su blog oficial. A diferencia de otros modelos de vídeo generativo que requieren minutos u horas para producir clips pregrabados, Waypoint-1 genera fotogramas (las imágenes individuales que forman un vídeo) sobre la marcha mientras el usuario interactúa con la escena, a velocidades de hasta 60 fotogramas por segundo en hardware de consumo.

El sistema permite controlar la cámara virtual, los objetos y el entorno de forma inmediata, como si estuvieras jugando a un videojuego, pero en lugar de utilizar gráficos 3D tradicionales, cada fotograma es generado por IA. Waypoint-1 acepta señales de control espacial —movimientos de cámara, posiciones de objetos, mapas de profundidad (información sobre la distancia de cada elemento en la escena)— y produce vídeo coherente sin artefactos visuales graves ni saltos bruscos entre fotogramas. Según Overworld, esto abre la puerta a experiencias interactivas totalmente generadas por IA, desde simuladores hasta juegos experimentales.

La clave técnica está en la arquitectura de difusión optimizada para inferencia (el proceso de ejecutar un modelo ya entrenado para generar nuevos contenidos) en tarjetas gráficas domésticas. Waypoint-1 funciona en GPUs NVIDIA de la serie RTX 40 (las tarjetas gráficas de consumo más recientes de NVIDIA, diseñadas para gaming y creación de contenido) y requiere menos memoria que otros modelos de vídeo generativo de tamaño comparable. Overworld ha publicado el código, los pesos del modelo (los parámetros ya entrenados que determinan cómo genera el vídeo) y ejemplos de uso en Hugging Face, permitiendo que investigadores y desarrolladores experimenten con la tecnología de forma abierta.

El proyecto llega en un momento de rápido avance en vídeo generativo. Empresas como Runway, Pika y Google han presentado modelos capaces de producir clips de alta calidad, pero casi todos funcionan de forma offline: el usuario introduce una descripción, espera el procesamiento y descarga el resultado final. Waypoint-1 es uno de los primeros sistemas en demostrar que la generación interactiva en tiempo real es técnicamente viable, aunque todavía con limitaciones en resolución y duración de las escenas. Overworld no ha anunciado planes comerciales inmediatos, pero el lanzamiento abierto sugiere interés en construir una comunidad de desarrolladores antes que un producto cerrado.

Fuente original
Hugging Face Blog
Más en · Modelos de IA