En directo
[Modelos de IA]Google lanza PaliGemma 2 Mix, modelos de visión multilingües que entienden imágenes en nueve idiomas[Investigación]DABStep, un nuevo test para medir si los agentes de IA resuelven tareas complejas de verdad[Investigación]OpenAI cuestiona la fiabilidad de un test de referencia para medir la habilidad de programación de los modelos de IA[Investigación]Científicos usan AlphaFold para diseñar cultivos resistentes al calor[Herramientas]OpenAI lanza ChatGPT Work, un asistente que completa proyectos enteros por ti[Modelos de IA]Falcon-H1: la familia de modelos de lenguaje que mezcla arquitecturas para ganar velocidad sin perder calidad[Investigación]AlphaFold desvela la estructura de una proteína clave en las enfermedades cardíacas[Herramientas]Microsoft y Hugging Face profundizan su alianza para facilitar el despliegue de modelos de IA[Modelos de IA]Falcon-Edge: modelos de lenguaje de 1,58 bits que caben en un móvil[Herramientas]Hugging Face y Kaggle facilitan el uso compartido de modelos de inteligencia artificial[Modelos de IA]Google lanza PaliGemma 2 Mix, modelos de visión multilingües que entienden imágenes en nueve idiomas[Investigación]DABStep, un nuevo test para medir si los agentes de IA resuelven tareas complejas de verdad[Investigación]OpenAI cuestiona la fiabilidad de un test de referencia para medir la habilidad de programación de los modelos de IA[Investigación]Científicos usan AlphaFold para diseñar cultivos resistentes al calor[Herramientas]OpenAI lanza ChatGPT Work, un asistente que completa proyectos enteros por ti[Modelos de IA]Falcon-H1: la familia de modelos de lenguaje que mezcla arquitecturas para ganar velocidad sin perder calidad[Investigación]AlphaFold desvela la estructura de una proteína clave en las enfermedades cardíacas[Herramientas]Microsoft y Hugging Face profundizan su alianza para facilitar el despliegue de modelos de IA[Modelos de IA]Falcon-Edge: modelos de lenguaje de 1,58 bits que caben en un móvil[Herramientas]Hugging Face y Kaggle facilitan el uso compartido de modelos de inteligencia artificial
Transmitiendo ·

Noticias.
Inteligencia Artificial

Inteligencia Artificial para Gente Real · ES / PT-BR

InvestigaciónGoogle DeepMind Blog2 min

Google presenta SIMA 2, un agente de IA capaz de razonar y actuar en mundos virtuales en 3D

El nuevo agente de inteligencia artificial de DeepMind puede entender instrucciones, planificar acciones y colaborar con personas en entornos interactivos gracias a la tecnología Gemini.

Por Redacción2 min
En resumen

SIMA 2 es un agente de inteligencia artificial desarrollado por Google DeepMind que puede entender instrucciones en lenguaje natural, razonar sobre sus acciones y colaborar con personas en entornos virtuales tridimensionales. Funciona gracias a Gemini, el modelo multimodal de Google que procesa texto, imagen y video, y aprende observando como los usuarios resuelven problemas en tiempo real dentro de mundos interactivos.

Compartir
Google presenta SIMA 2, un agente de IA capaz de razonar y actuar en mundos virtuales en 3D
Investigación · Google DeepMind Blog

Google DeepMind ha presentado SIMA 2, un agente de inteligencia artificial (un programa capaz de tomar decisiones y realizar tareas de forma autónoma) que puede moverse, razonar y colaborar con usuarios humanos dentro de mundos virtuales en 3D. A diferencia de sistemas anteriores que se limitaban a seguir instrucciones simples, SIMA 2 combina comprensión del lenguaje natural, planificación de acciones y capacidad de aprendizaje en tiempo real, según informó Google DeepMind en su blog oficial.

El agente está impulsado por Gemini (el modelo de lenguaje e imagen multimodal de Google, capaz de procesar texto, imágenes y vídeo simultáneamente), lo que le permite interpretar lo que ve en un entorno virtual, entender instrucciones en lenguaje cotidiano y ejecutar secuencias complejas de acciones. Por ejemplo, puede ayudar a un jugador a construir una estructura en un videojuego, explorar un entorno desconocido siguiendo indicaciones verbales o adaptarse a cambios en las reglas del mundo virtual sin necesidad de reprogramación.

SIMA son las siglas de Scalable Instructable Multiworld Agent (agente escalable e instruible para múltiples mundos), un proyecto que DeepMind lleva desarrollando desde 2023 con el objetivo de crear sistemas de IA que funcionen en entornos interactivos diversos, no solo en uno específico. La versión anterior, SIMA 1, podía ejecutar tareas básicas en varios videojuegos comerciales, pero SIMA 2 añade razonamiento explícito: el agente puede explicar por qué toma una decisión, anticipar consecuencias y ajustar su estrategia sobre la marcha.

Una de las novedades clave es que SIMA 2 aprende de la interacción con humanos. Durante las pruebas, el agente mejoró su rendimiento observando cómo usuarios reales resolvían problemas en entornos 3D, un enfoque que DeepMind llama aprendizaje por imitación interactiva. Esto lo diferencia de sistemas que solo se entrenan con datos estáticos: SIMA 2 puede incorporar feedback en directo y adaptar su comportamiento sin necesidad de volver a entrenarse desde cero.

Aunque por ahora SIMA 2 funciona exclusivamente en mundos virtuales controlados, Google sugiere que este tipo de agentes podría aplicarse en el futuro a simulaciones de entrenamiento, asistentes virtuales más complejos o herramientas de diseño 3D colaborativo. La compañía no ha anunciado fecha de lanzamiento comercial ni acceso público al sistema, que de momento sigue en fase de investigación. El proyecto forma parte de la estrategia más amplia de DeepMind para desarrollar IA capaz de razonar y actuar en entornos abiertos, un desafío que la industria considera uno de los pasos clave hacia sistemas de inteligencia artificial más generales.

Más en · Investigación