IBM lanza Granite 4.0 Nano, un modelo de IA que cabe en un móvil
Con apenas 400 millones de parámetros, este modelo de lenguaje de código abierto puede ejecutarse en dispositivos con solo 512 MB de RAM, desde smartphones antiguos hasta microcontroladores.

IBM acaba de publicar Granite 4.0 Nano, probablemente el modelo de lenguaje de uso general más pequeño del mercado. Con entre 419 y 627 millones de parámetros (los valores numéricos que determinan cómo funciona un modelo de IA), este modelo puede ejecutarse en dispositivos con tan solo 512 MB de memoria RAM, algo impensable hace apenas un año. Para hacerse una idea: un iPhone 6 de 2014 tiene 1 GB de RAM, y este modelo necesita la mitad.
La familia Granite 4.0 Nano incluye tres versiones especializadas. La más básica está pensada para tareas generales de texto, mientras que las otras dos incorporan capacidades de razonamiento matemático y de programación. Según las pruebas publicadas por IBM en colaboración con Hugging Face (una plataforma donde desarrolladores comparten y descargan modelos de IA ya entrenados), el modelo supera en rendimiento a otros de su tamaño en benchmarks estándar (pruebas comparativas que miden la capacidad de los modelos para responder preguntas, resolver problemas lógicos o generar código).
Lo más llamativo es dónde puede ejecutarse. IBM ha demostrado que Granite 4.0 Nano funciona en un Jetson Nano (un ordenador del tamaño de una tarjeta de crédito diseñado para proyectos de robótica e IA), en un Raspberry Pi 5 (un ordenador barato muy popular entre aficionados y educadores) e incluso en microcontroladores ESP32 (chips que cuestan menos de 10 euros y se usan en sensores, drones o dispositivos domésticos inteligentes). En este último caso, el modelo tarda unos 11 segundos en generar cada palabra, pero funciona sin conexión a internet.
IBM ha liberado el código fuente y los pesos del modelo (los datos del entrenamiento que permiten a otros usar o modificar el modelo) bajo licencia Apache 2.0, lo que permite su uso comercial sin restricciones. La compañía ve este lanzamiento como una apuesta por la IA on-device (que se ejecuta directamente en el dispositivo del usuario, sin enviar datos a la nube), especialmente útil en entornos donde no hay conexión estable, se requiere privacidad absoluta o el coste de enviar datos a servidores remotos es prohibitivo.
El anuncio se produce en un momento en que varias empresas buscan reducir el tamaño de los modelos de lenguaje sin sacrificar demasiada capacidad. Microsoft presentó recientemente Phi-4 (un modelo compacto optimizado para razonamiento), y Meta ha trabajado en versiones ligeras de Llama para móviles. Sin embargo, Granite 4.0 Nano va un paso más allá en miniaturización: mientras la mayoría de estos modelos requieren al menos 2 GB de RAM, IBM ha conseguido bajar a 512 MB manteniendo un rendimiento competitivo en tareas básicas.
Los casos de uso más evidentes están en el Internet de las Cosas (IoT, la red de objetos cotidianos conectados a internet, desde frigoríficos hasta sensores industriales), asistentes de voz que funcionan sin conexión, traducción automática en dispositivos baratos o herramientas educativas en regiones con infraestructura limitada. IBM ya está trabajando con varios socios para integrar el modelo en productos comerciales, aunque no ha dado detalles concretos ni fechas.


