En directo
[Investigación]Cómo dar prioridad a la investigación más valiosa sin dejar GPUs sin usar[Herramientas]Seis modelos de IA en una semana, sin escribir código: así funciona ML Intern[Modelos de IA]Liquid AI lanza dos modelos de IA que toman decisiones en 16 milisegundos[Investigación]Nvidia logra medalla de oro en dos olimpiadas científicas con el mismo modelo de IA[Modelos de IA]Un modelo de IA que habla árabe emiratí como un local[Herramientas]Hugging Face convierte su plataforma en un catálogo unificado de entornos para entrenar agentes de IA[Herramientas]Un benchmark de Microsoft exige que los agentes de IA funcionen bien veinte veces seguidas[Modelos de IA]Allen AI publica AstaBrief, un modelo abierto que redacta informes científicos con citas en un minuto[Investigación]ServiceNow crea un sistema que genera automáticamente tareas para entrenar agentes de IA empresariales[Investigación]Allen Institute publica Olmo-core 3, su infraestructura abierta para entrenar modelos gigantes de IA[Investigación]Cómo dar prioridad a la investigación más valiosa sin dejar GPUs sin usar[Herramientas]Seis modelos de IA en una semana, sin escribir código: así funciona ML Intern[Modelos de IA]Liquid AI lanza dos modelos de IA que toman decisiones en 16 milisegundos[Investigación]Nvidia logra medalla de oro en dos olimpiadas científicas con el mismo modelo de IA[Modelos de IA]Un modelo de IA que habla árabe emiratí como un local[Herramientas]Hugging Face convierte su plataforma en un catálogo unificado de entornos para entrenar agentes de IA[Herramientas]Un benchmark de Microsoft exige que los agentes de IA funcionen bien veinte veces seguidas[Modelos de IA]Allen AI publica AstaBrief, un modelo abierto que redacta informes científicos con citas en un minuto[Investigación]ServiceNow crea un sistema que genera automáticamente tareas para entrenar agentes de IA empresariales[Investigación]Allen Institute publica Olmo-core 3, su infraestructura abierta para entrenar modelos gigantes de IA
Transmitiendo · —

Noticias.
Inteligencia Artificial

Inteligencia Artificial para Gente Real · ES / PT-BR

Modelos de IAHugging Face Blog3 min

Un modelo de IA pequeño que funciona en tu móvil sin internet

Liquid AI lanza LFM2.5-2.6B, un modelo ligero que puede ejecutarse en dispositivos económicos y responder preguntas complejas sin depender de la nube.

Por Redacción3 min
Compartir
Un modelo de IA pequeño que funciona en tu móvil sin internet
Modelos de IA · Hugging Face Blog

Liquid AI (una startup fundada por investigadores del MIT especializada en modelos de inteligencia artificial eficientes) acaba de publicar LFM2.5-2.6B, un modelo de lenguaje (un tipo de IA capaz de entender y generar texto) lo suficientemente pequeño como para funcionar en ordenadores de bolsillo, móviles de gama media e incluso en un Jetson Nano (un ordenador del tamaño de una tarjeta de crédito diseñado para ejecutar IA sin conexión a internet). Según informó la compañía en el blog de Hugging Face (una plataforma donde desarrolladores comparten y descargan modelos de IA ya entrenados), este modelo está optimizado para trabajar como agente de IA local: puede buscar información, ejecutar comandos y completar tareas sin enviar datos a servidores externos.

El nombre del modelo, LFM2.5-2.6B, hace referencia a sus 2.600 millones de parámetros (los valores ajustables que determinan cómo responde el modelo). Eso lo convierte en un modelo pequeño comparado con gigantes como GPT-4 o Claude, que tienen cientos de miles de millones de parámetros. Pero su ventaja no está en competir con ellos en tareas complejas, sino en poder ejecutarse en dispositivos con recursos limitados: consume menos de 4 GB de memoria RAM y funciona sin GPU (el tipo de procesador que normalmente necesitan los modelos grandes para operar con rapidez). Liquid AI ha publicado dos versiones del modelo, una estándar y otra ajustada mediante instrucciones (un proceso de entrenamiento que mejora la capacidad del modelo para seguir órdenes específicas).

El modelo destaca en dos áreas: razonamiento matemático y tareas de agente. En pruebas de referencia como GSM8K (un test con problemas matemáticos de primaria) y GPQA (preguntas de nivel universitario en ciencias), LFM2.5-2.6B supera a otros modelos de tamaño similar como Llama 3.2 3B o Phi-3.5-mini. Además, puede conectarse con herramientas externas y ejecutar comandos del sistema operativo, lo que lo hace útil para automatizar tareas en local: desde gestionar archivos hasta interactuar con APIs (interfaces que permiten a distintos programas comunicarse entre sí) sin necesidad de estar conectado a la nube.

Liquid AI ofrece dos formas de usar el modelo. La más sencilla es descargarlo directamente desde Hugging Face e integrarlo en aplicaciones mediante bibliotecas como Transformers (un conjunto de herramientas de código abierto para trabajar con modelos de lenguaje). La segunda opción es usar LM Studio (un programa gratuito que permite ejecutar modelos de IA en tu propio ordenador sin escribir código), que ya incluye LFM2.5-2.6B en su catálogo y permite probarlo con una interfaz gráfica similar a ChatGPT, pero completamente offline. Según la compañía, el modelo funciona en procesadores Intel de 12ª generación en adelante, en chips Apple Silicon (los procesadores que Apple diseña para sus Mac, iPhone y iPad) y en tarjetas gráficas NVIDIA con al menos 6 GB de memoria.

El lanzamiento se produce en medio de un debate creciente sobre los límites de los modelos gigantes. Mientras empresas como OpenAI o Anthropic apuestan por sistemas cada vez más grandes y costosos, proyectos como este demuestran que modelos más pequeños pueden ser útiles para casos de uso específicos: asistentes personales que funcionan sin conexión, herramientas de automatización en empresas que no quieren compartir datos sensibles con terceros, o dispositivos embebidos (aparatos con capacidad de procesamiento limitada, como robots o electrodomésticos inteligentes). Liquid AI no ha revelado con qué datos entrenó el modelo ni cuánto costó desarrollarlo, pero sí ha publicado los pesos del modelo con una licencia abierta (lo que significa que cualquiera puede descargarlo, modificarlo y usarlo comercialmente sin pagar).

Fuente original
Hugging Face Blog
Más en · Modelos de IA