En directo
[Investigación]Cómo dar prioridad a la investigación más valiosa sin dejar GPUs sin usar[Herramientas]Seis modelos de IA en una semana, sin escribir código: así funciona ML Intern[Modelos de IA]Liquid AI lanza dos modelos de IA que toman decisiones en 16 milisegundos[Investigación]Nvidia logra medalla de oro en dos olimpiadas científicas con el mismo modelo de IA[Modelos de IA]Un modelo de IA que habla árabe emiratí como un local[Herramientas]Hugging Face convierte su plataforma en un catálogo unificado de entornos para entrenar agentes de IA[Herramientas]Un benchmark de Microsoft exige que los agentes de IA funcionen bien veinte veces seguidas[Modelos de IA]Allen AI publica AstaBrief, un modelo abierto que redacta informes científicos con citas en un minuto[Investigación]ServiceNow crea un sistema que genera automáticamente tareas para entrenar agentes de IA empresariales[Investigación]Allen Institute publica Olmo-core 3, su infraestructura abierta para entrenar modelos gigantes de IA[Investigación]Cómo dar prioridad a la investigación más valiosa sin dejar GPUs sin usar[Herramientas]Seis modelos de IA en una semana, sin escribir código: así funciona ML Intern[Modelos de IA]Liquid AI lanza dos modelos de IA que toman decisiones en 16 milisegundos[Investigación]Nvidia logra medalla de oro en dos olimpiadas científicas con el mismo modelo de IA[Modelos de IA]Un modelo de IA que habla árabe emiratí como un local[Herramientas]Hugging Face convierte su plataforma en un catálogo unificado de entornos para entrenar agentes de IA[Herramientas]Un benchmark de Microsoft exige que los agentes de IA funcionen bien veinte veces seguidas[Modelos de IA]Allen AI publica AstaBrief, un modelo abierto que redacta informes científicos con citas en un minuto[Investigación]ServiceNow crea un sistema que genera automáticamente tareas para entrenar agentes de IA empresariales[Investigación]Allen Institute publica Olmo-core 3, su infraestructura abierta para entrenar modelos gigantes de IA
Transmitiendo · —

Noticias.
Inteligencia Artificial

Inteligencia Artificial para Gente Real · ES / PT-BR

Modelos de IAHugging Face Blog2 min

Nuevos modelos de IA de Liquid AI funcionan en tu ordenador sin GPU

La startup Liquid AI lanza modelos de lenguaje optimizados para procesadores convencionales, capaces de procesar textos largos sin necesidad de hardware especializado ni conexión a internet.

Por Redacción2 min
Compartir
Nuevos modelos de IA de Liquid AI funcionan en tu ordenador sin GPU
Modelos de IA · Hugging Face Blog

Liquid AI (una empresa fundada por investigadores del MIT centrada en arquitecturas de redes neuronales alternativas) acaba de publicar LFM2.5-Encoders, una familia de modelos de inteligencia artificial pensados específicamente para funcionar en procesadores convencionales (CPU), sin necesidad de tarjetas gráficas especializadas (GPU). Según informó la compañía en su blog de Hugging Face (una plataforma donde desarrolladores comparten y descargan modelos de IA ya entrenados), estos modelos pueden procesar documentos de hasta medio millón de palabras en cuestión de minutos usando solo el procesador de un ordenador normal.

La ventaja principal es la privacidad y la reducción de costes: al no depender de servidores externos ni de hardware caro, cualquier empresa puede ejecutar estos modelos en sus propios equipos para tareas como resumir documentos largos, buscar información en bases de datos internas o responder preguntas sobre contratos y manuales técnicos. Los modelos vienen en tres tamaños (40 millones, 154 millones y 300 millones de parámetros — números que indican la capacidad del modelo), todos diseñados para funcionar de forma eficiente en máquinas sin aceleración gráfica.

Liquid AI no usa la arquitectura Transformer (la estructura de red neuronal dominante desde que se inventó el GPT original), sino una variante propia llamada LFM (Liquid Foundation Model), basada en ecuaciones diferenciales que permiten procesar secuencias largas de texto sin consumir tanta memoria. Esto es clave para que funcionen en CPU: mientras que modelos tradicionales como GPT necesitan multiplicar matrices enormes (operación muy intensiva), estos aprovechan mejor los procesadores normales reduciendo la cantidad de cálculos redundantes.

Los tres modelos están disponibles bajo licencia Apache 2.0 (es decir, se pueden usar, modificar y comercializar libremente) y funcionan de forma óptima con frameworks (herramientas de software para ejecutar modelos de IA) que no requieren aceleración por GPU, como Candle o llama.cpp. La empresa destaca casos de uso en industrias reguladas — sanidad, finanzas, gobierno — donde enviar datos sensibles a servicios en la nube puede violar normativas de privacidad.

Aunque estos modelos están optimizados para comprensión y búsqueda de información (lo que se llama 'encoders'), no para generar texto como ChatGPT, representan un paso importante hacia la democratización de la IA: hasta ahora, usar modelos potentes en local requería invertir miles de euros en hardware especializado. Con LFM2.5-Encoders, cualquier portátil moderno puede ejecutar análisis complejos de documentos largos sin conexión a internet ni suscripciones mensuales.

Fuente original
Hugging Face Blog
Más en · Modelos de IA