En directo
[Regulación]¿Es legal entrenar modelos de IA con libros protegidos por derechos de autor?[Negocios]Una IA jefa despidió a su primer empleado humano, pero solo después de que le recordaran sus propias normas[Herramientas]Cómo una comunidad mexicana volvió al adobe para reconstruir sus casas tras el huracán Otis[Investigación]Recrean la materia del Big Bang con átomos más pequeños que nunca[Regulación]La empresa de cámaras de vigilancia Flock pide un 'acuerdo' con sus críticos tras la ola de rechazo[Herramientas]Los Nothing Ear (3a) demuestran que los auriculares baratos ya no suenan peor[Modelos de IA]Ox Alpha, el modelo de IA anónimo que nadie sabe quién ha creado[Investigación]Moderna logra resultados prometedores con una vacuna contra el melanoma diseñada con inteligencia artificial[Regulación]Estados Unidos presiona a sus aliados para que elijan bando en la carrera de la inteligencia artificial[Investigación]Cómo AlphaGo cambió la ciencia diez años después de ganar al campeón de Go[Regulación]¿Es legal entrenar modelos de IA con libros protegidos por derechos de autor?[Negocios]Una IA jefa despidió a su primer empleado humano, pero solo después de que le recordaran sus propias normas[Herramientas]Cómo una comunidad mexicana volvió al adobe para reconstruir sus casas tras el huracán Otis[Investigación]Recrean la materia del Big Bang con átomos más pequeños que nunca[Regulación]La empresa de cámaras de vigilancia Flock pide un 'acuerdo' con sus críticos tras la ola de rechazo[Herramientas]Los Nothing Ear (3a) demuestran que los auriculares baratos ya no suenan peor[Modelos de IA]Ox Alpha, el modelo de IA anónimo que nadie sabe quién ha creado[Investigación]Moderna logra resultados prometedores con una vacuna contra el melanoma diseñada con inteligencia artificial[Regulación]Estados Unidos presiona a sus aliados para que elijan bando en la carrera de la inteligencia artificial[Investigación]Cómo AlphaGo cambió la ciencia diez años después de ganar al campeón de Go
Transmitiendo ·

Noticias.
Inteligencia Artificial

Inteligencia Artificial para Gente Real · ES / PT-BR

Modelos de IAHugging Face Blog2 min

Liquid AI lanza un modelo de visión ultraligero que entiende imágenes en dispositivos sin internet

LFM2.5-VL-3B es un modelo de inteligencia artificial capaz de analizar imágenes y responder preguntas sobre ellas, optimizado para ejecutarse en ordenadores pequeños y baratos sin necesidad de conexión a la nube.

Por Redacción2 min
Compartir
Liquid AI lanza un modelo de visión ultraligero que entiende imágenes en dispositivos sin internet
Modelos de IA · Hugging Face Blog

Liquid AI (una startup fundada por investigadores del MIT especializada en arquitecturas eficientes de inteligencia artificial) acaba de publicar LFM2.5-VL-3B, un modelo de visión y lenguaje (es decir, capaz de interpretar imágenes y generar texto sobre ellas) pensado específicamente para ejecutarse en el "edge" (dispositivos locales como teléfonos, cámaras de seguridad o robots, sin depender de internet ni de servidores remotos). Según anunció la empresa en Hugging Face (una plataforma donde desarrolladores comparten y descargan modelos de IA ya entrenados), el modelo tiene solo 3.000 millones de parámetros (los valores numéricos que definen el comportamiento de un modelo de IA) pero ofrece un rendimiento comparable a modelos mucho más grandes en tareas de análisis visual.

La clave de LFM2.5-VL-3B está en su arquitectura basada en "Liquid Foundation Models" (LFM), un diseño que procesa la información de forma más eficiente que los transformers tradicionales (la arquitectura que usan modelos como GPT o Llama) y que permite ejecutar el modelo en hardware limitado, como las placas Jetson Nano de Nvidia (ordenadores del tamaño de una tarjeta de crédito pensados para aplicaciones de robótica e IA embebida). En pruebas internas, el modelo alcanzó un 73,4% de precisión en el benchmark VQAv2 (un test estándar que mide la capacidad de responder preguntas sobre imágenes), una cifra competitiva para un modelo de su tamaño y orientación.

Liquid AI ha publicado el modelo con "pesos abiertos" (lo que significa que cualquiera puede descargarlo y usarlo, aunque la licencia restringe usos comerciales sin permiso), junto con ejemplos de código para ejecutarlo en dispositivos ARM (la familia de procesadores que usan la mayoría de teléfonos y muchos ordenadores pequeños) y en aceleradores de Nvidia. La empresa destaca que el modelo puede realizar inferencia (el proceso de generar respuestas una vez entrenado) a velocidades de hasta 30 tokens por segundo en una Jetson Orin Nano, lo que lo hace viable para aplicaciones en tiempo real como asistentes robóticos o sistemas de vigilancia inteligente.

El lanzamiento se produce en un momento en que la industria busca alternativas a los grandes modelos que dependen de la nube, tanto por razones de privacidad (los datos de imagen no salen del dispositivo) como de costes operativos. Aunque LFM2.5-VL-3B aún no compite con los modelos más avanzados en tareas complejas, su combinación de tamaño reducido y rendimiento en el edge marca un paso relevante hacia la IA visual descentralizada, especialmente en sectores como salud, manufactura o agricultura de precisión, donde la latencia y la conectividad son limitaciones críticas.

Fuente original
Hugging Face Blog
Más en · Modelos de IA