En directo
[Investigación]Cómo dar prioridad a la investigación más valiosa sin dejar GPUs sin usar[Herramientas]Seis modelos de IA en una semana, sin escribir código: así funciona ML Intern[Modelos de IA]Liquid AI lanza dos modelos de IA que toman decisiones en 16 milisegundos[Investigación]Nvidia logra medalla de oro en dos olimpiadas científicas con el mismo modelo de IA[Modelos de IA]Un modelo de IA que habla árabe emiratí como un local[Herramientas]Hugging Face convierte su plataforma en un catálogo unificado de entornos para entrenar agentes de IA[Herramientas]Un benchmark de Microsoft exige que los agentes de IA funcionen bien veinte veces seguidas[Modelos de IA]Allen AI publica AstaBrief, un modelo abierto que redacta informes científicos con citas en un minuto[Investigación]ServiceNow crea un sistema que genera automáticamente tareas para entrenar agentes de IA empresariales[Investigación]Allen Institute publica Olmo-core 3, su infraestructura abierta para entrenar modelos gigantes de IA[Investigación]Cómo dar prioridad a la investigación más valiosa sin dejar GPUs sin usar[Herramientas]Seis modelos de IA en una semana, sin escribir código: así funciona ML Intern[Modelos de IA]Liquid AI lanza dos modelos de IA que toman decisiones en 16 milisegundos[Investigación]Nvidia logra medalla de oro en dos olimpiadas científicas con el mismo modelo de IA[Modelos de IA]Un modelo de IA que habla árabe emiratí como un local[Herramientas]Hugging Face convierte su plataforma en un catálogo unificado de entornos para entrenar agentes de IA[Herramientas]Un benchmark de Microsoft exige que los agentes de IA funcionen bien veinte veces seguidas[Modelos de IA]Allen AI publica AstaBrief, un modelo abierto que redacta informes científicos con citas en un minuto[Investigación]ServiceNow crea un sistema que genera automáticamente tareas para entrenar agentes de IA empresariales[Investigación]Allen Institute publica Olmo-core 3, su infraestructura abierta para entrenar modelos gigantes de IA
Transmitiendo · —

Noticias.
Inteligencia Artificial

Inteligencia Artificial para Gente Real · ES / PT-BR

HerramientasHugging Face Blog2 min

Hugging Face automatiza la conversión de modelos de IA para chips Apple

La plataforma estrena una herramienta que traduce automáticamente miles de modelos de inteligencia artificial al formato MLX, optimizado para los procesadores M de Apple.

Por Redacción2 min
Compartir
Hugging Face automatiza la conversión de modelos de IA para chips Apple
Herramientas · Hugging Face Blog

Hugging Face (una plataforma donde desarrolladores comparten y descargan modelos de inteligencia artificial ya entrenados) ha lanzado una función que convierte automáticamente modelos de IA al formato MLX, el framework (conjunto de herramientas de programación) que Apple diseñó específicamente para ejecutar aprendizaje automático en sus chips M1, M2 y M3. La novedad elimina el trabajo manual que hasta ahora debían hacer los desarrolladores para adaptar estos modelos a ordenadores Mac.

Según informó Hugging Face en su blog oficial, la herramienta permite que cualquier modelo compatible con Transformers (la biblioteca de código abierto más usada para trabajar con modelos de lenguaje) pueda ejecutarse en hardware de Apple con solo añadir una etiqueta en su repositorio. El sistema genera automáticamente la versión MLX del modelo y la publica en un espacio separado dentro de la plataforma, sin que el desarrollador tenga que escribir una sola línea de código adicional.

MLX es una biblioteca de computación numérica que Apple presentó hace poco más de un año para aprovechar al máximo la arquitectura unificada de memoria de sus chips (donde CPU y GPU comparten la misma RAM, lo que acelera ciertos cálculos). Hasta ahora, convertir un modelo de PyTorch (el framework estándar en IA) a MLX requería conocimientos técnicos específicos y varias horas de trabajo manual, lo que limitaba el número de modelos disponibles para usuarios de Mac.

La automatización llega en un momento en que los modelos de lenguaje pequeños (SLM, versiones más ligeras de los grandes modelos como GPT-4) ganan popularidad para ejecutarse localmente en portátiles sin depender de la nube. Empresas como Apple, Microsoft y Meta han apostado por este enfoque, que ofrece más privacidad y reduce costes de computación en servidores remotos, pero que hasta ahora chocaba con la fragmentación de formatos y herramientas entre ecosistemas.

Hugging Face no ha especificado cuántos modelos se convertirán de forma retroactiva, pero la plataforma aloja actualmente más de 900.000 modelos públicos. La nueva función está disponible desde hoy para cualquier desarrollador que suba o mantenga modelos en la plataforma, y puede activarse con un simple cambio en los metadatos del repositorio.

Fuente original
Hugging Face Blog
Más en · Herramientas