En directo
[Investigación]Cómo dar prioridad a la investigación más valiosa sin dejar GPUs sin usar[Herramientas]Seis modelos de IA en una semana, sin escribir código: así funciona ML Intern[Modelos de IA]Liquid AI lanza dos modelos de IA que toman decisiones en 16 milisegundos[Investigación]Nvidia logra medalla de oro en dos olimpiadas científicas con el mismo modelo de IA[Modelos de IA]Un modelo de IA que habla árabe emiratí como un local[Herramientas]Hugging Face convierte su plataforma en un catálogo unificado de entornos para entrenar agentes de IA[Herramientas]Un benchmark de Microsoft exige que los agentes de IA funcionen bien veinte veces seguidas[Modelos de IA]Allen AI publica AstaBrief, un modelo abierto que redacta informes científicos con citas en un minuto[Investigación]ServiceNow crea un sistema que genera automáticamente tareas para entrenar agentes de IA empresariales[Investigación]Allen Institute publica Olmo-core 3, su infraestructura abierta para entrenar modelos gigantes de IA[Investigación]Cómo dar prioridad a la investigación más valiosa sin dejar GPUs sin usar[Herramientas]Seis modelos de IA en una semana, sin escribir código: así funciona ML Intern[Modelos de IA]Liquid AI lanza dos modelos de IA que toman decisiones en 16 milisegundos[Investigación]Nvidia logra medalla de oro en dos olimpiadas científicas con el mismo modelo de IA[Modelos de IA]Un modelo de IA que habla árabe emiratí como un local[Herramientas]Hugging Face convierte su plataforma en un catálogo unificado de entornos para entrenar agentes de IA[Herramientas]Un benchmark de Microsoft exige que los agentes de IA funcionen bien veinte veces seguidas[Modelos de IA]Allen AI publica AstaBrief, un modelo abierto que redacta informes científicos con citas en un minuto[Investigación]ServiceNow crea un sistema que genera automáticamente tareas para entrenar agentes de IA empresariales[Investigación]Allen Institute publica Olmo-core 3, su infraestructura abierta para entrenar modelos gigantes de IA
Transmitiendo · —

Noticias.
Inteligencia Artificial

Inteligencia Artificial para Gente Real · ES / PT-BR

HerramientasHugging Face Blog2 min

DeepInfra se integra en Hugging Face para ejecutar modelos de IA de forma más rápida y barata

La plataforma de inferencia ahora permite a los desarrolladores desplegar modelos desde Hugging Face con un solo clic, sin necesidad de gestionar servidores propios.

Por Redacción2 min
Compartir
DeepInfra se integra en Hugging Face para ejecutar modelos de IA de forma más rápida y barata
Herramientas · Hugging Face Blog

Hugging Face (una plataforma donde desarrolladores comparten y descargan modelos de IA ya entrenados) ha anunciado la integración de DeepInfra en su programa Inference Providers. Esto significa que cualquier modelo alojado en Hugging Face puede ejecutarse ahora en la infraestructura de DeepInfra (un servicio especializado en hacer funcionar modelos de IA de forma optimizada, con servidores repartidos en varias regiones del mundo) sin que el desarrollador tenga que configurar nada manualmente.

DeepInfra destaca por ofrecer precios competitivos y tiempos de respuesta rápidos, especialmente al ejecutar LLMs (modelos de lenguaje grandes, como GPT o Llama, capaces de generar y entender texto) y modelos de generación de imágenes. Según informó Hugging Face en su blog oficial, la empresa opera con GPUs (procesadores especializados en cálculos masivos, necesarios para ejecutar modelos de IA) de última generación distribuidas globalmente, lo que reduce la latencia (el tiempo que tarda el modelo en responder) para usuarios en diferentes regiones.

La integración se produce en un momento en que muchos equipos buscan alternativas a las APIs (interfaces de programación que permiten usar un servicio sin instalar nada localmente) de las grandes tecnológicas, ya sea por costes, privacidad o para evitar depender de un único proveedor. Con esta alianza, un desarrollador puede subir un modelo a Hugging Face y, con un par de clics, desplegarlo en DeepInfra sin tocar una línea de código de infraestructura.

El programa Inference Providers de Hugging Face incluye ya a otros servicios similares, pero DeepInfra se suma con una propuesta centrada en rendimiento y precio por token (la unidad mínima de texto que procesa un modelo; cuanto más barato el token, menos cuesta usar el modelo). Esto puede resultar especialmente útil para startups y equipos pequeños que necesitan escalar sin asumir costes prohibitivos o contratar ingenieros especializados en DevOps (el área que se ocupa de gestionar servidores y automatizar despliegues).

Fuente original
Hugging Face Blog
Más en · Herramientas