Baseten se une a Hugging Face para facilitar el despliegue de modelos de IA
La plataforma de infraestructura para IA se integra como proveedor oficial, permitiendo ejecutar modelos con una sola línea de código.

Hugging Face (la plataforma donde desarrolladores comparten y descargan modelos de IA ya entrenados) acaba de incorporar a Baseten como proveedor oficial de inferencia (el proceso de usar un modelo de IA ya entrenado para hacer predicciones o generar respuestas). La integración permite a quienes desarrollan aplicaciones ejecutar miles de modelos alojados en Hugging Face directamente desde la infraestructura de Baseten, sin necesidad de configurar servidores propios ni gestionar la capacidad de cómputo.
Baseten se especializa en ofrecer infraestructura lista para usar en el despliegue de modelos de IA, especialmente LLMs (modelos de lenguaje de gran tamaño, como GPT o Llama). La empresa promete tiempos de arranque rápidos y escalado automático: si una aplicación recibe más peticiones de las esperadas, Baseten añade capacidad al instante; si baja la demanda, la reduce para no desperdiciar recursos. Según el anuncio, la integración con Hugging Face hace posible desplegar un modelo con una única línea de código usando la API estándar de Hugging Face.
La novedad es especialmente útil para equipos pequeños o startups que quieren probar modelos de pesos abiertos (modelos cuyo código y parámetros internos son públicos y modificables) sin invertir en infraestructura propia. Hasta ahora, ejecutar un modelo de IA en producción implicaba configurar servidores, ajustar GPUs (procesadores especializados en cálculos masivos en paralelo) y mantener todo funcionando. Con esta alianza, Hugging Face ofrece una opción más para quienes prefieren pagar por uso en lugar de montar su propio sistema.
Baseten se suma así a otros proveedores de inferencia ya integrados en Hugging Face, como AWS, Google Cloud y Together AI. La competencia en este segmento se ha intensificado en los últimos meses: cada vez más empresas ofrecen infraestructura especializada para ejecutar modelos de IA a escala, apostando por la comodidad y la velocidad de despliegue como ventajas competitivas frente a soluciones caseras.


