Baseten se integra à Hugging Face para facilitar o uso de modelos de IA em produção
Plataforma de infraestrutura entra para o programa de provedores oficiais e promete rodar modelos de linguagem e imagem com menos fricção técnica.

A Hugging Face (plataforma onde desenvolvedores compartilham e baixam modelos de IA já treinados) anunciou a entrada da Baseten (empresa que vende infraestrutura pronta para rodar modelos de inteligência artificial) em seu programa de Inference Providers — uma lista de parceiros certificados para executar modelos hospedados na plataforma. Na prática, isso significa que quem usa a Hugging Face agora pode colocar seus modelos para rodar na infraestrutura da Baseten de forma mais direta, sem precisar configurar servidores do zero.
A Baseten se especializa em inferência (o processo de usar um modelo de IA já treinado para gerar respostas ou previsões em tempo real). A empresa oferece GPUs (chips especializados em processar cálculos de IA rapidamente) otimizadas para rodar desde modelos menores até LLMs grandes (large language models, os modelos de linguagem que geram texto, como o GPT), além de modelos de geração de imagens e vídeo. Segundo o anúncio, a integração permite usar a API da Hugging Face para acessar essa infraestrutura, o que reduz a complexidade para times que querem colocar modelos em produção sem montar uma operação própria de servidores.
O programa de Inference Providers foi criado para dar opções a quem precisa escalar o uso de modelos além do que a própria Hugging Face oferece em sua infraestrutura gratuita ou básica. Outros provedores do programa incluem nomes como AWS (Amazon Web Services, o braço de computação em nuvem da Amazon) e Google Cloud. A Baseten se posiciona como uma alternativa mais focada em desempenho para modelos específicos, com ferramentas de monitoramento e ajuste fino (fine-tuning, o processo de treinar um modelo existente com dados novos para melhorar seu desempenho em tarefas específicas).
A parceria interessa especialmente a startups e equipes de produto que querem testar ou lançar aplicações com IA generativa sem investir pesado em infraestrutura própria logo de cara. A Baseten cobra por uso, o que pode ser mais econômico para quem ainda está validando uma ideia do que manter servidores rodando o tempo todo. A integração já está disponível e pode ser acessada diretamente pelo painel da Hugging Face.

