Ao vivo
[Pesquisa]Como o Ai2 resolveu a briga por GPUs com orçamentos em vez de fila de prioridade[Ferramentas]Como criar modelos de IA personalizados por menos de US$ 20 usando um agente automatizado[Modelos de IA]Liquid AI lança modelos de IA que tomam decisões em milissegundos — e funcionam em celulares[Modelos de IA]TII lança Falcon ASR, modelo de transcrição de áudio aberto que roda em hardware comum[Modelos de IA]Nvidia mostra que um único modelo de IA pode chegar ao pódio tanto em programação quanto em matemática avançada[Modelos de IA]Falcon-Emirati: o modelo de IA que aprendeu a falar árabe como um emiradense de verdade[Ferramentas]Hugging Face cria repositório central para ambientes de IA que aprendem por tentativa e erro[Ferramentas]O agente de IA disse que terminou. O banco de dados discordou.[Modelos de IA]Instituto Allen lança modelo de IA aberto para escrever relatórios científicos em segundos[Pesquisa]Como a ServiceNow cria dados de treino que ensinam agentes de IA a funcionar dentro de empresas[Pesquisa]Como o Ai2 resolveu a briga por GPUs com orçamentos em vez de fila de prioridade[Ferramentas]Como criar modelos de IA personalizados por menos de US$ 20 usando um agente automatizado[Modelos de IA]Liquid AI lança modelos de IA que tomam decisões em milissegundos — e funcionam em celulares[Modelos de IA]TII lança Falcon ASR, modelo de transcrição de áudio aberto que roda em hardware comum[Modelos de IA]Nvidia mostra que um único modelo de IA pode chegar ao pódio tanto em programação quanto em matemática avançada[Modelos de IA]Falcon-Emirati: o modelo de IA que aprendeu a falar árabe como um emiradense de verdade[Ferramentas]Hugging Face cria repositório central para ambientes de IA que aprendem por tentativa e erro[Ferramentas]O agente de IA disse que terminou. O banco de dados discordou.[Modelos de IA]Instituto Allen lança modelo de IA aberto para escrever relatórios científicos em segundos[Pesquisa]Como a ServiceNow cria dados de treino que ensinam agentes de IA a funcionar dentro de empresas
Transmitindo · —

Notícias.
Inteligência Artificial

Inteligência Artificial para Gente de Verdade · ES / PT-BR

FerramentasHugging Face Blog2 min

Baseten se integra à Hugging Face para facilitar o uso de modelos de IA em produção

Plataforma de infraestrutura entra para o programa de provedores oficiais e promete rodar modelos de linguagem e imagem com menos fricção técnica.

Por Redação2 min
Compartilhar
Baseten se integra à Hugging Face para facilitar o uso de modelos de IA em produção
Ferramentas · Hugging Face Blog

A Hugging Face (plataforma onde desenvolvedores compartilham e baixam modelos de IA já treinados) anunciou a entrada da Baseten (empresa que vende infraestrutura pronta para rodar modelos de inteligência artificial) em seu programa de Inference Providers — uma lista de parceiros certificados para executar modelos hospedados na plataforma. Na prática, isso significa que quem usa a Hugging Face agora pode colocar seus modelos para rodar na infraestrutura da Baseten de forma mais direta, sem precisar configurar servidores do zero.

A Baseten se especializa em inferência (o processo de usar um modelo de IA já treinado para gerar respostas ou previsões em tempo real). A empresa oferece GPUs (chips especializados em processar cálculos de IA rapidamente) otimizadas para rodar desde modelos menores até LLMs grandes (large language models, os modelos de linguagem que geram texto, como o GPT), além de modelos de geração de imagens e vídeo. Segundo o anúncio, a integração permite usar a API da Hugging Face para acessar essa infraestrutura, o que reduz a complexidade para times que querem colocar modelos em produção sem montar uma operação própria de servidores.

O programa de Inference Providers foi criado para dar opções a quem precisa escalar o uso de modelos além do que a própria Hugging Face oferece em sua infraestrutura gratuita ou básica. Outros provedores do programa incluem nomes como AWS (Amazon Web Services, o braço de computação em nuvem da Amazon) e Google Cloud. A Baseten se posiciona como uma alternativa mais focada em desempenho para modelos específicos, com ferramentas de monitoramento e ajuste fino (fine-tuning, o processo de treinar um modelo existente com dados novos para melhorar seu desempenho em tarefas específicas).

A parceria interessa especialmente a startups e equipes de produto que querem testar ou lançar aplicações com IA generativa sem investir pesado em infraestrutura própria logo de cara. A Baseten cobra por uso, o que pode ser mais econômico para quem ainda está validando uma ideia do que manter servidores rodando o tempo todo. A integração já está disponível e pode ser acessada diretamente pelo painel da Hugging Face.

Fonte original
Hugging Face Blog
Mais em · Ferramentas