Ao vivo
[Pesquisa]Como o Ai2 resolveu a briga por GPUs com orçamentos em vez de fila de prioridade[Ferramentas]Como criar modelos de IA personalizados por menos de US$ 20 usando um agente automatizado[Modelos de IA]Liquid AI lança modelos de IA que tomam decisões em milissegundos — e funcionam em celulares[Modelos de IA]TII lança Falcon ASR, modelo de transcrição de áudio aberto que roda em hardware comum[Modelos de IA]Nvidia mostra que um único modelo de IA pode chegar ao pódio tanto em programação quanto em matemática avançada[Modelos de IA]Falcon-Emirati: o modelo de IA que aprendeu a falar árabe como um emiradense de verdade[Ferramentas]Hugging Face cria repositório central para ambientes de IA que aprendem por tentativa e erro[Ferramentas]O agente de IA disse que terminou. O banco de dados discordou.[Modelos de IA]Instituto Allen lança modelo de IA aberto para escrever relatórios científicos em segundos[Pesquisa]Como a ServiceNow cria dados de treino que ensinam agentes de IA a funcionar dentro de empresas[Pesquisa]Como o Ai2 resolveu a briga por GPUs com orçamentos em vez de fila de prioridade[Ferramentas]Como criar modelos de IA personalizados por menos de US$ 20 usando um agente automatizado[Modelos de IA]Liquid AI lança modelos de IA que tomam decisões em milissegundos — e funcionam em celulares[Modelos de IA]TII lança Falcon ASR, modelo de transcrição de áudio aberto que roda em hardware comum[Modelos de IA]Nvidia mostra que um único modelo de IA pode chegar ao pódio tanto em programação quanto em matemática avançada[Modelos de IA]Falcon-Emirati: o modelo de IA que aprendeu a falar árabe como um emiradense de verdade[Ferramentas]Hugging Face cria repositório central para ambientes de IA que aprendem por tentativa e erro[Ferramentas]O agente de IA disse que terminou. O banco de dados discordou.[Modelos de IA]Instituto Allen lança modelo de IA aberto para escrever relatórios científicos em segundos[Pesquisa]Como a ServiceNow cria dados de treino que ensinam agentes de IA a funcionar dentro de empresas
Transmitindo · —

Notícias.
Inteligência Artificial

Inteligência Artificial para Gente de Verdade · ES / PT-BR

FerramentasHugging Face Blog2 min

DeepInfra agora roda modelos de IA direto na Hugging Face — e promete ser mais barato

A parceria permite que desenvolvedores usem centenas de modelos de linguagem e imagem pagando apenas pelo que processam, sem configurar servidores próprios.

Por Redação2 min
Compartilhar
DeepInfra agora roda modelos de IA direto na Hugging Face — e promete ser mais barato
Ferramentas · Hugging Face Blog

A Hugging Face (uma plataforma onde desenvolvedores compartilham e baixam modelos de IA já treinados) acaba de adicionar a DeepInfra como provedora oficial de inferência (ou seja, de execução de modelos). Na prática, isso significa que qualquer pessoa pode agora rodar modelos de inteligência artificial — desde o Llama 3.1 (um LLM de código aberto feito pela Meta) até geradores de imagem como o Stable Diffusion — sem precisar montar a própria infraestrutura de servidores. Você paga apenas pelo que usar, e a DeepInfra promete preços até 10 vezes menores que a concorrência em alguns casos.

A DeepInfra oferece acesso a mais de 200 modelos, incluindo LLMs (modelos de linguagem grandes, como o GPT), modelos de visão computacional (que analisam imagens), de fala e de embedding (que transformam texto em representações numéricas úteis para buscas ou recomendações). Segundo informou a Hugging Face, a empresa usa GPUs (chips especializados em processar IA) de última geração, como as H100 da Nvidia, e garante 99,99% de disponibilidade — um padrão importante para quem está construindo produtos comerciais que dependem de IA funcionando o tempo todo.

Para quem já usa a Hugging Face, a integração é direta: basta escolher a DeepInfra como provedora ao configurar um modelo, e tudo roda por meio da API (interface de programação) padrão da plataforma. Não é preciso criar conta separada nem reescrever código. A cobrança é por token (unidade de texto processada) ou por segundo de uso, dependendo do tipo de modelo. A DeepInfra também oferece suporte para fine-tuning (ajuste fino de modelos com dados próprios) e para rodar LLMs de pesos abertos (modelos cujos parâmetros internos estão disponíveis publicamente, ao contrário do GPT-4).

A novidade amplia as opções para startups e desenvolvedores que querem experimentar IA sem gastar milhares de reais em infraestrutura própria. Com a DeepInfra entrando na lista oficial de provedores da Hugging Face — ao lado de nomes como AWS e Google Cloud —, fica mais fácil comparar preços e desempenho antes de escolher onde rodar seus modelos. Para o mercado brasileiro, onde custo de nuvem pesa, isso pode fazer diferença na hora de viabilizar projetos.

Fonte original
Hugging Face Blog
Mais em · Ferramentas