Ao vivo
[Pesquisa]Como o Ai2 resolveu a briga por GPUs com orçamentos em vez de fila de prioridade[Ferramentas]Como criar modelos de IA personalizados por menos de US$ 20 usando um agente automatizado[Modelos de IA]Liquid AI lança modelos de IA que tomam decisões em milissegundos — e funcionam em celulares[Modelos de IA]TII lança Falcon ASR, modelo de transcrição de áudio aberto que roda em hardware comum[Modelos de IA]Nvidia mostra que um único modelo de IA pode chegar ao pódio tanto em programação quanto em matemática avançada[Modelos de IA]Falcon-Emirati: o modelo de IA que aprendeu a falar árabe como um emiradense de verdade[Ferramentas]Hugging Face cria repositório central para ambientes de IA que aprendem por tentativa e erro[Ferramentas]O agente de IA disse que terminou. O banco de dados discordou.[Modelos de IA]Instituto Allen lança modelo de IA aberto para escrever relatórios científicos em segundos[Pesquisa]Como a ServiceNow cria dados de treino que ensinam agentes de IA a funcionar dentro de empresas[Pesquisa]Como o Ai2 resolveu a briga por GPUs com orçamentos em vez de fila de prioridade[Ferramentas]Como criar modelos de IA personalizados por menos de US$ 20 usando um agente automatizado[Modelos de IA]Liquid AI lança modelos de IA que tomam decisões em milissegundos — e funcionam em celulares[Modelos de IA]TII lança Falcon ASR, modelo de transcrição de áudio aberto que roda em hardware comum[Modelos de IA]Nvidia mostra que um único modelo de IA pode chegar ao pódio tanto em programação quanto em matemática avançada[Modelos de IA]Falcon-Emirati: o modelo de IA que aprendeu a falar árabe como um emiradense de verdade[Ferramentas]Hugging Face cria repositório central para ambientes de IA que aprendem por tentativa e erro[Ferramentas]O agente de IA disse que terminou. O banco de dados discordou.[Modelos de IA]Instituto Allen lança modelo de IA aberto para escrever relatórios científicos em segundos[Pesquisa]Como a ServiceNow cria dados de treino que ensinam agentes de IA a funcionar dentro de empresas
Transmitindo · —

Notícias.
Inteligência Artificial

Inteligência Artificial para Gente de Verdade · ES / PT-BR

FerramentasHugging Face Blog2 min

Amazon e Hugging Face mostram como montar a infraestrutura para treinar e rodar modelos de IA na nuvem

Parceria disponibiliza guias técnicos e ferramentas para empresas que querem criar seus próprios modelos de linguagem usando servidores da AWS.

Por Redação2 min
Compartilhar
Amazon e Hugging Face mostram como montar a infraestrutura para treinar e rodar modelos de IA na nuvem
Ferramentas · Hugging Face Blog

A Amazon Web Services (AWS, o braço de computação em nuvem da Amazon) e a Hugging Face (plataforma onde desenvolvedores compartilham e baixam modelos de IA já treinados) publicaram um conjunto de tutoriais e componentes prontos para quem precisa treinar ou rodar modelos de linguagem de grande escala — os chamados LLMs (sigla em inglês para modelos que entendem e geram texto). O material é voltado para empresas que querem criar seus próprios modelos ou adaptar modelos existentes sem depender de APIs pagas de terceiros.

Os guias cobrem desde a escolha de máquinas virtuais equipadas com GPUs (chips especializados em cálculos pesados, essenciais para IA) até técnicas como fine-tuning (processo de ajustar um modelo já treinado para uma tarefa específica) e inferência distribuída (dividir o trabalho de gerar respostas entre vários servidores ao mesmo tempo). Segundo informou a Hugging Face em seu blog oficial, o objetivo é reduzir o tempo e a complexidade para quem está começando a construir infraestrutura própria de IA.

Entre as ferramentas destacadas estão o Amazon SageMaker (plataforma da AWS para treinar e implantar modelos de machine learning) e bibliotecas de código aberto como o Transformers e o Accelerate, ambas mantidas pela Hugging Face. O material também ensina a usar instâncias equipadas com chips Trainium e Inferentia, processadores desenvolvidos pela própria Amazon especificamente para cargas de trabalho de inteligência artificial, prometendo melhor desempenho e custo menor que GPUs tradicionais da Nvidia.

A iniciativa interessa especialmente a empresas que lidam com dados sensíveis ou que precisam de controle total sobre seus modelos — setores como saúde, finanças e governo costumam evitar enviar informações para APIs externas por questões de privacidade e conformidade regulatória. Com infraestrutura própria na nuvem, essas organizações podem manter os dados dentro de seus próprios ambientes enquanto ainda se beneficiam da escala e da flexibilidade da AWS.

O anúncio reforça a disputa entre as gigantes de nuvem — Microsoft (via Azure e parceria com a OpenAI), Google Cloud e AWS — para atrair clientes corporativos interessados em IA generativa. Enquanto a Microsoft aposta em integrar modelos prontos como o GPT-4 diretamente em seus produtos, a AWS tem focado em oferecer infraestrutura flexível e ferramentas para que as empresas construam soluções sob medida, estratégia que pode agradar quem prefere não ficar dependente de um único fornecedor de modelos.

Fonte original
Hugging Face Blog
Mais em · Ferramentas