Ao vivo
[Pesquisa]Como o Ai2 resolveu a briga por GPUs com orçamentos em vez de fila de prioridade[Ferramentas]Como criar modelos de IA personalizados por menos de US$ 20 usando um agente automatizado[Modelos de IA]Liquid AI lança modelos de IA que tomam decisões em milissegundos — e funcionam em celulares[Modelos de IA]TII lança Falcon ASR, modelo de transcrição de áudio aberto que roda em hardware comum[Modelos de IA]Nvidia mostra que um único modelo de IA pode chegar ao pódio tanto em programação quanto em matemática avançada[Modelos de IA]Falcon-Emirati: o modelo de IA que aprendeu a falar árabe como um emiradense de verdade[Ferramentas]Hugging Face cria repositório central para ambientes de IA que aprendem por tentativa e erro[Ferramentas]O agente de IA disse que terminou. O banco de dados discordou.[Modelos de IA]Instituto Allen lança modelo de IA aberto para escrever relatórios científicos em segundos[Pesquisa]Como a ServiceNow cria dados de treino que ensinam agentes de IA a funcionar dentro de empresas[Pesquisa]Como o Ai2 resolveu a briga por GPUs com orçamentos em vez de fila de prioridade[Ferramentas]Como criar modelos de IA personalizados por menos de US$ 20 usando um agente automatizado[Modelos de IA]Liquid AI lança modelos de IA que tomam decisões em milissegundos — e funcionam em celulares[Modelos de IA]TII lança Falcon ASR, modelo de transcrição de áudio aberto que roda em hardware comum[Modelos de IA]Nvidia mostra que um único modelo de IA pode chegar ao pódio tanto em programação quanto em matemática avançada[Modelos de IA]Falcon-Emirati: o modelo de IA que aprendeu a falar árabe como um emiradense de verdade[Ferramentas]Hugging Face cria repositório central para ambientes de IA que aprendem por tentativa e erro[Ferramentas]O agente de IA disse que terminou. O banco de dados discordou.[Modelos de IA]Instituto Allen lança modelo de IA aberto para escrever relatórios científicos em segundos[Pesquisa]Como a ServiceNow cria dados de treino que ensinam agentes de IA a funcionar dentro de empresas
Transmitindo · —

Notícias.
Inteligência Artificial

Inteligência Artificial para Gente de Verdade · ES / PT-BR

PesquisaHugging Face Blog2 min

Como treinar modelos de IA menores sem gastar uma fortuna

Empresa propõe técnica que reduz em até 75% o custo de destilação de conhecimento, processo usado para criar versões mais leves de grandes modelos de linguagem.

Por Redação2 min
Compartilhar
Como treinar modelos de IA menores sem gastar uma fortuna
Pesquisa · Hugging Face Blog

A Multiverse Computing, empresa espanhola especializada em IA para finanças, apresentou um método que pode tornar a criação de modelos de linguagem compactos bem mais barata. A técnica melhora um processo chamado de destilação de conhecimento (knowledge distillation) — uma forma de treinar um modelo pequeno para imitar o comportamento de um modelo maior, sem precisar começar do zero. Segundo a empresa, o novo método reduz em até 75% os custos computacionais desse processo, o que pode permitir que mais equipes criem modelos próprios sem depender exclusivamente de serviços pagos na nuvem.

O artigo, publicado no blog oficial da Hugging Face (plataforma onde desenvolvedores compartilham e baixam modelos de IA já treinados), explica que o segredo está em uma abordagem chamada de "destilação de conhecimento agnóstica ao modelo". Na prática, isso significa que o método funciona sem precisar acessar os pesos internos do modelo maior — ou seja, é possível destilar conhecimento de qualquer LLM (large language model, os modelos gigantes que entendem e geram texto) acessível por API, incluindo modelos fechados como o GPT-4 da OpenAI ou o Claude da Anthropic.

A técnica combina duas estratégias: usar dados sintéticos gerados pelo próprio modelo grande e aplicar uma perda de destilação baseada em divergência KL (uma medida matemática que compara quão diferentes são as respostas de dois modelos). A Multiverse testou o método em vários modelos de base, como Llama (família de modelos de código aberto da Meta) e Mistral (outro modelo open-source popular entre desenvolvedores), e reportou que os modelos menores resultantes conseguem desempenho próximo ao dos originais em tarefas como responder perguntas, resumir textos e seguir instruções — mas rodando muito mais rápido e consumindo menos memória.

Para o mercado brasileiro, onde infraestrutura de nuvem costuma ser mais cara e empresas menores têm orçamentos limitados para IA, a possibilidade de criar modelos sob medida sem depender de GPUs de última geração (chips especializados em processar IA) pode ser um divisor de águas. A Multiverse disponibilizou código de exemplo no GitHub e promete liberar mais detalhes nos próximos meses, o que pode facilitar a adoção da técnica por startups e equipes de pesquisa com menos recursos.

Fonte original
Hugging Face Blog
Mais em · Pesquisa