Ao vivo
[Pesquisa]Como o Ai2 resolveu a briga por GPUs com orçamentos em vez de fila de prioridade[Ferramentas]Como criar modelos de IA personalizados por menos de US$ 20 usando um agente automatizado[Modelos de IA]Liquid AI lança modelos de IA que tomam decisões em milissegundos — e funcionam em celulares[Modelos de IA]TII lança Falcon ASR, modelo de transcrição de áudio aberto que roda em hardware comum[Modelos de IA]Nvidia mostra que um único modelo de IA pode chegar ao pódio tanto em programação quanto em matemática avançada[Modelos de IA]Falcon-Emirati: o modelo de IA que aprendeu a falar árabe como um emiradense de verdade[Ferramentas]Hugging Face cria repositório central para ambientes de IA que aprendem por tentativa e erro[Ferramentas]O agente de IA disse que terminou. O banco de dados discordou.[Modelos de IA]Instituto Allen lança modelo de IA aberto para escrever relatórios científicos em segundos[Pesquisa]Como a ServiceNow cria dados de treino que ensinam agentes de IA a funcionar dentro de empresas[Pesquisa]Como o Ai2 resolveu a briga por GPUs com orçamentos em vez de fila de prioridade[Ferramentas]Como criar modelos de IA personalizados por menos de US$ 20 usando um agente automatizado[Modelos de IA]Liquid AI lança modelos de IA que tomam decisões em milissegundos — e funcionam em celulares[Modelos de IA]TII lança Falcon ASR, modelo de transcrição de áudio aberto que roda em hardware comum[Modelos de IA]Nvidia mostra que um único modelo de IA pode chegar ao pódio tanto em programação quanto em matemática avançada[Modelos de IA]Falcon-Emirati: o modelo de IA que aprendeu a falar árabe como um emiradense de verdade[Ferramentas]Hugging Face cria repositório central para ambientes de IA que aprendem por tentativa e erro[Ferramentas]O agente de IA disse que terminou. O banco de dados discordou.[Modelos de IA]Instituto Allen lança modelo de IA aberto para escrever relatórios científicos em segundos[Pesquisa]Como a ServiceNow cria dados de treino que ensinam agentes de IA a funcionar dentro de empresas
Transmitindo · —

Notícias.
Inteligência Artificial

Inteligência Artificial para Gente de Verdade · ES / PT-BR

FerramentasHugging Face Blog1 min

Como descobrir por que seu modelo de IA está travando o computador

Hugging Face lança ferramenta gratuita que mostra em detalhes onde modelos de linguagem estão consumindo memória e processamento — e como corrigir gargalos.

Por Redação1 min
Compartilhar
Como descobrir por que seu modelo de IA está travando o computador
Ferramentas · Hugging Face Blog

A Hugging Face (plataforma onde desenvolvedores compartilham e baixam modelos de IA já treinados) lançou uma ferramenta gratuita que permite identificar exatamente quais partes de um modelo de linguagem estão consumindo mais memória e tempo de processamento. Batizada de torch-attention-profile, a biblioteca analisa especificamente o mecanismo de atenção — a parte dos modelos que processa relações entre palavras e consome a maior fatia de recursos quando o texto fica longo.

O problema que a ferramenta resolve é prático: modelos grandes como LLMs (sigla em inglês para Large Language Models, os sistemas de IA capazes de gerar e entender texto) costumam travar ou ficar lentos sem motivo aparente, especialmente quando rodam em hardware limitado. Segundo a equipe da Hugging Face, o gargalo quase sempre está nas camadas de atenção, mas até agora era difícil saber exatamente onde — obrigando desenvolvedores a fazer testes às cegas ou aceitar que o modelo simplesmente não rodaria naquele equipamento.

A biblioteca funciona diretamente com PyTorch (um dos frameworks mais usados para treinar e executar modelos de IA) e gera relatórios visuais mostrando linha por linha do código onde está o problema: qual operação está ocupando mais VRAM (memória da placa de vídeo), qual está demorando mais tempo, e se há cálculos redundantes que poderiam ser eliminados. A ferramenta é voltada para quem já programa em Python, mas a documentação traz exemplos prontos para copiar e adaptar.

O lançamento acontece num momento em que cada vez mais desenvolvedores tentam rodar modelos de IA localmente — seja por privacidade, custo ou para não depender de conexão com a internet. A ferramenta é de código aberto e está disponível no GitHub, sem custo nem necessidade de cadastro em serviços pagos da Hugging Face.

Fonte original
Hugging Face Blog
Mais em · Ferramentas