Ao vivo
[Pesquisa]Como o Ai2 resolveu a briga por GPUs com orçamentos em vez de fila de prioridade[Ferramentas]Como criar modelos de IA personalizados por menos de US$ 20 usando um agente automatizado[Modelos de IA]Liquid AI lança modelos de IA que tomam decisões em milissegundos — e funcionam em celulares[Modelos de IA]TII lança Falcon ASR, modelo de transcrição de áudio aberto que roda em hardware comum[Modelos de IA]Nvidia mostra que um único modelo de IA pode chegar ao pódio tanto em programação quanto em matemática avançada[Modelos de IA]Falcon-Emirati: o modelo de IA que aprendeu a falar árabe como um emiradense de verdade[Ferramentas]Hugging Face cria repositório central para ambientes de IA que aprendem por tentativa e erro[Ferramentas]O agente de IA disse que terminou. O banco de dados discordou.[Modelos de IA]Instituto Allen lança modelo de IA aberto para escrever relatórios científicos em segundos[Pesquisa]Como a ServiceNow cria dados de treino que ensinam agentes de IA a funcionar dentro de empresas[Pesquisa]Como o Ai2 resolveu a briga por GPUs com orçamentos em vez de fila de prioridade[Ferramentas]Como criar modelos de IA personalizados por menos de US$ 20 usando um agente automatizado[Modelos de IA]Liquid AI lança modelos de IA que tomam decisões em milissegundos — e funcionam em celulares[Modelos de IA]TII lança Falcon ASR, modelo de transcrição de áudio aberto que roda em hardware comum[Modelos de IA]Nvidia mostra que um único modelo de IA pode chegar ao pódio tanto em programação quanto em matemática avançada[Modelos de IA]Falcon-Emirati: o modelo de IA que aprendeu a falar árabe como um emiradense de verdade[Ferramentas]Hugging Face cria repositório central para ambientes de IA que aprendem por tentativa e erro[Ferramentas]O agente de IA disse que terminou. O banco de dados discordou.[Modelos de IA]Instituto Allen lança modelo de IA aberto para escrever relatórios científicos em segundos[Pesquisa]Como a ServiceNow cria dados de treino que ensinam agentes de IA a funcionar dentro de empresas
Transmitindo · —

Notícias.
Inteligência Artificial

Inteligência Artificial para Gente de Verdade · ES / PT-BR

PesquisaHugging Face Blog2 min

Microsoft lança nova versão de arquitetura que promete tornar modelos de IA mais precisos com menos memória

O Differential Transformer V2 melhora a capacidade dos modelos de linguagem de filtrar informação irrelevante e pode reduzir o custo de rodar IA em até 62%.

Por Redação2 min
Compartilhar
Microsoft lança nova versão de arquitetura que promete tornar modelos de IA mais precisos com menos memória
Pesquisa · Hugging Face Blog

A Microsoft lançou uma atualização da arquitetura Differential Transformer (um tipo de estrutura que organiza como modelos de linguagem processam texto), que promete deixar modelos de inteligência artificial mais precisos sem aumentar — e até reduzindo — a quantidade de memória e poder de processamento necessários. Segundo informou a empresa em artigo publicado no blog da Hugging Face (uma plataforma onde desenvolvedores compartilham e baixam modelos de IA já treinados), a nova versão consegue melhorar a capacidade dos modelos de distinguir informação importante de ruído, um dos grandes problemas atuais dos LLMs (sigla em inglês para modelos de linguagem de grande escala, como o ChatGPT).

A principal inovação está em como o modelo calcula a atenção — o mecanismo que decide quais partes de um texto merecem mais foco ao gerar uma resposta. A versão anterior do Differential Transformer já fazia isso de forma dupla, subtraindo uma camada de atenção "ruidosa" de outra mais relevante. A V2 melhora esse processo e adiciona um recurso chamado Multi-Head Differential Attention (uma forma de processar várias perspectivas do texto ao mesmo tempo, cada uma filtrando ruído de maneira independente), o que torna o modelo mais eficiente e preciso.

Na prática, a Microsoft conseguiu resultados expressivos: em tarefas de recuperação de informação (quando o modelo precisa encontrar dados específicos em textos longos), a nova arquitetura alcançou 97,4% de precisão, contra 51,9% de modelos tradicionais baseados na arquitetura Transformer padrão. Além disso, o Differential Transformer V2 consegue manter 62% menos informação armazenada em cache (memória temporária usada durante o processamento) sem perder desempenho, o que reduz drasticamente o custo de rodar esses modelos em servidores.

A arquitetura já está disponível de forma aberta na biblioteca Transformers da Hugging Face e pode ser treinada ou adaptada por qualquer desenvolvedor. A Microsoft também liberou modelos pré-treinados com 1,4 bilhão e 7 bilhões de parâmetros (os "pesos" que determinam o comportamento do modelo) para que pesquisadores e empresas possam testar a tecnologia. A expectativa é que a nova abordagem seja adotada em aplicações que exigem processar contextos muito longos — como análise de contratos, sumarização de documentos extensos ou assistentes que precisam lembrar de conversas inteiras — onde modelos atuais costumam se perder ou misturar informações irrelevantes.

Fonte original
Hugging Face Blog
Mais em · Pesquisa