
Como rodar um assistente de IA mais rápido em notebooks comuns
Técnica desenvolvida pela Hugging Face e Intel acelera modelos de linguagem em computadores sem GPU dedicada, usando versões menores como rascunho.
Notícias.
Inteligência Artificial
Inteligência Artificial para Gente de Verdade · ES / PT-BR

Técnica desenvolvida pela Hugging Face e Intel acelera modelos de linguagem em computadores sem GPU dedicada, usando versões menores como rascunho.

Nils Reimers, autor de uma das bibliotecas mais usadas para buscar e organizar informações com IA, se junta à plataforma para tornar a tecnologia mais acessível

Pesquisadores criaram um sistema que identifica ingredientes problemáticos em rótulos e receitas, ajudando quem tem alergia alimentar a evitar reações graves.

Método chamado ALTK usa menos tokens para obter resultados semelhantes aos de sistemas que 'pensam' em voz alta, como o o1 da OpenAI

Granite 4.0 Nano tem apenas 419 milhões de parâmetros e consegue executar tarefas de linguagem em dispositivos com menos de 1 GB de memória.

Pesquisadores da ServiceNow mostram que modelos grandes de raciocínio podem ensinar versões menores a pensar melhor — sem precisar de dados rotulados à mão.

A versão 5 da biblioteca Transformers reduz linhas de código e facilita personalização de modelos de linguagem para desenvolvedores

Plataforma reformulou a maneira como seus modelos dividem palavras em pedaços menores, tornando o processo mais transparente e fácil de personalizar.

Desenvolvido pelo instituto TII, o modelo combina duas arquiteturas diferentes e promete superar concorrentes em tarefas complexas no idioma.

Ferramenta popular para rodar modelos de linguagem no computador ganha sistema de gerenciamento automático inspirado no Hugging Face Hub.

Pesquisadores criam Alyah, conjunto de testes que avalia se grandes modelos de linguagem conseguem lidar com o árabe falado nos Emirados — e a maioria falha.

O Differential Transformer V2 melhora a capacidade dos modelos de linguagem de filtrar informação irrelevante e pode reduzir o custo de rodar IA em até 62%.

Pesquisadores testaram assistentes como ChatGPT e Claude em situações de ensino e descobriram que eles entregam respostas prontas na hora errada.

O Holo2, novo modelo da startup chinesa, supera concorrentes em testes de localização de menus, botões e mensagens de apps — área que costuma gerar erros constrangedores.

Pesquisadores usaram GPU doméstica e modelos de linguagem para analisar sequências genéticas — com custo 600 vezes menor que alternativas tradicionais.

A TRL v1.0 permite que desenvolvedores treinem e ajustem modelos de linguagem com menos código e mais flexibilidade, acompanhando as mudanças rápidas do setor.

Hugging Face apresenta método que distribui o processamento de contextos gigantescos entre várias GPUs, abrindo caminho para IAs que entendem documentos inteiros.

A arquitetura Mixture of Experts permite que modelos gigantes de linguagem processem texto usando apenas uma fração de seus neurônios, reduzindo custo e velocidade sem perder qualidade.

Instituto de IA de Abu Dhabi cria ranking que avalia quanto LLMs entendem de fato a língua árabe, não só palavras isoladas.

A sincronização delta permite compartilhar modelos gigantes de IA enviando apenas as diferenças em relação a versões públicas, economizando tempo e banda.
Usamos cookies de análise (Google Analytics) para entender quais artigos interessam. Só são ativadas se você aceitar. Saiba mais sobre privacidade