Ao vivo
[Ferramentas]Como adicionar marcas d'água em imagens de IA com uma linha de código[Ferramentas]LeRobot lança formato de dataset que facilita treinar robôs com milhões de exemplos[Ferramentas]Três truques da OpenAI para rodar modelos de IA muito mais rápido (que você pode usar hoje)[Modelos de IA]Writer lança modelos de IA compactos que raciocinam sem precisar de servidores potentes[Ferramentas]Hugging Face e Together AI facilitam o ajuste fino de qualquer modelo de linguagem[Ferramentas]ServiceNow cria framework que gera dados de treino para qualquer modelo de IA[Pesquisa]Hugging Face lança ferramentas para qualquer um estudar agentes de IA[Ferramentas]Hugging Face passa a oferecer servidores franceses da Scaleway para rodar modelos de IA[Regulação]Mulher acusa padrasto de usar Grok para criar imagem sexual a partir de foto de infância[Modelos de IA]Anthropic detalha como vão funcionar as marcas d'água do Claude[Ferramentas]Como adicionar marcas d'água em imagens de IA com uma linha de código[Ferramentas]LeRobot lança formato de dataset que facilita treinar robôs com milhões de exemplos[Ferramentas]Três truques da OpenAI para rodar modelos de IA muito mais rápido (que você pode usar hoje)[Modelos de IA]Writer lança modelos de IA compactos que raciocinam sem precisar de servidores potentes[Ferramentas]Hugging Face e Together AI facilitam o ajuste fino de qualquer modelo de linguagem[Ferramentas]ServiceNow cria framework que gera dados de treino para qualquer modelo de IA[Pesquisa]Hugging Face lança ferramentas para qualquer um estudar agentes de IA[Ferramentas]Hugging Face passa a oferecer servidores franceses da Scaleway para rodar modelos de IA[Regulação]Mulher acusa padrasto de usar Grok para criar imagem sexual a partir de foto de infância[Modelos de IA]Anthropic detalha como vão funcionar as marcas d'água do Claude
Transmitindo ·

Notícias.
Inteligência Artificial

Inteligência Artificial para Gente de Verdade · ES / PT-BR

PesquisaHugging Face Blog2 min

Nova técnica permite treinar modelos de IA com textos de um milhão de palavras de uma só vez

Hugging Face apresenta método que distribui o processamento de contextos gigantescos entre várias GPUs, abrindo caminho para IAs que entendem documentos inteiros.

Por Redação2 min
Compartilhar
Nova técnica permite treinar modelos de IA com textos de um milhão de palavras de uma só vez
Pesquisa · Hugging Face Blog

A Hugging Face (uma plataforma onde desenvolvedores compartilham e usam modelos de inteligência artificial) anunciou uma técnica chamada Ulysses Sequence Parallelism que permite treinar modelos de linguagem com contextos de até um milhão de tokens (pedaços de texto que equivalem, grosso modo, a três quartos de uma palavra cada). Para ter ideia do que isso significa: um romance inteiro costuma ter entre 80 mil e 120 mil tokens — ou seja, a técnica permite que um modelo processe vários livros de uma vez só antes de dar uma resposta.

O problema que a Ulysses resolve é simples: quanto maior o texto que você quer que uma IA entenda de uma vez (o chamado "contexto"), mais memória e poder de processamento ela exige. Modelos atuais travam ou ficam lentos demais quando o contexto passa de algumas dezenas de milhares de tokens. A solução proposta divide esse contexto gigantesco entre várias GPUs (os chips especializados que fazem os cálculos da IA) de um jeito inteligente: cada GPU processa um pedaço do texto, mas todas trocam informações entre si para que o modelo continue "enxergando" o texto inteiro.

A técnica usa algo chamado ring attention (atenção em anel), um método em que as GPUs ficam organizadas em círculo e vão passando partes do texto umas para as outras enquanto trabalham. Isso evita que uma única GPU precise guardar o texto todo na memória. Segundo a Hugging Face, o Ulysses consegue escalar de forma quase linear: se você dobra o número de GPUs, o contexto que consegue processar também dobra, sem perder muito desempenho.

A técnica já está disponível como código aberto e foi testada com modelos de até 7 bilhões de parâmetros (os "pesos" internos que definem como a IA funciona). Entre as aplicações práticas, estão a análise de contratos jurídicos imensos, a leitura de bases de código inteiras de uma empresa ou a compreensão de prontuários médicos completos de um paciente. Até agora, modelos comerciais costumam se limitar a contextos de 32 mil a 200 mil tokens — o Ulysses empurra esse limite muito além, mas ainda exige uma infraestrutura cara de várias GPUs trabalhando juntas.

Fonte original
Hugging Face Blog
Mais em · Pesquisa