Ao vivo
[Modelos de IA]IBM e Confluent lançam modelos de IA para análise de séries temporais em tempo real[Pesquisa]Pesquisadores criam ferramenta que mostra o que os testes de IA medem de verdade[Ferramentas]Hugging Face integra dezenas de serviços de IA em uma única plataforma[Ferramentas]Hugging Face lança biblioteca com mais de 200 operações para rodar IA no navegador[Modelos de IA]Open-R1: a primeira cópia totalmente aberta do DeepSeek-R1[Pesquisa]AlphaFold completa cinco anos e já acelerou pesquisas em mais de 190 países[Modelos de IA]OpenAI apresenta GPT-Live, nova geração de vozes mais naturais para o ChatGPT[Regulação]Mercado paralelo vende acesso ao Claude na China por 10% do preço oficial[Pesquisa]Google DeepMind abre laboratório de pesquisa em Singapura[Pesquisa]Google DeepMind e governo dos EUA criam Genesis, projeto nacional para acelerar ciência com IA[Modelos de IA]IBM e Confluent lançam modelos de IA para análise de séries temporais em tempo real[Pesquisa]Pesquisadores criam ferramenta que mostra o que os testes de IA medem de verdade[Ferramentas]Hugging Face integra dezenas de serviços de IA em uma única plataforma[Ferramentas]Hugging Face lança biblioteca com mais de 200 operações para rodar IA no navegador[Modelos de IA]Open-R1: a primeira cópia totalmente aberta do DeepSeek-R1[Pesquisa]AlphaFold completa cinco anos e já acelerou pesquisas em mais de 190 países[Modelos de IA]OpenAI apresenta GPT-Live, nova geração de vozes mais naturais para o ChatGPT[Regulação]Mercado paralelo vende acesso ao Claude na China por 10% do preço oficial[Pesquisa]Google DeepMind abre laboratório de pesquisa em Singapura[Pesquisa]Google DeepMind e governo dos EUA criam Genesis, projeto nacional para acelerar ciência com IA
Transmitindo ·

Notícias.
Inteligência Artificial

Inteligência Artificial para Gente de Verdade · ES / PT-BR

PesquisaThe Decoder1 min

Google cria 'wiki' que permite agentes de IA aprenderem com os próprios erros

O WikiSkill funciona como um caderno permanente onde agentes de inteligência artificial registram o que deu certo e o que falhou, melhorando seu desempenho ao longo do tempo sem precisar ser retreinados

Por Redação1 min
Em resumo

O Google lançou o WikiSkill, um sistema que dá aos agentes de IA (programas que executam tarefas sozinhos) uma memória persistente. Eles registram erros e acertos em uma estrutura tipo wiki e consultam esse histórico para melhorar. Modelos menores com WikiSkill chegam a igualar o desempenho de modelos maiores sem ele.

Compartilhar
Google cria 'wiki' que permite agentes de IA aprenderem com os próprios erros
Pesquisa · The Decoder

Pesquisadores do Google criaram o WikiSkill, um sistema que dá aos agentes de IA (programas que realizam tarefas de forma autônoma, como navegar em sites ou organizar arquivos) uma memória persistente — isto é, que não some quando a tarefa termina. Em vez de esquecer tudo após cada execução, esses agentes passam a documentar suas falhas e acertos em uma estrutura parecida com uma wiki, a mesma lógica de organização da Wikipédia, e consultam esse histórico para melhorar nas próximas vezes.

Segundo informou o site The Decoder, que cobriu o lançamento, o sistema funciona como um caderno de aprendizado coletivo: cada vez que um agente resolve (ou não resolve) uma tarefa, ele registra o que funcionou, o que falhou e por quê. Nas rodadas seguintes, ele consulta esse banco de conhecimento antes de agir, evitando repetir os mesmos erros e aproveitando estratégias que já deram certo.

Os testes mostraram que modelos maiores (LLMs com mais parâmetros, ou seja, mais capacidade de processamento) se beneficiam mais do WikiSkill. Mas o dado mais interessante é que modelos menores equipados com o sistema conseguiram igualar o desempenho de modelos maiores que operam sem ele — o que sugere que uma boa memória pode compensar, em parte, a falta de potência bruta.

A novidade é relevante porque agentes de IA costumam partir do zero a cada nova tarefa, mesmo que já tenham enfrentado problemas parecidos antes. Com uma memória compartilhada e acessível, eles deixam de ser aprendizes descartáveis e passam a acumular experiência — uma característica até agora exclusiva de sistemas com treinamento contínuo, que são mais caros e complexos de manter.

Fonte original
The Decoder
Mais em · Pesquisa