Ao vivo
[Modelos de IA]IBM e Confluent lançam modelos de IA para análise de séries temporais em tempo real[Pesquisa]Pesquisadores criam ferramenta que mostra o que os testes de IA medem de verdade[Ferramentas]Hugging Face integra dezenas de serviços de IA em uma única plataforma[Ferramentas]Hugging Face lança biblioteca com mais de 200 operações para rodar IA no navegador[Modelos de IA]Open-R1: a primeira cópia totalmente aberta do DeepSeek-R1[Pesquisa]AlphaFold completa cinco anos e já acelerou pesquisas em mais de 190 países[Modelos de IA]OpenAI apresenta GPT-Live, nova geração de vozes mais naturais para o ChatGPT[Regulação]Mercado paralelo vende acesso ao Claude na China por 10% do preço oficial[Pesquisa]Google DeepMind abre laboratório de pesquisa em Singapura[Pesquisa]Google DeepMind e governo dos EUA criam Genesis, projeto nacional para acelerar ciência com IA[Modelos de IA]IBM e Confluent lançam modelos de IA para análise de séries temporais em tempo real[Pesquisa]Pesquisadores criam ferramenta que mostra o que os testes de IA medem de verdade[Ferramentas]Hugging Face integra dezenas de serviços de IA em uma única plataforma[Ferramentas]Hugging Face lança biblioteca com mais de 200 operações para rodar IA no navegador[Modelos de IA]Open-R1: a primeira cópia totalmente aberta do DeepSeek-R1[Pesquisa]AlphaFold completa cinco anos e já acelerou pesquisas em mais de 190 países[Modelos de IA]OpenAI apresenta GPT-Live, nova geração de vozes mais naturais para o ChatGPT[Regulação]Mercado paralelo vende acesso ao Claude na China por 10% do preço oficial[Pesquisa]Google DeepMind abre laboratório de pesquisa em Singapura[Pesquisa]Google DeepMind e governo dos EUA criam Genesis, projeto nacional para acelerar ciência com IA
Transmitindo ·

Notícias.
Inteligência Artificial

Inteligência Artificial para Gente de Verdade · ES / PT-BR

PesquisaTechCrunch AI1 min

Pesquisadora da Anthropic mostra sistema de IA que se corrige sozinho

Experimento automatizado conseguiu melhorar o comportamento de modelos de linguagem em dez métricas diferentes sem prejudicar o desempenho geral, segundo relatou a TechCrunch.

Por Redação1 min
Em resumo

Uma pesquisadora da Anthropic (empresa por trás do chatbot Claude) mostrou um sistema automatizado que conseguiu corrigir comportamentos indesejados em modelos de linguagem (LLMs, os sistemas por trás de ferramentas como ChatGPT) em dez testes diferentes, sem piorar o desempenho geral — algo considerado difícil até agora.

Compartilhar
Pesquisadora da Anthropic mostra sistema de IA que se corrige sozinho
Pesquisa · TechCrunch AI

Uma pesquisadora da Anthropic (empresa por trás do chatbot Claude) compartilhou resultados de um experimento com sistemas automatizados capazes de corrigir comportamentos indesejados em modelos de inteligência artificial. Segundo informou a TechCrunch, os testes envolveram dez benchmarks (conjuntos de testes padronizados usados para medir a qualidade de um modelo de IA) focados em comportamentos específicos considerados problemáticos.

O mais notável é que os sistemas automatizados conseguiram melhorar o desempenho do modelo em todas as dez métricas avaliadas, sem comprometer a performance geral em outras tarefas. Isso é importante porque, até agora, ajustar um modelo de linguagem (LLM, na sigla em inglês — os sistemas por trás de ferramentas como ChatGPT e Claude) para corrigir um problema específico costuma piorar o desempenho em outras áreas, um dilema conhecido como "degradação".

A revelação foi feita de forma informal pela pesquisadora, sem um artigo científico completo publicado ainda, mas chama atenção porque sugere avanços na chamada "auto-melhoria" de IA — a ideia de que modelos possam identificar e corrigir seus próprios erros sem intervenção humana constante. Esse é um dos objetivos de longo prazo da pesquisa em segurança de IA, já que modelos cada vez mais complexos se tornam difíceis de monitorar manualmente.

A Anthropic não detalhou quais comportamentos específicos foram corrigidos nem como exatamente o sistema automatizado funciona. A empresa é conhecida por investir pesadamente em pesquisa de alinhamento (técnicas para garantir que modelos de IA sigam instruções humanas de forma confiável e segura), e esse tipo de experimento faz parte desse esforço. Por enquanto, trata-se de pesquisa de laboratório, sem previsão de quando ou se a tecnologia chegará aos produtos comerciais da empresa.

Fonte original
TechCrunch AI
Mais em · Pesquisa