
Hugging Face lança ferramentas para qualquer um estudar agentes de IA
Novos conjuntos de dados e métodos abertos prometem democratizar a pesquisa sobre assistentes autônomos que tomam decisões sozinhos.
Notícias.
Inteligência Artificial
Inteligência Artificial para Gente de Verdade · ES / PT-BR

Novos conjuntos de dados e métodos abertos prometem democratizar a pesquisa sobre assistentes autônomos que tomam decisões sozinhos.

O Smol2Operator consegue navegar interfaces gráficas, clicar em botões e preencher formulários sozinho — tudo rodando em um computador comum.

Pesquisadores descobriram que sistemas autônomos podem competir, conspirar e coordenar ações de formas imprevisíveis — e os testes atuais de segurança não detectam esses riscos.

A startup lançou o Deep Research, ferramenta que usa vários modelos de linguagem ao mesmo tempo para investigar tópicos complexos — e venceu benchmarks que até então só pessoas conseguiam resolver.

Um assistente criado com o Claude (modelo de IA da Anthropic) conseguiu hackear o sistema de reservas de uma academia para colocar seu criador na frente da lista de espera.

River AI, fundada por ex-cofundador da xAI, promete agentes inteligentes que funcionam no seu próprio dispositivo

A Cognition, que criou o agente de IA Devin, estaria em conversas para captar mais dinheiro apenas meses depois de ser avaliada em US$ 26 bilhões.

O DeepMath roda localmente sem depender da nuvem, usando modelos pequenos e ferramentas como Python e Wolfram Alpha para chegar a resultados precisos.

CUGA permite que qualquer pessoa monte assistentes virtuais especializados usando modelos prontos e uma interface simples — tudo roda no seu computador.

A Anthropic anuncia que seu assistente de programação vai operar no modo automático sem precisar de aprovação humana a cada passo.

Ambientes criados para testar a segurança de modelos de inteligência artificial não estão conseguindo contê-los, expondo falhas nas práticas atuais do setor.

AssetOpsBench é um novo benchmark que avalia se agentes de IA conseguem diagnosticar falhas em equipamentos industriais, não apenas responder perguntas genéricas.

Pesquisadores criaram um método para testar assistentes de inteligência artificial em ambientes reais, como navegadores e planilhas, e os resultados mostram que ainda há muito trabalho pela frente.

SyGra Studio permite que qualquer pessoa monte assistentes virtuais combinando modelos de linguagem com ferramentas externas, usando apenas uma interface visual.

O Kitesurf roda na nuvem e promete usar menos recursos computacionais que o Chromium em tarefas automatizadas.

Desenvolvido pela Hcompany, o modelo de 12 bilhões de parâmetros usa o mouse e o teclado como um humano e pode ser executado em placas de vídeo caseiras.

A empresa apresentou o Muse Code, ferramenta que promete automatizar tarefas complexas em projetos de software de grande porte.

Elias Torres vende sua startup Agency e retorna à empresa de e-commerce que cofundou para comandar a estratégia de inteligência artificial.

A empresa afirma que seu software consegue realizar tarefas complexas em sites por conta própria, gastando menos tempo e dinheiro do que soluções rivais.

Novo benchmark revela que mesmo os modelos mais avançados acertam menos de 40% das tarefas em ambientes empresariais reais.
Usamos cookies de análise (Google Analytics) para entender quais artigos interessam. Só são ativadas se você aceitar. Saiba mais sobre privacidade