
PesquisaHugging Face Blog
Por que assistentes de IA ainda erram tanto: novo teste revela os limites dos agentes autônomos
Benchmark criado pela IBM mostra que mesmo os melhores modelos de linguagem falham em tarefas simples quando precisam usar ferramentas ou raciocinar em várias etapas.
