
PesquisaHugging Face Blog
Por que filtros de segurança em IA bloqueiam perguntas legítimas — e como consertar isso
Pesquisadores mostram que ensinar modelos de linguagem a recusar apenas pedidos nocivos dentro de um tema, sem bloquear todo o assunto, exige medir os dois lados da fronteira ao mesmo tempo.