
Los tests de IA miden sobre todo cuántos datos ha visto el modelo, no su inteligencia
Un equipo del Allen Institute descubre que los benchmarks actuales evalúan principalmente cuánta información ha memorizado un modelo de lenguaje durante su entrenamiento, no su capacidad real de razonar o resolver problemas nuevos.

















