MemTrapBench: Benchmark Revela Armadilhas Cognitivas na Memória de LLMs
Novo benchmark MemTrapBench revela que todas as estratégias de memória testadas em LLMs reduzem o desempenho, criando armadilhas cognitivas que distorcem o raciocínio dos modelos.
