A resposta não é o argumento: limite do monitoramento de IA
Estudo do arXiv mostra que dar a resposta correta a monitores de IA melhora a detecção de conclusões erradas, mas não verifica o raciocínio. Com certificação, monitores detectam 93,8% dos erros de resposta, mas apenas 18% dos raciocínios falhos com resposta correta.
