ARC-Bench expõe falha de ranking em world models JEPA congelados

ARC-Bench expõe falha de ranking em world models JEPA congelados

O ARC-Bench, novo protocolo de avaliação, auditou checkpoints oficiais de JEPA-WM e descobriu que o candidato de ação mais bem pontuado é quase sempre subótimo, em manipulação e em labirintos. O replanejamento em ciclo fechado esconde a falha e infla as taxas de sucesso.

Por Redação Mapa Paper10 set
Estudo testa metanormas em LLMs e revela viés punitivo

Estudo testa metanormas em LLMs e revela viés punitivo

Pesquisa do arXiv apresenta o framework de metanormas e o dataset NormReact, com 450 cenários de violação de normas. Em seis modelos testados, os LLMs previram mais punição do que humanos e pioraram o alinhamento conforme a distância social aumentou.

Por Redação Mapa Paper10 set
Alucinação em IA: o que é e como reduzir

Alucinação em IA: o que é e como reduzir

As alucinações em IA acontecem quando o modelo inventa fatos com confiança. Veja o que são, por que ocorrem e como reduzir o problema com técnicas práticas.

Por Redação Mapa Paper8 set
CPR-IE: métrica de eficiência de IA combina compressão, predição e recursos

CPR-IE: métrica de eficiência de IA combina compressão, predição e recursos

Paper no arXiv publicado em 4 de setembro de 2026 propõe a CPR-IE, métrica que ordena sistemas de IA por compressão, qualidade preditiva e custo de recursos, com garantias formais de consistência de Pareto e estabilidade de ranqueamento. Os autores alertam: é uma representação construída, não uma lei universal.

Por Redação Mapa Paper7 set