Skill Misevolution: o risco oculto dos agentes de IA que aprendem sozinhos
Estudo do arXiv mostra que agentes de IA que evoluem habilidades podem internalizar comportamentos inseguros. SafeEvolve reduz danos em até 26,7 pontos percentuais sem perda relevante de utilidade.
