QuantumMind: IA agêntica audita hipóteses de speedup quântico

QuantumMind: IA agêntica audita hipóteses de speedup quântico

Pesquisadores apresentaram no arXiv o QuantumMind, um workflow agêntico que gera e filtra hipóteses de aceleração quântica com um validador determinístico de dez verificações. Em 582 tarefas, o sistema marcou 53,1 pontos no Open-Discovery Score, superando o melhor baseline em 17,3 pontos.

Por Redação Mapa Paper11 ago
Modelos clínicos de IA: estudo propõe framework de privacidade

Modelos clínicos de IA: estudo propõe framework de privacidade

Estudo do arXiv mostra que modelos clínicos de IA podem expor dados de pacientes por vazamento indireto, e que HIPAA e GDPR não cobrem esse risco. Pesquisadores propõem um framework de avaliação baseado em cenários reais de uso.

Por Redação Mapa Paper11 ago
Agente-pesquisador evolui ao consultar grafos de conhecimento

Agente-pesquisador evolui ao consultar grafos de conhecimento

Estudo do arXiv apresenta um agente de texto-para-SPARQL que propõe e testa mudanças nos próprios prompts e código com base em erros cometidos na validação. O sistema evoluiu nove versões em DBpedia, atingiu 0,22 de acurácia e aponta falhas nos benchmarks atuais.

Por Redação Mapa Paper11 ago
Paper propõe base argumentativa para IA avaliativa

Paper propõe base argumentativa para IA avaliativa

Position paper submetido ao arXiv propõe a argumentação computacional como base formal para a Evaluative AI, abordagem que apresenta hipóteses concorrentes com evidências em vez de recomendações únicas.

Por Redação Mapa Paper11 ago
TREAT: benchmark testa IAs no reconhecimento de teoremas

TREAT: benchmark testa IAs no reconhecimento de teoremas

Novo benchmark TREAT testa se modelos de linguagem reconhecem teoremas conhecidos quando a representação matemática muda; o melhor modelo acertou 60,73% das identidades em um corpus com 737 teoremas e 29.480 variações.

Por Redação Mapa Paper11 ago
Emoção entra em modelo de IA de direção humana

Emoção entra em modelo de IA de direção humana

Pesquisadores ampliaram um modelo de inferência ativa de direção humana para incluir emoções, representadas por valência e excitação. O trabalho, disponível como preprint no arXiv, foi avaliado em dois cenários interativos de trânsito.

Por Redação Mapa Paper11 ago
Data-Centric Parallel acelera treino de sequências longas

Data-Centric Parallel acelera treino de sequências longas

Preprint submetido ao arXiv propõe o Data-Centric Parallel, método que ajusta configurações de treinamento distribuído com base no comprimento das sequências de cada lote. Resultados preliminares indicam speedup de até 2,88x em 32 GPUs H200, com integração de cerca de 10 linhas de código.

Por Redação Mapa Paper11 ago