OpenAI lança Data agent no ChatGPT Work

OpenAI lança Data agent no ChatGPT Work

A OpenAI anunciou em 10 de setembro de 2026 o Data agent, recurso do ChatGPT Work que conecta dados corporativos e monta dashboards interativos por linguagem natural.

Por Redação Mapa Paper10 set
Novo framework explica agentes de IA por rastros de execução

Novo framework explica agentes de IA por rastros de execução

O artigo arXiv:2609.06063v1 apresenta um framework pós-hoc que converte rastros de execução de agentes de IA em relatórios estruturados e explicações em linguagem natural fiéis ao comportamento observado. Segundo os autores, o método supera explicações geradas por LLM de forma ingênua e identifica alegações sem suporte, ações injustificadas e lacunas de evidência.

Por Redação Mapa Paper10 set
Método compõe especialistas de IA para restaurar texto corrompido

Método compõe especialistas de IA para restaurar texto corrompido

Paper no arXiv propõe a composição local alinhada à evidência, que escolhe em qual especialista de domínio confiar em cada posição de um texto corrompido, sem rótulos de região nem roteador treinado. O método atingiu 0,85 de acurácia de campo em documentos científicos mistos e 0,98 em misturas lexicalmente disjuntas.

Por Redação Mapa Paper10 set
Agentes de IA confiam demais em ferramentas, mostra estudo

Agentes de IA confiam demais em ferramentas, mostra estudo

Estudo no arXiv corrompeu retornos de busca na web, subagentes e execução de código em 14 LLMs e mediu a adoção do erro. A taxa média passou de um terço em todas as ferramentas e chegou a 68,0% na busca na web. Nenhuma das intervenções testadas, em prompting, metadados ou pós-treinamento, resolveu o problema de forma consistente.

Por Redação Mapa Paper10 set
TEAM-Design: novo método decide quando testar humano e IA

TEAM-Design: novo método decide quando testar humano e IA

O TEAM-Design, regra proposta em artigo no arXiv, atribui duas probabilidades de replay a cada tarefa para decidir qual baseline ausente medir sob orçamento fixo. Nos 6 cenários clínicos reanalisados, nenhum fluxo humano-IA superou humano sozinho e agente sozinho.

Por Redação Mapa Paper10 set
Agentes de IA falham ao simular valores humanos, aponta estudo

Agentes de IA falham ao simular valores humanos, aponta estudo

Estudo no arXiv simulou 4.000 conversas com 1.200 personas e três modelos (GPT-4o, Gemini-2.5-Flash e Gemma-4-E4B) ancoradas no World Values Survey. Mais de 50% das personas já falham em expressar o perfil de valores atribuído na primeira conversa, e apenas 2% a 7% derivam depois.

Por Redação Mapa Paper10 set
SCAFFOLD: agentes web que se aprimoram ganham 17,2 pontos

SCAFFOLD: agentes web que se aprimoram ganham 17,2 pontos

O SCAFFOLD, framework de agentes web visuais que se aprimoram sozinhos, supera o melhor baseline com habilidades em 11,1 a 17,2 pontos absolutos em WebArena, VisualWebArena e Online-Mind2Web. O código está aberto no GitHub.

Por Redação Mapa Paper10 set