AutoTailor corta custo de tokens de web agents em 94,9%

AutoTailor corta custo de tokens de web agents em 94,9%

O AutoTailor, framework meta-agêntico para agentes web, reduz 1.283 APIs MCP não refinadas para 33 e corta o uso de tokens em até 94,9% em 106 tarefas do WebArena Postmill. Com fallback de ReAct, o sistema chega a 90,6% de acerto contra 87,5% do ReAct sozinho.

Por Redação Mapa Paper15 set
OdoBot corta até 80% dos tokens em agentes web, diz arXiv

OdoBot corta até 80% dos tokens em agentes web, diz arXiv

O OdoBot, nova arquitetura de agente web apresentada no arXiv, usa 44% e 80% menos tokens do que os concorrentes Agent-E e WebVoyager em 45 tarefas no Canvas LMS, além de superar o WebVoyager na taxa de sucesso.

Por Redação Mapa Paper15 set
OrchSLM roteia modelos de linguagem pequenos em agentes

OrchSLM roteia modelos de linguagem pequenos em agentes

O paper OrchSLM, publicado no arXiv em 11 de setembro de 2026, unifica métodos de orquestração não interativa para modelos de linguagem pequenos e expõe as escolhas de projeto como parâmetros ajustáveis. A proposta é usar o roteamento como sonda para entender como estrutura de tarefa, composição do pool de modelos e consenso multiagente moldam o resultado.

Por Redação Mapa Paper15 set
TimeThink: framework ensina LLMs a raciocinar em séries temporais

TimeThink: framework ensina LLMs a raciocinar em séries temporais

O TimeThink, framework apresentado no arXiv em 11 de setembro de 2026, combina dados sintéticos e aprendizado por reforço com recompensas verificáveis para forçar modelos de linguagem a explicitar o raciocínio sobre séries temporais. Treinado só com dados sintéticos, o método supera baselines fortes em benchmarks sintéticos e do mundo real, segundo os autores.

Por Redação Mapa Paper15 set
LabAgent: agentes de IA que reproduzem pesquisas de laboratório

LabAgent: agentes de IA que reproduzem pesquisas de laboratório

O preprint arXiv:2609.13437v1 apresenta o LabAgent, sistema de agentes de IA que reproduz e amplia o conhecimento de laboratórios científicos. O LabAgent ficou em primeiro lugar contra agentes generalistas comerciais em quatro áreas das ciências da vida e reproduziu com precisão uma figura de artigo publicado.

Por Redação Mapa Paper15 set
CTD separa convergência e diversidade em otimização bayesiana

CTD separa convergência e diversidade em otimização bayesiana

O artigo "Converge Then Diversify" propõe dividir a otimização bayesiana multiobjetivo em duas etapas: primeiro convergir para um ponto da fronteira de Pareto, depois espalhar as soluções. Em 446 comparações pareadas, o método venceu o estado da arte em 72,9% dos casos e perdeu em apenas 6,1%.

Por Redação Mapa Paper15 set
LLM recommender: fine-tuning eleva explicação segura a 95,6%

LLM recommender: fine-tuning eleva explicação segura a 95,6%

Um LLM recomendador ajustado com constrained GRPO passou a explicar suas próprias indicações com fidelidade e sem conteúdo prejudicial, segundo o artigo arXiv:2609.13657v1. A taxa de aprovação nos três critérios avaliados subiu de 64,9% para 95,6% nas avaliações internas e de 67,7% para 93,1% com um juiz independente.

Por Redação Mapa Paper15 set
CoMA-DiT: Diffusion Transformer decodifica estados cerebrais

CoMA-DiT: Diffusion Transformer decodifica estados cerebrais

O CoMA-DiT, Diffusion Transformer bidirecional de aumento cross-modal, superou 20 baselines em decodificação de estados cerebrais multimodais, com ganhos de 4,28% em acurácia e 6,70% em macro-F1. O método trata modalidades pareadas como fontes de supervisão generativa mútua, não apenas como entradas para fusão.

Por Redação Mapa Paper12 set
Mr.LHDR: benchmark testa agentes de deep research de longo prazo

Mr.LHDR: benchmark testa agentes de deep research de longo prazo

O Mr.LHDR, benchmark publicado no arXiv em 10 de setembro de 2026, exige em média 12,1 conclusões intermediárias por pergunta e mostra que o melhor sistema avaliado chega a apenas 43,1% de acurácia geral e 34,3% de acurácia estrita. Remover as imagens derruba o DACS em 12,6 pontos.

Por Redação Mapa Paper12 set