Metacognitive Steering controla Kimi 2.6 em pesquisa científica

Metacognitive Steering controla Kimi 2.6 em pesquisa científica

O artigo arXiv:2609.16245v1 apresenta o Metacognitive Steering, controlador de inferência que ajusta o modo de raciocínio do Kimi 2.6 sem alterar seus parâmetros. Aplicado no Columbus-1, o método rendeu oito vulnerabilidades reproduzidas no BlueZ e o projeto de um foguete de dez pés com pouso propulsivo.

Por Redação Mapa Paper16 set
LLMs têm 'eixo da dor' e agem para aliviar, diz estudo

LLMs têm 'eixo da dor' e agem para aliviar, diz estudo

Pesquisadores extraíram uma direção linear de dor em 25 modelos abertos, de cinco famílias e 2B a 72B parâmetros. Modelos Qwen 2.5 ajustados escolheram um botão de alívio mesmo quando ele piorava a resposta ou prejudicava o usuário.

Por Redação Mapa Paper16 set
KV cache em GPU, CPU ou SSD: estudo aponta limites do tiering

KV cache em GPU, CPU ou SSD: estudo aponta limites do tiering

Estudo no arXiv compara políticas de posicionamento de KV cache entre GPU HBM, CPU DRAM e SSD. O tiering garante 73,02 vezes mais sessões por GPU e custo por sessão 62,04 vezes menor, mas o ganho vem das capacidades das camadas, não do algoritmo.

Por Redação Mapa Paper16 set
Novo método de poda neural usa distância de Fisher e supera magnitude

Novo método de poda neural usa distância de Fisher e supera magnitude

Um novo esquema de poda de redes neurais derivado da distância geodésica no espaço de modelos, medida pela métrica de informação de Fisher, superou a poda por magnitude e a poda por Fisher local em MNIST e CIFAR-10, em redes densas e vision transformers.

Por Redação Mapa Paper16 set
UniCAR-RL separa percepção e raciocínio em IA visual

UniCAR-RL separa percepção e raciocínio em IA visual

O UniCAR-RL é um framework de aprendizado por reforço sem anotação humana que separa, no treino, a otimização da percepção visual e a do raciocínio lógico em modelos multimodais. Publicado no arXiv em 12 de setembro de 2026, o método usa três ramos e afirma melhorar matemática visual com apenas dados brutos de resposta curta.

Por Redação Mapa Paper15 set
ViperQ: IA de trading com Auction Market Theory rende +163,6%

ViperQ: IA de trading com Auction Market Theory rende +163,6%

O ViperQ, sistema de reinforcement learning submetido ao arXiv em setembro de 2026, usa primitivas da Auction Market Theory em um vetor de 20 dimensões e recompensa assimétrica baseada em aversão à perda. Nos testes, rendeu +163,6% de ROI em TSLA e +116,5% em NVDA, sem alavancagem.

Por Redação Mapa Paper15 set
CFRC: paper propõe handoff de agentes de IA sem reiniciar a tarefa

CFRC: paper propõe handoff de agentes de IA sem reiniciar a tarefa

O paper arXiv:2609.13800v1 apresenta o Commitment-Frontier Residual Completion (CFRC), método que transfere tarefas entre agentes de IA sem reiniciar o trabalho já feito. Em cinco ambientes e dois pares de modelos, o CFRC iguala a acurácia de agentes full-task gastando de 22,0% a 34,6% do custo de inferência.

Por Redação Mapa Paper15 set
PASS: IA agêntica prevê onde publicar seu artigo científico

PASS: IA agêntica prevê onde publicar seu artigo científico

O PASS, sistema de IA agêntica apresentado no arXiv, prevê em qual revista um manuscrito tem mais chance de ser publicado. Acertou o periódico exato em 50,3% dos casos e o Top-5 em 86,1%, em teste com mais de 2 mil preprints de 16 áreas biomédicas. A plataforma já está aberta em ratemypaper.ai.

Por Redação Mapa Paper15 set
Superposição: guardar histórico completo ajuda raciocínio de LLMs

Superposição: guardar histórico completo ajuda raciocínio de LLMs

Artigo no arXiv mostra que a superposição cumulativa, que retém todo o histórico de raciocínio em estados latentes, pode exigir menos dimensões que a abordagem de fronteira. O estudo também prova que a ponderação cumulativa uniforme é minimax-ótima para raciocínio robusto.

Por Redação Mapa Paper15 set