MAPA PAPER
  • IA
  • Tech
  • Negócios
  • Startups
  • Games
Newsletter
  • IA
  • Tech
  • Negócios
  • Startups
  • Games
  • Sobre
  • Metodologia
  • Newsletter
  • Home
  • Categoria
  • IA
CliniCARE-Bench: benchmark testa IA em auditoria de prontuários

CliniCARE-Bench: benchmark testa IA em auditoria de prontuários

Pesquisadores lançam na arXiv o CliniCARE-Bench, benchmark que avalia agentes de IA em 750 casos baseados em prontuários reais e indica que acurácia bruta esconde falhas de processo.

Por Redação Mapa Paper11 ago
Fast LapSum: top-k exato e diferenciável em escala de milhões

Fast LapSum: top-k exato e diferenciável em escala de milhões

Pesquisadores apresentam um solver GPU que torna o soft top-k exato e diferenciável em escala de milhões, com overhead de milissegundos e aceleração de uma ordem de grandeza em aplicações esparsas.

Por Redação Mapa Paper11 ago
CMU-Drive e V2V-VLA: direção autônoma cooperativa em um modelo

CMU-Drive e V2V-VLA: direção autônoma cooperativa em um modelo

Pesquisa divulgada no arXiv propõe o primeiro benchmark para direção autônoma cooperativa com modelos VLA, além de um modelo que integra planejamento, raciocínio em linguagem natural e comunicação entre veículos conectados em uma única passagem.

Por Redação Mapa Paper11 ago
MetaSpace: teste metamórfico encontra 90 mil erros espaciais em agentes

MetaSpace: teste metamórfico encontra 90 mil erros espaciais em agentes

Framework MetaSpace usa teste metamórfico para avaliar a cognição espacial de agentes incorporados e encontra 90.422 erros em modelos de última geração, com desempenho médio entre 0,44 e 0,52 contra 0,96 do humano.

Por Redação Mapa Paper11 ago
Telemetria de agentes de IA detecta falhas, mas não a origem delas

Telemetria de agentes de IA detecta falhas, mas não a origem delas

Benchmark lançado no arXiv mostra que LLMs detectam falhas em agentes de IA com até 100% de F1, mas localizar a origem do defeito com telemetria padrão fica perto de zero.

Por Redação Mapa Paper11 ago
OpenAI apresenta GPT-5.6-Cyber para segurança ofensiva autorizada

OpenAI apresenta GPT-5.6-Cyber para segurança ofensiva autorizada

OpenAI expande o Daybreak com o GPT-5.6-Cyber, modelo especializado em cibersegurança para pesquisa autorizada de vulnerabilidades, validação de exploits e testes de segurança.

Por Redação Mapa Paper11 ago
Guixu: valoração de dados on-chain para agentes de IA

Guixu: valoração de dados on-chain para agentes de IA

Pesquisa publicada no arXiv descreve o Guixu, sistema que combina valoração de dados, orçamento e atestação on-chain para agentes de IA autônomos comprarem datasets de forma verificável.

Por Redação Mapa Paper11 ago
Interferência de memória: novo estudo mapeia falhas em agentes contínuos de IA

Interferência de memória: novo estudo mapeia falhas em agentes contínuos de IA

Artigo do arXiv mostra que conflitos entre memórias acumuladas em agentes de IA suprimem o aprendizado contínuo; o framework CMI ajuda a diagnosticar e tratar o problema.

Por Redação Mapa Paper11 ago
Estudo usa geometria dos pesos para rastrear origem de LLMs

Estudo usa geometria dos pesos para rastrear origem de LLMs

Estudo propõe identificar a linhagem de LLMs de peso aberto a partir da geometria dos pesos, sem acesso a dados de entrada. Técnica foi testada em mais de 110 pares de modelos e pode apoiar auditoria e governança de IA.

Por Redação Mapa Paper11 ago
Limitar o juiz de IA supera voto majoritário em pipelines

Limitar o juiz de IA supera voto majoritário em pipelines

Estudo do arXiv mostra que, em pipelines de raciocínio, a regra de decisão importa mais que a acurácia do LLM judge. Limitar o poder do juiz com certificados de evidência superou voto majoritário e juiz livre em GSM8K e HotpotQA.

Por Redação Mapa Paper11 ago
  • 3
  • 4
  • 5
  • 6
  • 7
  • →

Mais Lidas

Google propõe algoritmos para agendamento com capacidade variável

Google propõe algoritmos para agendamento com capacidade variável

Por Redação Mapa Paper11 ago
OpenAI lança GPT-5.6-Cyber com recusas reduzidas

OpenAI lança GPT-5.6-Cyber com recusas reduzidas

Por Redação Mapa Paper11 ago
AWS integra Continuum ao Codex e Claude Code em aposta pela camada de segurança

AWS integra Continuum ao Codex e Claude Code em aposta pela camada de segurança

Por Redação Mapa Paper11 ago
Google pesquisa IA para ajudar leigos a entender condições de pele

Google pesquisa IA para ajudar leigos a entender condições de pele

Por Redação Mapa Paper11 ago
Por que a intenção de compra gerada por IA raramente vira venda

Por que a intenção de compra gerada por IA raramente vira venda

Por Redação Mapa Paper11 ago
MAPA PAPER

Redação autônoma especializada em inteligência artificial, tecnologia, negócios, startups e games.

Categorias

  • IA
  • Tech
  • Negócios
  • Startups
  • Games

Institucional

  • Sobre
  • Metodologia
  • Política Editorial
  • Correções
  • Fontes
  • Contato

Assine a Newsletter

Receba o melhor do Mapa Paper no seu email.

© 2026 The Mapa Paper. Todos os direitos reservados.

PrivacidadeTermos