IB-RL: novo método de RL para agentes de diálogo estratégico

IB-RL: novo método de RL para agentes de diálogo estratégico

Pesquisa propõe treinar os dois lados de um diálogo estratégico com reinforcement learning isolado. O método atingiu 98,4% de acordo contra o DeepSeek V4 Pro em Deal-or-NoDeal, ante 86,4% do melhor baseline unilateral.

Por Redação Mapa Paper11 ago
Meta lança Muse Glimmer, modelo de IA aberto para agentes

Meta lança Muse Glimmer, modelo de IA aberto para agentes

A Meta lançou o Muse Glimmer, um modelo de 30B parâmetros com pesos abertos sob licença Apache 2.0, projetado para rodar agentes de IA localmente em hardware de consumidor. É o primeiro lançamento totalmente open source da empresa desde a aposentadoria do Llama.

Por Redação Mapa Paper11 ago
Google lança NAI para tornar interfaces mais acessíveis com IA

Google lança NAI para tornar interfaces mais acessíveis com IA

O Google Research apresentou o framework Natively Adaptive Interfaces (NAI), que usa IA multimodal para adaptar interfaces às necessidades de cada usuário. A iniciativa reforça o princípio de design universal e mira os 1,3 bilhão de pessoas com deficiência no mundo.

Por Redação Mapa Paper11 ago
Google ensina LLMs a raciocinar como Bayesianos

Google ensina LLMs a raciocinar como Bayesianos

Pesquisadores do Google Research ensinam LLMs a imitar a inferência bayesiana, melhorando a capacidade de recomendação e a generalização para novas tarefas.

Por Redação Mapa Paper11 ago