Paper Pilot: sistema de IA contra citações falsas em artigos
Pesquisador propõe no arXiv um sistema de oito portões de aprovação que zerou citações fabricadas em teste. Sem ele, IA inventou até 25% das referências em artigos científicos.
Pesquisador propõe no arXiv um sistema de oito portões de aprovação que zerou citações fabricadas em teste. Sem ele, IA inventou até 25% das referências em artigos científicos.
Uma camada conservadora de correção ortográfica para textos biomédicos recuperou 80,45% do desempenho perdido com ruído de OCR, segundo pré-impressão no arXiv.
A escrita de código não é mais o centro do trabalho de um engenheiro de software. Com agentes de IA como Claude Code, a nova função é projetar as fronteiras que essas ferramentas não podem cruzar, redefinindo a profissão.
Identidade e permissões não bastam para governar agentes de IA empresariais, alerta a CISO da Box, Heather Ceylan. A executiva defende uma abordagem em camadas que inclui governança de execução, porque agentes exploram permissões em escala e velocidade impossíveis para humanos.
O artigo do VentureBeat argumenta que agentes de IA autônomos precisam de identidade própria antes de qualquer gateway. A autenticação tradicional não garante confiança em tempo de execução, exigindo nova mentalidade de segurança.
A análise do VentureBeat mostra que gateways de IA são adotados como primeiro controle, mas dependem de identidade e atribuição inexistentes. A CISA incluiu em junho a falha CVE-2026-42271 do LiteLLM no catálogo KEV, e o gateway acumulou sete CVEs em um mês.
A Cohere lançou o Parse 5, modelo de visão e linguagem de 2,3 bilhões de parâmetros que converte PDFs em Markdown. Ele perde nos benchmarks para GPT-5.5, Opus 4.8 e Gemini 3.5 Flash, mas leva vantagem no custo: US$ 1,50 por mil páginas.
A OpenAI e o MHESI lançaram uma aceleradora de oito semanas para dez startups de IA na Tailândia, focada em saúde, bem-estar e educação. O programa busca transformar protótipos em produtos confiáveis.
Estudo do arXiv mostra que GPT-4.1 e GPT-5.0 automatizam parte da revisão de literatura científica, mas com precisão abaixo da humana em campos subjetivos.
Paper do arXiv propõe o Relational Hypergraph Transformer (RHT), arquitetura que representa bancos relacionais como hipergrafos e reduz a complexidade da atenção em aprendizado multi-tabela. Testado no Synthea, o modelo alcançou embeddings mais coerentes que baselines, enquanto o XGBoost manteve vantagem em recall de códigos raros.