Estudo: gates determinísticos e LLM para agentes falham de forma parecida

Estudo: gates determinísticos e LLM para agentes falham de forma parecida

Pesquisa no arXiv testou 1.119 ações de agentes de IA e mediu pilhas de proteção com uma camada de regras e quatro juízes de LLM. Dois juízes empilhados equivalem a apenas 1,2 a 1,4 camadas de proteção efetiva, o que questiona a lógica de empilhar gates para reduzir risco.

Por Redação Mapa Paper7 out
Paper propõe defesa em camadas contra sycophancy em LLMs

Paper propõe defesa em camadas contra sycophancy em LLMs

O paper arXiv:2610.07403v1 propõe um framework 2x2 que separa defesas internas e externas contra sycophancy em LLMs. No Llama 3.1 8B, o Router Gate reduziu a bajulação média de 35,80% para 31,32%, mas sem significância estatística.

Por Redação Mapa Paper7 out
2D-FET-Bench V2 testa IA no design de transistores em flakes 2D

2D-FET-Bench V2 testa IA no design de transistores em flakes 2D

O benchmark 2D-FET-Bench V2, publicado no arXiv, reúne 128 tarefas para medir se agentes de modelo de linguagem desenham layouts de transistores em flakes 2D. A melhor configuração, GPT5.6-Luna com ReAct-3, passou em 62,3% das tentativas e teve 43,8% de consistência.

Por Redação Mapa Paper7 out
Alucinações em LLMs: o que são e como reduzir o risco

Alucinações em LLMs: o que são e como reduzir o risco

Alucinação em LLM é a resposta errada entregue com a mesma segurança da certa. Entenda por que o modelo inventa e quais técnicas, de RAG a verificação em camadas, reduzem o risco em aplicações reais.

Por Redação Mapa Paper6 out
Estudo mede contágio de crenças entre agentes de IA

Estudo mede contágio de crenças entre agentes de IA

Pesquisa no arXiv mede pela primeira vez a probabilidade de agentes de LLM adotarem uma afirmação conforme o endosso dos pares. A adoção segue curva sigmoide e o consenso coletivo se mostra mais difícil de desfazer do que de criar.

Por Redação Mapa Paper5 out
GHOST: falha de segurança em agentes de IA atinge 11,5% no GPT-5.5

GHOST: falha de segurança em agentes de IA atinge 11,5% no GPT-5.5

Pesquisa publicada no arXiv em 2 de outubro de 2026 descreve o GHOST, falha em agentes de longo horizonte que ignora restrições de segurança definidas muitas interações antes. A taxa de ocorrência chegou a 11,5% no GPT-5.5. Uma defesa em duas camadas, o STAR-Guard, zerou os casos nos experimentos.

Por Redação Mapa Paper5 out
SR-OPD corta até 96% dos tokens de professor na destilação de LLMs

SR-OPD corta até 96% dos tokens de professor na destilação de LLMs

A técnica SR-OPD, apresentada em artigo no arXiv, usa rollouts bem-sucedidos do próprio aluno como referência para escolher quais falhas recebem supervisão do professor. Nos testes, consumiu entre 3,46% e 5,02% dos tokens de input exigidos pelo método tradicional, com desempenho de raciocínio comparável.

Por Redação Mapa Paper5 out
LLMs erram ao atualizar julgamento clínico, diz estudo no arXiv

LLMs erram ao atualizar julgamento clínico, diz estudo no arXiv

Estudo no arXiv avaliou LLMs com trajetórias de UTI e encontrou dois modos de falha na revisão de julgamento clínico: reação mais forte à piora do que à melhora e ancoragem no risco prévio. O prompting não corrigiu o comportamento.

Por Redação Mapa Paper5 out