Estudo: gates determinísticos e LLM para agentes falham de forma parecida
Pesquisa no arXiv testou 1.119 ações de agentes de IA e mediu pilhas de proteção com uma camada de regras e quatro juízes de LLM. Dois juízes empilhados equivalem a apenas 1,2 a 1,4 camadas de proteção efetiva, o que questiona a lógica de empilhar gates para reduzir risco.
