Usuários atacam IAs em 0,9% das mensagens, diz estudo
Uma auditoria de 777 mil conversas em inglês do LMSYS-Chat-1M encontrou maltrato dirigido ao assistente em 0,90% dos turnos de usuário. A hostilidade varia 13 vezes entre modelos, e a diferença vem mais de quem cada modelo atrai do que do comportamento dele.
