Estudo com 9 LLMs revela limite coletivo em decisões oncológicas
Pesquisadores testaram 9 modelos de IA em 2.005 decisões oncológicas e descobriram que nenhum acerta 42,1% delas. GPT-5.5 e Gemini 3.1 Pro assumem riscos até 5 vezes mais que os demais, sem maior precisão.
