Pesquisa desvada por que 'skills' de IA funcionam — e quando falham
Pesquisa do arXiv analisa 8.135 experimentos e revela que skills de LLM estabilizam execução (65,7% dos casos) mas não injetam conhecimento — e que retrieval cai de 29,6% a 3,3% com pools maiores.
