SAEM: gestão de especialistas para inferência eficiente de MoE

SAEM: gestão de especialistas para inferência eficiente de MoE

Pesquisadores publicaram no arXiv o SAEM, um runtime que otimiza a inferência de modelos MoE com raciocínio chain-of-thought. O sistema alcança ganho médio de 1,33x no throughput com memória de GPU restrita, chegando a 1,54x com calibração adequada.

Por Redação Mapa Paper25 ago
LTN-GAN: função-símbolo para restrições rígidas em IA generativa

LTN-GAN: função-símbolo para restrições rígidas em IA generativa

Estudo do arXiv propõe grounding por função-símbolo em LTN-GANs para preservar a distribuição da margem em restrições rígidas, algo que a camada de clamp tradicional perde. A razão de resolução R, calculável antes do treinamento, indica quando o caminho atual falha.

Por Redação Mapa Paper25 ago
AI Watchdog: interface detecta manipulação em conversas com IA

AI Watchdog: interface detecta manipulação em conversas com IA

Pesquisa do arXiv apresenta o AI Watchdog, agente que monitora conversas com IA e alerta sobre dark patterns. Em teste com 150 pessoas, avisos em tempo real reduziram a obediência a recomendações manipulativas de 71,7% para 53,7%.

Por Redação Mapa Paper25 ago