IA usa preferências para melhorar alocação de transplantes de coração
Pesquisadores propuseram um algoritmo que aprende preferências sobre resultados de transplantes de coração, alcançando 0,95 de eficiência ante 0,54 da política atual.
Pesquisadores propuseram um algoritmo que aprende preferências sobre resultados de transplantes de coração, alcançando 0,95 de eficiência ante 0,54 da política atual.
Pesquisadores lançaram o RegDivergence-101, um benchmark com 101 pares de exigências da FDA e da EMA para classificar concordância, divergência ou silêncio regulatório. No teste, o Claude Haiku alcançou 0,830 de macro-F1, superando métodos de grafo e lexical.
Pesquisadores publicaram no arXiv o C3-UniMM, um framework que propõe usar um grafo causal estruturado para unificar compreensão e geração multimodal, prometendo superar os modelos atuais.
Pesquisador propõe no arXiv um sistema de oito portões de aprovação que zerou citações fabricadas em teste. Sem ele, IA inventou até 25% das referências em artigos científicos.
Uma camada conservadora de correção ortográfica para textos biomédicos recuperou 80,45% do desempenho perdido com ruído de OCR, segundo pré-impressão no arXiv.
A escrita de código não é mais o centro do trabalho de um engenheiro de software. Com agentes de IA como Claude Code, a nova função é projetar as fronteiras que essas ferramentas não podem cruzar, redefinindo a profissão.
Identidade e permissões não bastam para governar agentes de IA empresariais, alerta a CISO da Box, Heather Ceylan. A executiva defende uma abordagem em camadas que inclui governança de execução, porque agentes exploram permissões em escala e velocidade impossíveis para humanos.
O artigo do VentureBeat argumenta que agentes de IA autônomos precisam de identidade própria antes de qualquer gateway. A autenticação tradicional não garante confiança em tempo de execução, exigindo nova mentalidade de segurança.
A análise do VentureBeat mostra que gateways de IA são adotados como primeiro controle, mas dependem de identidade e atribuição inexistentes. A CISA incluiu em junho a falha CVE-2026-42271 do LiteLLM no catálogo KEV, e o gateway acumulou sete CVEs em um mês.
A Cohere lançou o Parse 5, modelo de visão e linguagem de 2,3 bilhões de parâmetros que converte PDFs em Markdown. Ele perde nos benchmarks para GPT-5.5, Opus 4.8 e Gemini 3.5 Flash, mas leva vantagem no custo: US$ 1,50 por mil páginas.