O OWASP GenAI Security Project divulgou a edição 2026 do Top 10 para Aplicações LLM, agora fundamentada em milhares de incidentes reais em vez de apenas consenso de especialistas. Junto com a lista, o projeto lançou o Agent Control Standard, dedicado à governança de identidade, permissões e testes de segurança para agentes autônomos, e elevou o risco de 'Excessive Agency' à terceira posição do ranking.
Pesquisadores do grupo de trabalho da OWASP compararam o ranking de riscos do Top 10 para LLMs, definido por consenso de especialistas, com um levantamento de mais de 6.600 incidentes reais extraídos de bases como CVE, GHSA, OSV e AIAAIC. A concordância entre o ranking de especialistas e o ranking baseado em incidentes reais foi fraca (Cohen's kappa ~0,20), embora o próprio ranking de especialistas continue sendo o mais robusto quando testado contra classificadores automatizados de última geração.
Um artigo de opinião argumenta que times de segurança avançaram na descoberta e inventário de agentes de IA dentro das organizações, mas ainda falham em impor limites reais sobre suas ações. A proposta central é migrar de um modelo de permissões estáticas para um enforcement contextual, que correlacione identidade, permissões e intenção antes de autorizar uma ação específica do agente.