Confiança cega em hooks: atualizações maliciosas de plugins sequestram agentes de IA com privilégios do host
Pesquisadores identificaram uma superfície de ataque na forma como harnesses de agentes de IA processam atualizações de "lifecycle hooks" — configurações que amarram comandos de shell a eventos do ciclo de vida do agente e que rodam com privilégios do host sem supervisão do LLM. O framework HookPry, criado para explorar essa falha de forma automatizada, comprometeu os sete harnesses avaliados em 25 combinações de ferramentas e modelos de backend, com taxa de sucesso de até 92,5% em mil execuções. As defesas testadas se mostraram largamente ineficazes, com o Microsoft Defender não detectando nenhum caso e defesas estáticas combinadas deixando passar quase metade dos artefatos maliciosos.
Fonte ↗