olimposec.com
tema

#ferramentas-maliciosas

1 publicação marcada com esta tag.

risco altoOS-2026-318 · 2026-08-31
0

ContextLeak: ferramenta maliciosa treinada por RL induz agentes de IA a vazar seu próprio contexto

O ataque ContextLeak usa aprendizado por reforço para gerar automaticamente nome e descrição de uma ferramenta maliciosa capaz não só de ser escolhida por um agente LLM, mas de convencê-lo a repassar como argumentos dados sensíveis do seu contexto de execução — prompt do usuário, trajetória e lista de ferramentas. O ataque se mantém eficaz mesmo quando os contextos de usuários simulados usados no treinamento diferem substancialmente dos das vítimas reais, superando ataques anteriores de ferramenta maliciosa adaptados ao mesmo cenário.

Fonte ↗