olimposec.com
tema

#contexto-longo

1 publicação marcada com esta tag.

risco médioOS-2026-324 · 2026-08-31
0

LongPIBench expõe que defesas contra injeção de prompt falham quando o contexto fica longo

Praticamente todos os benchmarks de injeção de prompt existentes testam contextos curtos, o que segundo os autores infla artificialmente a eficácia percebida das defesas atuais. O LongPIBench cobre quatro cenários realistas — revisão de artigos, triagem de currículos, revisão de código e resumo de e-mails — com contextos de milhares a dezenas de milhares de tokens, e mostra que até ataques simples de injeção conseguem taxas de sucesso altas e contornam defesas de estado da arte nesse regime.

Fonte ↗