olimposec.com
tema

#seguranca-de-llm

2 publicações marcadas com esta tag.

panoramaOS-2026-344 · 2026-09-02
0

Pesquisa mostra que restrições de segurança em LLMs se combinam bem, mas a utilidade do modelo não

Um estudo sobre 'implantação com gating de capacidades' — controle de acesso por usuário dentro de um único conjunto de pesos de LLM — mostra que restrições de segurança individualmente inofensivas se compõem de forma previsível quando combinadas (a interseção de restrições de múltiplos perfis aprofunda a supressão), mas o mesmo não vale para a utilidade do modelo, que pode se degradar de forma imprevisível quando perfis são combinados.

Fonte ↗
panoramaOS-2026-348 · 2026-09-02
0

SoK mapeia como falhas de segurança se propagam em sistemas multiagente de LLM mesmo quando cada agente é seguro

Um trabalho de sistematização de conhecimento (SoK) revisa 197 estudos sobre segurança de sistemas multiagente de LLM (MAS) e propõe um framework que organiza ataques por posição do adversário, interface de interação e risco sistêmico resultante, mostrando que falhas emergem do fluxo de informação, estado, decisões e autoridade entre agentes — não apenas de falhas locais em um agente isolado.

Fonte ↗