olimposec.com
tema

#llm-local

2 publicações marcadas com esta tag.

risco altoOS-2026-387 · 2026-09-09
0

Ataque de canal lateral por cache da CPU reconstroi o texto gerado por LLMs locais durante a detokenizacao

Pesquisadores demonstram um ataque que reconstroi o texto de saida de LLMs rodando localmente observando apenas a atividade do cache da CPU durante a etapa de detokenizacao, usando Flush+Reload no codigo compartilhado do tokenizador para saber quando a decodificacao ocorre e Prime+Probe para isolar a atividade de cache dependente de cada token, seguido por um pipeline de clustering e modelo de linguagem para recuperar o texto a partir das observacoes ruidosas. Ao contrario de ataques anteriores que exigiam memoria compartilhada, offloading de CPU ou arquiteturas Mixture-of-Experts especificas, este mira o detokenizador, componente padrao presente em praticamente todo pipeline de inferencia local, incluindo sistemas agenticos como o OpenClaw, ampliando bastante a superficie pratica de ataque.

Fonte ↗
risco altoOS-2026-195 · 2026-08-10
0

Kimsuky monta stack de IA offline em servidores próprios para escalar phishing e desenvolvimento de malware

O grupo de espionagem norte-coreano Kimsuky passou a operar modelos de linguagem localmente em seus próprios servidores — usando Ollama, GPT4All e Msty, além de bibliotecas como LLaMaSharp e Microsoft Semantic Kernel — em vez de depender de chatbots públicos. A empresa sul-coreana Genians, que descobriu a operação, relata uso de RAG sobre documentos e credenciais já roubados, e integração com a campanha em curso "Operation GitPower", que abusa repositórios GitHub como canal de comando.

Fonte ↗