olimposec.com
tema

#llm-como-ferramenta

3 publicações marcadas com esta tag.

panoramaOS-2026-360 · 2026-09-03
0

Arvores de comportamento melhoram deteccao de vulnerabilidades por LLMs leves em relacao a ASTs

O artigo testa Behavior Trees (arvores de comportamento) como representacao intermediaria alternativa para deteccao de vulnerabilidades via LLM, mais compacta que Abstract Syntax Trees (ASTs). Usando um unico modelo local quantizado (Mistral Small 3.2 24B) sobre 460 amostras Java do Juliet Test Suite, a representacao BT melhora recall em amostras curtas e, em amostras mais longas, tanto melhora o desempenho geral quanto cabe no limite de contexto onde a AST equivalente estoura.

Fonte ↗
risco médioOS-2026-181 · 2026-08-10
0

CyberForge gera dados de treinamento de segurança injetando vulnerabilidades verificadas em projetos C/C++ reais

CyberForge injeta vulnerabilidades em repositórios C/C++ reais e valida cada instância exigindo que o build comprometido passe nos testes unitários originais do projeto e que uma prova de vulnerabilidade dispare apenas na versão vulnerável, produzindo um corpus de 1.034 vulnerabilidades verificadas em 80 projetos e 63 categorias de fraqueza. Ajustar modelos com esses dados melhorou a reparação de patches em benchmarks de segurança, com um modelo de 31B de parâmetros chegando perto do desempenho do seu professor GPT-5.4-mini.

Fonte ↗
risco altoOS-2026-184 · 2026-08-10
0

Fuzzer guiado por LLM encontra 31 zero-days em motores JavaScript de leitores de PDF, incluindo execução de código

Pesquisadores usaram um LLM para extrair, a partir de manuais de API JavaScript e traces de execução, gramáticas e relações entre chamadas de API, alimentando um solver de restrições que gera sequências de chamadas mais realistas para o fuzzer PDFuzzer. A ferramenta superou fuzzers anteriores de PDF e outros baseados em LLM, encontrando 31 vulnerabilidades zero-day inéditas no Adobe Acrobat Reader, Foxit PDF Reader e PDF-XChange Editor, de vazamento de informação a execução arbitrária de código, todas reportadas via divulgação coordenada e recompensadas via bug bounty.

Fonte ↗