
VulnAgent-X: Um Framework Agêntico em Camadas para Detecção de Vulnerabilidades em Nível de Repositório
VulnAgent-X é um protótipo de detecção de vulnerabilidades/defeitos baseado em múltiplos Agents, voltado à reprodução de pesquisas acadêmicas. A entrada é um repositório local ou um diff, e a saída inclui findings estruturados, cadeia de evidências, resultados de localização, confiança e logs de experimentos.
repo path ou unified diffscreening -> context expansion -> scheduler -> router -> experts -> sceptic -> verification(stub) -> evidence fusionissue_typelocation(file + line range)evidence_summaryconfidenceseverityoptional_cwefix_hintevidence_chaincounter_evidencescreening: triagem rápida de regiões suspeitas (regras + sinais de metadados)context_expansion: recupera o "contexto mínimo suficiente" (extrai janelas ao redor das localizações suspeitas)scheduler: aplica estratégias de escalonamento com base em confiança e risco (early_exit / expert_review / verification)router_agent: seleciona um Agent especialista para cada região suspeitasemantic/security/logic: fornecem alegações e evidências estruturadas sob diferentes perspectivassceptic_agent: gera contraprovas e sinais de penalizaçãoverification: verificação dinâmica opcional (atualmente uma implementação stub segura)evidence_fusion: realiza a fusão unificada e gera os findings finaisRequisitos: Python 3.11+ (também é executado em versões mais recentes)
cd /Users/xiaolu/Documents/Python_code/vulnAgentX
python3 -m venv .venv
source .venv/bin/activate
python -m pip install -e '.[dev]'
Analisar o repositório inteiro:
.venv/bin/vulnagentx analyze --repo /path/to/repo --output json
Analisar um arquivo de diff:
.venv/bin/vulnagentx analyze --diff-file /path/to/patch.diff --output json
Saída resumida:
.venv/bin/vulnagentx analyze --repo /path/to/repo --output summary
Iniciar o serviço:
.venv/bin/uvicorn vulnagentx.app.api:app --reload
Verificação de integridade (health check):
curl http://127.0.0.1:8000/health
Enviar uma análise:
curl -X POST http://127.0.0.1:8000/analyze \
-H "Content-Type: application/json" \
-d '{"repo_path":"/path/to/repo"}'
docker compose -f docker/docker-compose.yml up --build
.venv/bin/ruff check src tests
.venv/bin/mypy src
.venv/bin/pytest
{
"run_id": "...",
"findings": [
{
"issue_type": "command_injection",
"location": {"file_path": "app.py", "start_line": 42, "end_line": 42},
"evidence_summary": "Command execution surface detected...",
"confidence": 0.87,
"severity": "critical",
"optional_cwe": "CWE-78",
"fix_hint": "Avoid shell command composition...",
"source_agents": ["security_agent", "semantic_agent"],
"evidence_chain": [],
"counter_evidence": []
}
],
"metrics": {
"runtime_seconds": 0.07
},
"logs": []
}
| Arquivo | Finalidade |
|---|---|
.env.example | Modelo de variáveis de ambiente (configurações opcionais, como nível de log). |
pyproject.toml | Build do projeto, dependências, entradas de scripts e configuração de pytest/ruff/mypy. |
README.md | README principal (com botões de troca de idioma; padrão: chinês). |
README.zh.md | Documentação completa em chinês. |
README.en.md | Documentação completa em inglês. |
docker/Dockerfile | Arquivo de construção da imagem do contêiner do serviço de API. |
docker/docker-compose.yml | Sobe os serviços de contêiner localmente com um clique. |
rules/semgrep/vulnagentx-rules.yml | Conjunto de regras Semgrep integradas (injeção de comandos/injeção de SQL/desserialização/API C insegura). |
scripts/run_experiment.py | Script de execução de experimentos em lote sobre datasets; gera predições em JSONL. |
scripts/evaluate.py | Lê as saídas dos experimentos e calcula métricas de detecção/localização/eficiência. |
scripts/run_ablation.py | Script de experimentos de ablação (no_semgrep/no_treesitter/no_sceptic/no_verification). |
src/vulnagentx)