
agent-opfor v0.10.1
Emulação de adversário de código aberto para agentes de IA e servidores MCP.
Emulação adversária open‑source para agentes de IA, aplicações LLM e servidores MCP.
Teste sua IA como um atacante real faria — a partir do terminal, da sua IDE ou de uma extensão de navegador que qualquer membro da equipa pode usar.
Site · Documentação · GitHub · Extensão para navegador · Discord
OPFOR é a abreviatura de Opposition Force — um termo militar para a unidade que faz o papel de inimigo nos treinos, para que o resto do exército aprenda como são os ataques reais antes que eles aconteçam. Nomeámos a ferramenta com essa ideia em mente: para defender melhor os agentes de IA, primeiro tens de os atacar.
Porque construímos isto
Entregámos 130 produtos para 90 startups nos últimos dez anos. Nos últimos 18 meses, quase todos tinham um agente de IA — e todas essas equipas bateram no mesmo muro ao testá-lo.
Por isso construímos o OPFOR. Primeiro para nós. Agora open source.
Apache 2.0. Feito na Índia.
Início rápido
npm install -g @keyvaluesystems/agent-opfor-cli
export OPENAI_API_KEY=your-key # or GEMINI_API_KEY, ANTHROPIC_API_KEY, etc.
Passo único — executa o assistente de configuração e inicia imediatamente a verificação:
opfor run
Dois passos — guarda uma configuração que podes reutilizar ou enviar para CI:
opfor setup # wizard saves a config to .opfor/configs/
opfor run --config .opfor/configs/<file> # run any time against the saved config
https://github.com/user-attachments/assets/a6a3cff2-2cf9-4486-944e-ac0163e7ea04
O que o opfor faz
O opfor testa a superfície completa de agentes de IA — prompts, ferramentas, servidores MCP, memória e raciocínio multi‑turno. Gera ataques direcionados para OWASP LLM Top 10, OWASP Agentic AI Top 10, OWASP MCP Top 10, OWASP API Security e conjuntos de preconceito da EU AI Act, dispara‑os contra o teu alvo e avalia cada resposta com um LLM.
A maioria das ferramentas de red‑team neste espaço é excelente numa coisa — uma biblioteca de sondas, um avaliador para programadores, um framework programático. O Opfor cobre mais terreno com uma única ferramenta:
- Extensão de navegador para não‑programadores — qualquer membro da equipa pode fazer red‑team a um chatbot implantado, sem código, sem variáveis de ambiente, sem YAML
- Executa o opfor como servidor MCP — deixa o teu agente de IA no Cursor ou Claude Desktop testar os teus outros agentes em linguagem natural
- Cobertura OWASP completa numa só ferramenta — LLM Top 10, Agentic AI Top 10, MCP Top 10, API Security Top 10
- Sem caixa‑negra — cada prompt de ataque, pedido, resposta e veredito do juiz é registado; reproduzível, auditável, bifurcável
- Feito para agentes, não apenas para modelos — desenhado desde o primeiro dia para chamadas de ferramentas, MCP, memória e estado multi‑turno
- Consciente de rastreios — integra‑se com Langfuse e Netra para que o juiz LLM veja o que o teu agente fez internamente, não apenas o que disse
Cinco formas de executar o opfor
Diferentes pessoas na tua equipa precisam de diferentes pontos de entrada. O Opfor fornece cinco.
| Modo | Como | Melhor para |
|---|---|---|
| 🖥️ CLI | opfor setup → opfor run | Engenheiros, CI/CD, fluxos centrados no terminal |
| 🌐 Extensão de navegador | Instala a extensão, clica no ícone em qualquer interface de chat | Gestores de produto, designers, QA, analistas de segurança — qualquer um que não consiga ou não queira escrever código |
| 🤖 Servidor MCP | Regista o opfor no Cursor ou Claude Desktop, depois pergunta no chat | Agentes de IA que programam e testam os teus outros agentes |
| ⚡ Skills | /opfor-setup · /opfor-run · /opfor-mcp-setup · /opfor-mcp-run | Programadores que querem testes com um comando dentro da IDE |
| 📦 SDK | npm install @keyvaluesystems/agent-opfor-sdk, depois chama run / hunt a partir do teu código | Red‑teaming programático e fluxos personalizados |
Todos os cinco partilham os mesmos avaliadores, modelos de ataque e lógica de juiz.
→ Referência do CLI · Configuração da extensão para navegador · Configuração do MCP · Configuração de Skills · Referência do SDK · Gestão de sessões
Como funciona
Quando executas uma verificação, o opfor: