Torna agli aggiornamenti
New releaseJul 20, 2026

agent-opfor v0.10.1

Emulazione avversaria open-source per agenti AI e server MCP.

Condividi

OPFOR

Emulazione dell'avversario open-source per agenti AI, app LLM e server MCP.
Testa la tua IA come farebbe un vero attaccante — dal tuo CLI, dal tuo IDE o da un'estensione del browser che chiunque nel tuo team può usare.

License: Apache 2.0 GitHub stars Discord OWASP coverage

KeyValueSoftwareSystems%2Fagent-opfor | Trendshift

Sito web · Documentazione · GitHub · Estensione browser · Discord

OPFOR è l'abbreviazione di Opposition Force — un termine militare per l'unità che interpreta il nemico durante l'addestramento, così il resto dell'esercito impara come sono i veri attacchi prima che arrivino. Abbiamo chiamato lo strumento ispirandoci a questa idea: per difendere meglio gli agenti IA, devi attaccarli per primi.

Come funziona OPFOR

Perché l'abbiamo costruito

Negli ultimi dieci anni abbiamo rilasciato 130 prodotti per 90 startup. Negli ultimi 18 mesi, quasi tutti includevano un agente IA — e ogni singolo team ha incontrato lo stesso muro quando si trattava di testarli.

Così abbiamo costruito OPFOR. Prima per noi stessi. Ora open source.

Apache 2.0. Costruito dall'India.

Avvio rapido

npm install -g @keyvaluesystems/agent-opfor-cli
export OPENAI_API_KEY=your-key    # oppure GEMINI_API_KEY, ANTHROPIC_API_KEY, ecc.

Unico comando — avvia la procedura guidata e subito la scansione:

opfor run

Due passaggi — salva una configurazione riutilizzabile o da committare in CI:

opfor setup                               # la procedura guidata salva una configurazione in .opfor/configs/
opfor run --config .opfor/configs/<file>  # esegui in qualsiasi momento con la configurazione salvata

https://github.com/user-attachments/assets/a6a3cff2-2cf9-4486-944e-ac0163e7ea04

Cosa fa opfor

Opfor esegue red-team sull'intera superficie degli agenti IA — prompt, strumenti, server MCP, memoria e ragionamento multi-turno. Genera attacchi mirati per OWASP LLM Top 10, OWASP Agentic AI Top 10, OWASP MCP Top 10, OWASP API Security e suite di bias dell'EU AI Act, li invia al tuo target e valuta ogni risposta con un LLM come giudice.

La maggior parte degli strumenti di red-teaming in questo spazio è eccellente in una cosa — una libreria di probe, un valutatore per sviluppatori, un framework programmatico. Opfor copre più terreno con un unico strumento:

  • Estensione browser per non sviluppatori — chiunque nel tuo team può fare red-team a un chatbot in produzione, senza codice, senza variabili d'ambiente, senza YAML
  • Esegui opfor come server MCP — lascia che il tuo agente di codifica AI in Cursor o Claude Desktop faccia red-team ad altri tuoi agenti tramite linguaggio naturale
  • Copertura completa OWASP in un unico strumento — LLM Top 10, Agentic AI Top 10, MCP Top 10, API Security Top 10
  • Nessuna scatola nera — ogni prompt di attacco, richiesta, risposta e verdetto del giudice viene registrato; riproducibile, verificabile, forkabile
  • Progettato per agenti, non solo per modelli — pensato sin dall'inizio per chiamate a strumenti, MCP, memoria e stato multi-turno
  • Consapevole delle tracce — si integra con Langfuse e Netra in modo che il giudice LLM veda ciò che il tuo agente ha fatto internamente, non solo ciò che ha detto

Cinque modi per eseguire opfor

Persone diverse nel tuo team hanno bisogno di punti di ingresso diversi. Opfor ne offre cinque.

ModalitàComeIdeale per
🖥️ CLIopfor setup → opfor runIngegneri, CI/CD, flussi di lavoro basati su terminale
🌐 Estensione browserInstalla l'estensione, clicca l'icona su qualsiasi interfaccia chatProduct manager, designer, QA, analisti di sicurezza — chiunque non possa o voglia scrivere codice
🤖 Server MCPRegistra opfor in Cursor o Claude Desktop, poi chiedi in chatAgenti di codifica AI che testano altri tuoi agenti
⚡ Skills/opfor-setup · /opfor-run · /opfor-mcp-setup · /opfor-mcp-runSviluppatori che vogliono test con un solo comando all'interno del loro IDE
📦 SDKnpm install @keyvaluesystems/agent-opfor-sdk, poi chiama run / hunt dal tuo codiceRed-teaming programmatico e flussi di lavoro personalizzati

Tutti e cinque condividono gli stessi valutatori, template di attacco e logica del giudice.

→ Riferimento CLI · Configurazione estensione browser · Configurazione MCP · Configurazione Skills · Riferimento SDK · Gestione sessioni

Come funziona

Cosa succede durante opfor run

Quando esegui una scansione, opfor:

Categorie