
agent-opfor v0.10.2
Émulation d'adversaire open-source pour agents d'IA et serveurs MCP.
Émulation adverse open-source pour agents IA, applications LLM et serveurs MCP.
Testez votre IA comme un véritable attaquant le ferait — depuis votre CLI, votre IDE, ou une extension de navigateur que n'importe qui dans votre équipe peut utiliser.
Site web · Documentation · GitHub · Extension navigateur · Discord
OPFOR est l'abréviation de Opposition Force — un terme militaire désignant l'unité qui joue l'ennemi lors des entraînements, afin que le reste de l'armée apprenne ce que sont de véritables attaques avant qu'elles n'arrivent. Nous avons nommé l'outil d'après cette idée : pour mieux défendre les agents IA, il faut d'abord les attaquer.
Pourquoi nous l'avons construit
Nous avons livré 130 produits pour 90 startups au cours des dix dernières années. Ces 18 derniers mois, presque chacun d'entre eux contenait un agent IA — et chaque équipe s'est heurtée au même mur en matière de tests.
C'est pourquoi nous avons construit OPFOR. D'abord pour nous-mêmes. Maintenant en open source.
Apache 2.0. Construit depuis l'Inde.
Démarrage rapide
npm install -g @keyvaluesystems/agent-opfor-cli
export OPENAI_API_KEY=your-key # ou GEMINI_API_KEY, ANTHROPIC_API_KEY, etc.
En une étape — lance l'assistant de configuration et démarre immédiatement l'analyse :
opfor run
En deux étapes — enregistrez une configuration réutilisable ou à intégrer dans votre CI :
opfor setup # l'assistant enregistre une config dans .opfor/configs/
opfor run --config .opfor/configs/<file> # exécutez à tout moment avec la config sauvegardée
https://github.com/user-attachments/assets/a6a3cff2-2cf9-4486-944e-ac0163e7ea04
Ce que fait opfor
Opfor effectue un red-teaming sur l'ensemble de la surface d'attaque d'un agent IA — invites, outils, serveurs MCP, mémoire et raisonnement multi-tour. Il génère des attaques ciblées pour les OWASP LLM Top 10, OWASP Agentic AI Top 10, OWASP MCP Top 10, OWASP API Security et les suites de biais de l'EU AI Act, les envoie à votre cible et juge chaque réponse avec un LLM.
La plupart des outils de red-teaming dans ce domaine excellent sur un point — une bibliothèque de sondes, un évaluateur développeur, un framework programmatique. Opfor couvre plus de terrain en un seul outil :
- Extension navigateur pour non-développeurs — n'importe qui dans votre équipe peut red-teamer un chatbot déployé, sans code, sans variables d'environnement, sans YAML
- Exécutez opfor en tant que serveur MCP — laissez votre agent de codage IA dans Cursor ou Claude Desktop red-teamer vos autres agents via le langage naturel
- Couverture OWASP complète en un seul outil — LLM Top 10, Agentic AI Top 10, MCP Top 10, API Security Top 10
- Pas de boîte noire — chaque invite d'attaque, requête, réponse et verdict du juge est enregistré ; reproductible, vérifiable, forkable
- Conçu pour les agents, pas seulement les modèles — conçu dès le départ pour les appels d'outils, MCP, la mémoire et l'état multi-tour
- Conscient des traces — s'intègre avec Langfuse et Netra pour que le juge LLM voie ce que votre agent a fait en interne, pas seulement ce qu'il a dit
Cinq façons d'exécuter opfor
Différentes personnes dans votre équipe ont besoin de points d'entrée différents. Opfor en propose cinq.
| Mode | Comment | Idéal pour |
|---|---|---|
| 🖥️ CLI | opfor setup → opfor run | Ingénieurs, CI/CD, workflows centrés sur le terminal |
| 🌐 Extension navigateur | Installez l'extension, cliquez sur l'icône sur n'importe quelle interface de chat | Chefs de produit, designers, QA, analystes de sécurité — tous ceux qui ne peuvent pas ou ne veulent pas coder |
| 🤖 Serveur MCP | Enregistrez opfor dans Cursor ou Claude Desktop, puis demandez dans le chat | Agents de codage IA qui testent vos autres agents |
| ⚡ Compétences | /opfor-setup · /opfor-run · /opfor-mcp-setup · /opfor-mcp-run | Développeurs qui souhaitent des tests en une commande dans leur IDE |
| 📦 SDK | npm install @keyvaluesystems/agent-opfor-sdk, puis appelez run / hunt depuis votre code | Red-teaming programmatique et workflows personnalisés |
Les cinq partagent les mêmes évaluateurs, modèles d'attaque et logique de jugement.
→ Référence CLI · Configuration de l'extension navigateur · Configuration MCP · Configuration des compétences · Référence SDK · Gestion des sessions