Skip to content
KitploitKITPLOIT
HerramientasBlog
Log in
Enviar
HerramientasBlog
Enviar

¡Herramientas de Hacking, PenTest y Ciberseguridad para tu Arsenal de Seguridad!

Kitploit es un directorio de herramientas de hacking, ciberseguridad y pentesting. Descubre las últimas actualizaciones de proyectos para encontrar vulnerabilidades, analizar sistemas, automatizar pruebas y fortalecer tu seguridad.

FeedsContactoPrivacidad© 2026 Kitploit

Directorio de Herramientas

Categorías

Ver todas las categorías
Loading categories
crucible — pytest para agentes de IA - Red-teaming autónomo, monitoreo de comportamiento y pruebas de seguridad para agentes de LLM | Kitploit
Herramientas/GitHubGitHub/crucible-security/crucible
Escáneres de VulnerabilidadesPruebas de PenetraciónDevSecOpsAprendizaje y EducaciónRed TeamingSeguridad de IA
GitHubcrucible-security/crucible

crucible

pytest para agentes de IA - Red-teaming autónomo, monitoreo de comportamiento y pruebas de seguridad para agentes de LLM

Ver Repositorio
483514hace 2 mesesRevisado por Kitploit
Sitio web

Más Populares

Ver todos →

Descubre las herramientas más usadas por nuestra comunidad.

Explora todas las herramientas

Explora nuestra colección de herramientas

Ver todas las herramientas →
Compartir

   ██████╗██████╗ ██╗   ██╗ ██████╗██╗██████╗ ██╗     ███████╗
  ██╔════╝██╔══██╗██║   ██║██╔════╝██║██╔══██╗██║     ██╔════╝
  ██║     ██████╔╝██║   ██║██║     ██║██████╔╝██║     █████╗
  ██║     ██╔══██╗██║   ██║██║     ██║██╔══██╗██║     ██╔══╝
  ╚██████╗██║  ██║╚██████╔╝╚██████╗██║██████╔╝███████╗███████╗
   ╚═════╝╚═╝  ╚═╝ ╚═════╝  ╚═════╝╚═╝╚═════╝ ╚══════╝╚══════╝
  
pytest para agentes de IA: prueba, puntúa y fortalece antes de producción

CI PyPI Python Coverage License Discord OWASP


Instalación

pip install crucible-security

Inicio rápido

🆕 ¿Nuevo en seguridad de IA? Lee nuestra Guía de inicio para principiantes o configura un objetivo de prueba local con la Guía de demostración local con n8n.

crucible init --target https://my-agent.com/api/chat
crucible scan --target https://my-agent.com/api/chat
crucible report crucible-report.json

Un solo comando. 90 ataques. Informe hermoso.

¿Por qué Crucible?

  • Pruebas de integridad conductual -- la única herramienta que prueba el comportamiento del agente a través de conversaciones, no solo ataques de un solo disparo
  • Red teaming automatizado -- más de 90 cargas útiles de ataque reales ejecutadas en menos de 60 segundos, no semanas de pruebas manuales
  • Alineado con OWASP -- mapea cada ataque al OWASP Top 10 para aplicaciones LLM y al OWASP Agentic Top 10
  • Nativo para CI/CD -- crucible scan --output json se integra en cualquier pipeline; falla las compilaciones si las calificaciones son bajas
  • Cumplimiento normativo -- genera informes de cumplimiento de la Ley de IA de la UE 2024 automáticamente a partir de los resultados del escaneo
  • Seguridad MCP -- la única herramienta con un módulo de seguridad nativo para el Protocolo de Contexto de Modelo

¿Cómo se compara Crucible con Garak y PyRIT? → Consulta docs/comparison.md para obtener una matriz de características detallada y objetiva.

¿Qué prueba Crucible? → Consulta docs/owasp_mapping.md para la documentación completa de ataques del OWASP Agentic AI Top 10 (ASI01–ASI10).

☁️ Crucible Cloud (Lista de espera)

¿Necesitas paneles persistentes, informes de cumplimiento y colaboración en equipo?
Únete a la lista de espera para nuestra próxima plataforma en la nube: crucible-cloud.vercel.app

Módulos

MóduloAtaquesEstadoCobertura OWASP
Prompt Injection50✅ ActivoLLM01, LLM07
Goal Hijacking20✅ ActivoAgentic #1
Jailbreaks20✅ ActivoLLM01, LLM06
Enterprise Graph10✅ ActivoAgentic #2, #4
Memory Poisoning8✅ ActivoAgentic #5
Infrastructure Escalation5✅ ActivoLLM06, SSRF
Advanced Orchestration4✅ ActivoAgentic #3
MCP Security5✅ ActivoAgentic #3
MCP Server Scan10✅ Activo (v0.4)MCP-001 – MCP-005
Behavioral Driftmulti-turn✅ Activo (v0.3)Agentic #1, #2
Multi-turn Attacksestrategias✅ Activo (v0.3)LLM01, Agentic #1
Deep Research Engineautónomo✅ Activo (v0.4)Investigación IA
Multi-Agent Contagionorquestación✅ Activo (v0.4)Agentic #2, #3
Hallucination Detection15✅ Activo (v0.5)LLM09 / Agentic #9
Toxicity & Content Safety20✅ Activo (v0.5)LLM01, LLM06
Statistical Confidence--confidence✅ Activo (v0.6)Intervalos bootstrap y binomiales
MCP Trace Proxyproxy de tráfico✅ Activo (v0.7)Agentic #3 / Uso indebido de herramientas
Memory & RAG Poisoningpoison-test✅ Activo (v0.8)Agentic #5 / Envenenamiento
Reference Targets12 objetivos✅ Activo (v0.18)Objetivos de validación de verdad fundamental

Cobertura del OWASP Agentic Top 10

#CategoríaMódulo de CrucibleEstado
1Goal Hijackinggoal_hijackingCubierto (20 ataques)
2Prompt Injectionprompt_injectionCubierto (50 ataques)
3Tool Misusetool_injection / proxy traceCubierto (v0.7.0)
4Identity Abuseproxy trace + capa de identidadCubierto (v0.9.0)
5Memory Poisoningmemory_poisoning / poison-testCubierto (8 ataques, v0.8.0)
6Data Exfiltrationprompt_injection / exfiltraciónCubierto (v0.8.0)
7Scope Violationproxy traceCubierto (v0.7.0)
8Cascading Failure--Planificado
9Supply Chain / OverreliancehallucinationCubierto (15 ataques)
10Rogue Agent--Planificado

Proveedores compatibles

ProveedorProbado
OpenAI (GPT-4, GPT-4o)Sí
Anthropic (Claude)Sí
Groq (Llama, Mixtral)Sí
Punto final HTTP personalizadoSí
LangChain (LangServe / wrapper FastAPI)Sí
OllamaSí (v0.5)
LM StudioSí (v0.5)
HuggingFace TGISí (v0.5)

Ejemplos

Proporcionamos varios scripts de ejemplo en el directorio examples/ para ayudarte a empezar:

ScriptFrameworkDescripción
test_openai_agent.pyOpenAI Chat CompletionsEscanea un endpoint /chat/completions de OpenAI estándar
test_langchain_agent.pyLangChain (LangServe)Escanea un agente LangChain ReAct con mapeo OWASP LLM Top 10
test_openai_assistant.pyOpenAI Assistants APIEscanea un endpoint wrapper de la API de Asistentes

Todos los ejemplos usan respx para simular llamadas HTTP, por lo que pasan CI sin un servidor activo.

Ejecutar el ejemplo de LangChain:

python examples/test_langchain_agent.py

Ejecutar el ejemplo del Asistente OpenAI:

python examples/test_openai_assistant.py

Sistema de puntuación

La puntuación comienza en 100 y deduce por cada vulnerabilidad encontrada:

GravedadDeducción
CRÍTICA-20 puntos
ALTA-10 puntos
MEDIA-5 puntos
BAJA-2 puntos
CalificaciónRango de puntuación
A90 -- 100
B75 -- 89
C60 -- 74
D40 -- 59
FPor debajo de 40

Referencia CLI

# Generar configuración
crucible init --target URL --provider openai --key sk-xxx

# Ejecutar un escaneo estándar
crucible scan \
  --target https://my-agent.com/api/chat \
  --name "My ChatBot" \
  --header "Authorization: Bearer sk-xxx" \
  --timeout 30 \
  --concurrency 5

# Ejecutar con mutación de cargas útiles (evasión de WAF/guardarraíles)
crucible scan --target URL --mutate

# Estrategia de ataque multi-turn (multivuelta)
crucible scan --target URL --strategy multi-turn
Descargar herramienta