#1Herramientas de seguridad LLM, inyección de prompts, extracción de modelos, IA adversaria y red teaming de IA.
Recomendado por Kitploit

Firewall de agente de IA de código abierto que escanea tráfico HTTP, MCP, A2A y WebSocket en busca de exfiltración, SSRF e inyección de prompts,…
El índice más completo y actualizado continuamente de la comunidad sobre investigación de Modelos de Lenguaje de Gran Tamaño para la detección de…

Marco de trabajo de código abierto para red-teaming de sistemas de IA generativa: automatiza prompts de ataque, puntúa las respuestas del modelo y…

Un proxy de credenciales HTTP y vault para agentes de IA como Claude Code, OpenClaw, Hermes, agentes personalizados + harnesses, y más.

cMCP: Puerta de enlace MCP confidencial. Aplicación de políticas atestiguada por hardware para llamadas a herramientas MCP.

Asistente de pruebas de penetración impulsado por IA para automatizar el reconocimiento, la toma de notas y el análisis de vulnerabilidades.

Colección curada de recursos, laboratorios y materiales de formación en ciberseguridad que abarcan hacking ético, pruebas de penetración, desarrollo…

Laboratorio de evaluación de comportamiento (Quorum) para el proyecto superpowers que impulsa CLIs reales de agentes de codificación (Claude, Codex,…

Repositorio de código abierto para validar aplicaciones de IA agéntica: red team, comportamiento, cadena de suministro, análisis estático.

Automatiza flujos de trabajo basados en navegador con IA.

Entorno multiagente autoalojado para Go con agentes de pentesting impulsados por LLM (exploiter, reverser, threathunter, webscanner) que automatizan…

Un intérprete de Python minimalista y seguro escrito en Rust para uso por IA

Read-only AI agent that queries your cloud, code, and runtime infrastructure to surface misconfigurations, leaked secrets, and privilege escalation…

Sistema operativo seguro y privado para agentes de IA con almacenamiento local cifrado, autenticación OAuth/SSO, control de acceso basado en…

Sandboxes de Linux ligeros y seguros para procesos no confiables. Se ejecuta en el navegador y en el servidor.

AttackGen es una herramienta de pruebas de respuesta a incidentes de ciberseguridad que aprovecha el poder de los grandes modelos de lenguaje y el…

Un runtime* seguro para agentes de IA autónomos. Política a partir de constituciones en inglés sencillo. (*https://ironcurtain.dev)

Aislamiento adecuado para codificación con agentes y navegación web