#1Herramientas de seguridad LLM, inyección de prompts, extracción de modelos, IA adversaria y red teaming de IA.
Recomendado por Kitploit

Punto de referencia para evaluar los riesgos de seguridad de los agentes que usan computadoras, con 104 escenarios realistas de uso indebido en siete…
Código de investigación y conjunto de datos (WSD) para evaluar el impacto de la marca de agua de audio en la anti-suplantación, utilizando wav2vec2…

Evita contenido restringido y censurado en los prompts de chat de IA 😈

Detección pasiva de viveza facial en 3D (Anti-Spoofing) y detección de Deepfake. Se necesita una sola imagen para calcular la puntuación de viveza.…

Librería de pruebas de privacidad para sistemas de deep learning, que permite evaluar la susceptibilidad a ataques de inferencia de membresía,…

Un PoC para CVE-2024-3660. Ejecución arbitraria de código en Keras.

Una falla de inyección de indicaciones de alta gravedad en Claude AI demuestra que incluso los modelos de lenguaje más inteligentes pueden…

Exploit de prueba de concepto para CVE-2025-23266 (NVIDIAScape) dirigido al runtime de contenedores de IA de NVIDIA. Demuestra el escape de…

Herramienta automatizada de reconocimiento de dominios web y evaluación de seguridad que integra enumeración de subdominios, escaneo de puertos,…

Este estudio analiza vulnerabilidades de deserialización de pickle en Python, centrándose en CVE-2024-3568 en TFAutoModel de Hugging Face…

Demostración de investigación de ataques de inyección de prompts indirectos para controlar agentes web autónomos basados en LLM, con herramientas…

PowerShell-based detection and remediation toolkit para CVE-2025-32711 (EchoLeak), una vulnerabilidad crítica de inyección de comandos de IA de cero…

Exploit para Langflow AI Remote Code Execution (No autenticado)

Código para el artículo Certified Unlearning for Neural Networks, ICML 2025

[CVPR 2025-ADVML] Repositorio oficial de `Attacking Attention of Foundation Models Effectively Disrupts Downstream Tasks`

Una colección de ejemplos de modelos de amenazas del mundo real en diversas tecnologías, que proporciona información práctica para identificar y…

Flow Integrity Deterministic Enforcement System. Mecanismos para proteger agentes de IA con control de flujo de información.

AISA-Scanner es un escáner de vulnerabilidades autónomo impulsado por IA que mapea CVEs con exploits de Metasploit, MITRE, CEH y SANS, ofreciendo…