#1Frameworks de ataque de ML adversario, técnicas de evasión y herramientas de evaluación de robustez de modelos.
Recomendado por Kitploit

Defensa de IA en producción con protección de 7 capas: restricciones matemáticas, acceso por capacidades de objetos, consenso O2 distribuido, ética…
Diferentes métodos para detectar un entorno virtualizado o un posible debugging

Técnica de inyección de prompts en múltiples etapas que evita la alineación de seguridad de los LLM mediante la reasignación de identidad, la…

Una simulación adversarial de IA de Red Team vs. Blue Team.

Marco de diagnóstico para medir la vulnerabilidad de los LLM ante la Erosión Contextual Afectiva (ACE) y vectores de ataque liminales relacionados.…

Modelo de aprendizaje automático intencionalmente vulnerable para formación práctica en seguridad. Explora vulnerabilidades comunes de ML, ataques…

Self-referenced local contrast for knowledge-poison detection in retrieval-augmented generation

Este proyecto (PoC por ahora, y parte de Shit Bucket) implica detección de rostros, reconocimiento facial y entrada adversarial para proteger avatares

PoC de puente entre cadenas para CVE-2026-23003: demuestra la falsificación de mensajes mediante la falta de ID de cadena de origen utilizando un…

POC de ejecución remota de código de contenedor Docker a host mediante vllm-metal trust_remote_code=True

Repositorio de código para el proyecto CS5446 que explora defensas contra ataques de jailbreak en modelos de lenguaje grandes. Incluye conjuntos de…

Exploit basado en RowHammer

POC de SecOpsMaesttro

Detector multicapa de inyección de prompts para aplicaciones de IA que utiliza heurísticas, análisis basado en LLM, firmas de ataque de vectorDB y…

El kit de seguridad para interacciones con LLM

Una forma un poco más divertida de deshabilitar Windows Defender + firewall. (a través de la API WSC)

The Python Risk Identification Tool for generative AI (PyRIT) es un framework de código abierto diseñado para capacitar a los profesionales de la…

Código de ejemplo para suplantación de DNS con envenenamiento ARP.