
SkillSpector
Security scanner for AI agent skills. Detect vulnerabilities, malicious patterns, security risks, prompt injection, data exfiltration, and…

Security scanner for AI agent skills. Detect vulnerabilities, malicious patterns, security risks, prompt injection, data exfiltration, and…

Security Scanner for Agent Skills

Security for the modern age of AI: defend against bad AI agents and malicious npm packages

Security scanner for AI/ML model files. Detects malicious code, backdoors, and vulnerabilities before deployment

Proxy server that wraps MCP servers with behavioral profiling, security scanning, risk gating, and safe execution. Detects prompt injection,…

Proof-of-concept for CVE-2026-23001: demonstrates RCE through unsafe pickle deserialization in Hugging Face Transformers by crafting a malicious…

CVE-2026-45033 PoC for Claude Code, not Github Copilot. Worked for Haiku 4.5.

Investigate malicious Windows logon by visualizing and analyzing Windows event log

Official code for the ISSTA 2026 paper: Is "Knowing It’s Malicious" Enough? Evaluating LLMs for Fine-Grained Malware Behavior Auditing

Pre-auth RCE scanner for Langflow < 1.8.0 — Route Injection + Vertex Injection → Code Execution (CVSS 9.8)

Static security scanner for AI agent skill packages. Detects malicious SKILL.md files and bundled scripts before they run.

Docker Container Escape POC via mlx-metal importlib

AI-driven automated threat analysis pipeline that routes files, URLs, IPs, domains, or images through specialized security analyzers and generates…

image scaling attacks for multi-modal prompt injection

IFRIT is an AI-powered reverse proxy that intercepts incoming requests in real time, classifying each one as legitimate or malicious. Legitimate…

GitHub Action that scans ML model files for malicious code and security vulnerabilities

Proof-of-concept exploit for CVE-2025-32434, a pickle deserialization vulnerability in PyTorch's weights_only mode, demonstrating malicious tar file…

Benchmark for evaluating safety risks of computer-using agents, with 104 realistic misuse scenarios across seven malicious categories, supporting…