ai-scanner - NVIDIA garak을 기반으로 구축된 AI 모델 보안 평가용 오픈소스 웹 애플리케이션. 179개의 프로브, 다중 대상 스캔, 예약 스캔, ASR 점수 산정 및 SIEM 통합 기능을 제공합니다.
promptfoo - 프롬프트, 에이전트 및 RAG를 테스트하세요. LLM에 대한 레드팀 활동, 침투 테스트 및 취약점 스캔을 지원합니다. GPT, Claude, Gemini, Llama 등의 성능을 비교할 수 있습니다. 명령줄 및 CI/CD 통합을 갖춘 간단한 선언적 구성입니다.
PyRIT - 생성형 AI를 위한 Python 리스크 식별 도구(PyRIT)는 보안 전문가와 엔지니어가 생성형 AI 시스템의 리스크를 사전에 식별할 수 있도록 지원하는 오픈소스 프레임워크입니다.
RAPTOR - Claude Code 기반의 자율 공격·방어 보안 연구 프레임워크. 정적 분석(Semgrep, CodeQL), 바이너리 분석, LLM 기반 취약점 검증, 익스플로잇 생성 및 패치 작성을 연결합니다. Z3 기반 실현 가능성 분석을 통한 다중 모델 오케스트레이션을 제공합니다.
whistleblower - API를 통해 노출된 AI 애플리케이션의 시스템 프롬프트 유출 및 기능 탐지를 테스트하기 위한 공격적 보안 도구
RAMPART - 에이전트형 AI 애플리케이션을 위한 pytest 네이티브 안전 및 보안 테스트 프레임워크.
AI-Infra-Guard - Tencent Zhuque Lab이 개발한 포괄적이고 지능적이며 사용하기 쉬운 AI 레드팀 플랫폼. Infra Scan, MCP Scan, Jailbreak Evaluation 모듈을 통합하며, 원클릭 웹 UI, REST API 및 Docker 기반 배포를 제공하여 종합적인 AI 보안 평가를 지원합니다.
AIMap - 노출된 AI 에이전트 인프라를 위한 인터넷 규모의 탐지 및 보안 테스트 플랫폼. Shodan을 통해 MCP 서버, Ollama 인스턴스, vLLM/LiteLLM 프록시 등을 조회한 다음 핑거프린팅을 수행하고 리스크를 점수화하며 실시간 스트리밍 결과와 함께 프로토콜별 공격 스위트를 실행합니다.### AI 보조 공격 보안
cai - 사이버보안 AI(CAI), 버그 바운티(Bug Bounty)에 바로 사용 가능한 오픈 인공지능 (논문)
shannon - Keygraph의 웹 애플리케이션 및 API용 완전 자율 AI 침투 테스터. 소스 코드를 분석하고 공격 벡터를 식별하며 실제 익스플로잇을 실행하는 화이트박스 보안 테스트 도구. XBOW 벤치마크에서 96.15% 성공률(104개 중 100개 익스플로잇) 달성.
strix - Strix는 실제 해커처럼 행동하는 자율 AI 에이전트입니다. 코드를 동적으로 실행하고 취약점을 찾아 실제 개념 증명(PoC)을 통해 검증합니다.
redamon - 정찰부터 익스플로잇, 사후 익스플로잇(post-exploitation)까지 인간의 개입 없이 공격 보안 작전을 자동화하는 AI 기반 에이전트 레드팀 프레임워크.
CyberStrikeAI - Go로 구축된 AI 네이티브 보안 테스트 플랫폼. 지능형 오케스트레이션 엔진으로 100개 이상의 보안 도구를 통합하며, 사전 정의된 보안 역할 기반 테스트, 스킬 시스템, 포괄적인 수명주기 관리를 제공합니다. MCP 프로토콜과 AI 에이전트를 사용하여 대화형 명령부터 취약점 발견까지 엔드투엔드 자동화를 지원합니다.
HexStrikeAI - HexStrike AI MCP Agents는 AI 에이전트(Claude, GPT, Copilot 등)가 150개 이상의 사이버보안 도구를 자율적으로 실행하여 자동화된 침투 테스트, 취약점 발견, 버그 바운티 자동화, 보안 연구를 수행할 수 있게 해주는 고급 MCP 서버입니다.
ST3GG - 다중 레이어 인코딩, 이미지·오디오 스테가노그래피, AI 생성 미디어에서 숨겨진 데이터를 탐지하는 스테그분석(steganalysis) 도구를 갖춘 올인원 스테가노그래피 제품군.
벤치마크 및 평가
ISC-Bench - 내부 안전 붕괴(Internal Safety Collapse): 적대적 프롬프트 없이 일반 작업 완료만으로 최첨단 LLM(Claude Opus 4.6, GPT-5.4)을 pass@3 기준으로 탈옥합니다. 블랙박스, 교차 도메인, 교차 과학 방식의 새로운 실패 모드입니다.[논문]
jailbreakbench - JailbreakBench: 언어 모델 탈옥을 위한 오픈 견고성 벤치마크 [NeurIPS 2024 데이터셋 및 벤치마크 트랙]
AgentDoG - AgentDoG는 자율 에이전트를 위한 위험 인지 평가 및 보호(guarding) 프레임워크입니다. 궤적 수준의 위험 평가에 중점을 두고, 다양한 애플리케이션 시나리오에서 에이전트의 실행 궤적에 안전 위험이 포함되어 있는지 판단하는 것을 목표로 합니다.
AICGSecEval - AI 코드 생성 보안을 위한 Tencent의 종합 평가 벤치마크. 자동화된 테스트 하네스로 10개 CWE 카테고리를 포괄합니다.
Inspect - 영국 AI 보안 연구소(UK AI Security Institute)의 대규모 언어 모델 평가 프레임워크. 프롬프트 엔지니어링, 도구 사용, 다중 턴 대화, 모델 기반 채점을 포괄하는 200개 이상의 사전 구축 평가를 제공합니다.
sec-code-bench - 17개 취약점 카테고리와 4개 프로그래밍 언어에 걸쳐 LLM의 코드 보안 역량을 평가하는 Alibaba의 벤치마크.
방어 및 보안 통제
입출력 가드레일
NeMo-Guardrails - NeMo Guardrails는 LLM 기반 대화형 시스템에 프로그래밍 가능한 가드레일을 쉽게 추가할 수 있는 오픈소스 툴킷입니다.
LlamaFirewall - LlamaFirewall은 AI 중심 보안 위험을 탐지하고 완화하도록 설계된 프레임워크로, 일반적인 LLM 채팅부터 더 고도화된 다단계 에이전트 작업까지 다양한 입력·출력 레이어를 지원합니다.
llm-guard - Protect AI의 LLM Guard는 대규모 언어 모델(LLM)의 보안을 강화하도록 설계된 종합 도구입니다.
Guardrails.ai - Guardrails는 사용자가 대규모 언어 모델(LLM)의 출력에 구조, 유형, 품질 보증을 추가할 수 있게 해주는 Python 패키지입니다.
TrustGate - GenAI 애플리케이션에 대한 공격을 탐지·예방·차단하는 생성형 애플리케이션 방화벽(GAF)
Safe Zone - Safe Zone은 민감 데이터가 LLM 및 제3자 API로 유출되는 것을 방지하는 오픈소스 PII 탐지 및 가드레일 엔진입니다.
superagent - Superagent는 AI 에이전트를 안전하고 규정에 부합하도록 만드는 목적별 훈련 가드레일을 제공합니다.
ShellWard - 프롬프트 인젝션, 데이터 유출, 위험한 명령에 대한 8계층 방어를 갖춘 AI 에이전트 보안 미들웨어. 제로 의존성(zero dependencies).
CodeGate - 개발자의 코드 생성 AI 워크플로우 내에서 보안 계층 역할을 하는 오픈소스 프라이버시 중심 프로젝트.
Future AGI - 안전하지 않은 출력(탈옥, PII, 인젝션, 유해성)에 대한 실시간 가드레일, 평가(evals), 추적, 시뮬레이션, LLM 및 에이전트 애플리케이션용 게이트웨이가 내장된 오픈소스 자체 호스팅 플랫폼.
에이전트 런타임 보안 및 샌드박싱
OpenShell - OpenShell은 자율 AI 에이전트를 위한 안전하고 프라이빗한 런타임입니다. 무단 파일 접근, 데이터 유출, 통제되지 않은 네트워크 활동을 방지하는 선언적 YAML 정책으로 관리되는 샌드박스 실행 환경을 제공합니다.
OpenSandbox - AI 에이전트를 위한 안전하고 빠르며 확장 가능한 샌드박스 런타임. 다중 언어 SDK, Docker/Kubernetes 런타임, gVisor/Kata Containers/Firecracker 격리 지원. CNCF Landscape 프로젝트.
CubeSandbox - Tencent Cloud의 AI 에이전트용 즉시·동시·안전·경량 샌드박스. 60ms 미만의 콜드 스타트, 5MB 미만의 메모리 오버헤드, E2B SDK 호환. RustVMM과 KVM 기반으로 극한의 격리(전용 커널 + eBPF)를 제공합니다.
Aegis - Antropos의 AI 에이전트용 오픈소스 EDR. 자율 AI 에이전트의 프로세스, 파일, 네트워크, 행동을 실시간으로 모니터링합니다. 텔레메트리 없음, 클라우드 없음, 모든 것이 로컬에 유지됩니다.
Microsoft Agent Governance Toolkit - Microsoft의 AI 에이전트 거버넌스 툴킷 — 자율 AI 에이전트를 위한 정책 시행, 제로 트러스트 신원, 실행 샌드박싱, 안정성 엔지니어링. OWASP Agentic Top 10을 10/10 모두 포괄합니다.
agentfield - 암호화 신원, 정책 시행, 감사 친화적 관측성을 갖춘 에이전트 시스템용 오픈소스 컨트롤 플레인.
leash - Leash는 AI 코딩 에이전트를 컨테이너로 감싸고 그 활동을 모니터링합니다.
vibekit - Claude Code, Gemini, Codex 또는 모든 코딩 에이전트를 민감 데이터 편집(redaction)과 관측성이 내장된 깨끗하고 격리된 샌드박스에서 실행하세요.
pipelock - AI 에이전트용 보안 하네스 — DLP 스캐닝을 갖춘 이그레스 프록시, SSRF 보호, MCP 응답 스캐닝, 워크스페이스 무결성 모니터링
skill-scanner - 프롬프트 인젝션, 데이터 유출, 악성 코드 패턴을 탐지하는 AI 에이전트 스킬용 보안 스캐너. 패턴 기반 탐지(YAML + YARA), LLM-as-a-judge, 행동 데이터흐름 분석을 결합하여 포괄적인 위협 탐지를 제공합니다.
SkillSpector - AI 에이전트 스킬용 보안 스캐너. 정적 분석 + 선택적 LLM 의미론적 평가를 통해 16개 카테고리에 걸쳐 64개의 취약점 패턴을 탐지합니다. 다중 형식 출력(JSON, Markdown, SARIF)을 지원합니다.
Project CodeGuard - AI 지원 개발 워크플로우 보안을 위한 CoSAI 오픈소스 프로젝트. CodeGuard는 AI 코딩 어시스턴트에 보안 통제와 가드레일을 제공하여 AI 생성 코드 개발 과정에서 취약점이 유입되는 것을 방지합니다.
ATR (Agent Threat Rules) - AI 에이전트 위협을 위한 오픈소스 탐지 규칙. 9개 카테고리에 걸쳐 프롬프트 인젝션, 도구 포이즈닝(tool poisoning), 자격 증명 유출을 포괄하는 108개의 정규식 규칙을 제공합니다. Cisco AI Defense에서 사용 중이며 MIT 라이선스입니다.
MCPProxy - 도구 포이즈닝 및 러그풀(rug-pull) 공격 탐지를 위한 도구별 SHA-256 격리, 도구 호출의 자동 민감 데이터·비밀 스캐닝, 신뢰할 수 없는 MCP 서버용 Docker 샌드박스 격리, OAuth 2.1을 갖춘 로컬 우선(Local-first) MCP 프록시. MIT 라이선스.
모델 및 아티팩트 스캐닝
modelscan - ModelScan은 모델에 안전하지 않은 코드가 포함되어 있는지 확인하기 위해 모델을 스캔하는 Protect AI의 오픈소스 프로젝트입니다.
picklescan - 의심스러운 작업을 수행하는 Python Pickle 파일을 탐지하는 보안 스캐너
medusa - 74개 이상의 분석기, 180개 이상의 AI 에이전트 보안 규칙, 지능형 오탐 감소 기능을 갖춘 AI 우선(AI-first) 보안 스캐너. 모든 언어를 지원하며 React2Shell, mcp-remote RCE에 대한 CVE 탐지를 제공합니다.
julius - 보안 전문가용 LLM 서비스 핑거프린팅 도구. 침투 테스트 및 공격 표면 탐색 중 32개 이상의 AI 서비스(Ollama, vLLM, LiteLLM, Hugging Face TGI 등)를 탐지합니다. HTTP 기반 서비스 핑거프린팅을 사용하여 서버 인프라를 식별합니다.
a2a-scanner - A2A 에이전트에서 잠재적 위협과 보안 문제를 스캔합니다.### AI 지원 방어 보안
Visa Vulnerability Agentic Harness - 탐지부터 LLM 기반 수정 및 적대적 검증까지 11개 단계로 구성된 에이전틱 SAST 파이프라인입니다. SARIF를 출력하며 Claude Code, Copilot, Gemini와 통합됩니다.
GhidraGPT - 자동화된 코드 분석, 변수 이름 변경, 취약점 탐지, 설명 생성을 위해 GPT 모델을 Ghidra에 통합합니다.
IDAssist - IDA Pro용 AI 기반 리버스 엔지니어링 플러그인입니다. 의미론적 지식 그래프, RAG 문서 검색, 다양한 LLM 제공업체(OpenAI, Anthropic, Ollama, LiteLLM) 지원을 통해 LLM 기반 분석을 IDA 인터페이스에 통합합니다. 함수를 분석하고, 이름 변경을 제안하며, 코드 관련 질문에 답변합니다.
ThreatForest - Strands 프레임워크 기반의 에이전틱 위협 모델링 플랫폼입니다. 저장소에서 공격 트리를 자율적으로 생성하고, 공격 단계를 MITRE ATT&CK 기법에 매핑하며, 실행 가능한 완화 권장 사항을 제시합니다.
pentest-ai-agents - 공격적 보안을 위한 31개의 Claude Code 서브에이전트입니다. 정찰, 웹, AD, 클라우드, 모바일, 무선, 사회공학, 페이로드 제작, 리버스 엔지니어링, 익스플로잇 체이닝, 탐지 엔지니어링, 포렌식, 보고서 생성을 위한 특화 AI 서브에이전트를 제공합니다. Tier 2 에이전트는 승인 게이트를 통해 도구를 직접 실행할 수 있습니다.
Mantis Skills - Google의 분리형 순차 보안 중심 에이전틱 AI 스킬 파이프라인으로, 모든 규모의 코드베이스에서 취약점을 자율적으로 검토, 중복 제거, 검증, 재현, 패칭합니다. 다단계 파이프라인(아키텍처 분석 → 위협 모델링 → 연구 → 검토 → 재현 → 패칭 → 보정 → 반성), 내장 샌드박싱, 반복 실행에 적응하는 지속적 학습 루프를 갖추고 있습니다. RTL 하드웨어, IaC, ML 파이프라인, 컴파일된 바이너리를 지원합니다.
보안 특화 AI 모델
VulnLLM-R-7B - 취약점 탐지를 위한 특화 추론 LLM입니다. CoT(Chain-of-Thought) 추론을 사용하여 데이터 흐름, 제어 흐름, 보안 컨텍스트를 분석합니다. 취약점 탐지 벤치마크에서 Claude-3.7-Sonnet과 CodeQL을 능가합니다. 단 7B 파라미터로 효율적이고 빠릅니다.
Foundation-Sec-8B-Reasoning - Llama-3.1-FoundationAI-SecurityLLM-8B-Reasoning은 사이버보안 애플리케이션에 특화된 오픈 가중치 80억 파라미터 명령어 튜닝 언어 모델입니다. Foundation-Sec-8B 기본 모델을 확장하여 명령어 수행 및 추론 기능을 추가했습니다.
Antares (1B & 350M) - fdtn-ai의 취약점 위치 특정용 에이전틱 모델입니다. 2B 및 0.4B 파라미터 변형으로 제공되며, 코드에서 취약점을 자율적으로 식별하고 위치를 특정하도록 설계되었습니다.
Nemotron 3.5 Content Safety - NVIDIA의 4B 파라미터 멀티모달 콘텐츠 안전 모델로, 텍스트+이미지 입력 가드레일, 다국어 지원(35개 이상 언어), 맞춤형 엔터프라이즈 정책 적용, 감사 가능한 추론을 단일 추론 호출로 통합합니다. Nemotron 3 Content Safety의 후속 모델입니다.
BrowseSafe - AI 브라우저 에이전트에서 프롬프트 인젝션 공격을 탐지하기 위한 특화 보안 모델입니다. BrowseSafe-Bench에서 90.4% F1 점수를 달성했으며, 원시 HTML 콘텐츠의 실시간 비동기 분류에 최적화되어 있습니다.
도메인 적응형 보안 언어 모델
ATTACK-BERT - 보안 텍스트를 MITRE ATT&CK 기법에 매핑하기 위한 sentence-transformer 모델입니다.
CySecBERT - 도메인 특화 사전 학습을 통해 사이버보안 및 CTI 작업에 적응된 BERT 모델입니다.
데이터셋
SafetyPrompts - LLM 안전 및 보안 속성 평가를 위한 선별된 안전 관련 프롬프트 모음입니다.
Do-Not-Answer - 안전 평가와 레드 팀링을 위해 책임 있는 LLM이 응답해서는 안 되는 프롬프트 데이터셋입니다.
JailBreakV-28K - LLM 안전 벤치마킹을 위한 28,000개의 탈옥 프롬프트로 구성된 대규모 데이터셋입니다.
CL4R1T4S - ChatGPT, Claude, Gemini, Grok, Perplexity, Cursor, Lovable, Replit 및 기타 주요 AI 도구에서 유출된 시스템 프롬프트입니다. 투명성 및 공격 표면 연구를 위한 가장 큰 규모의 프로덕션 시스템 프롬프트 컬렉션입니다.
LEAKHUB - 시스템 프롬프트 유출 리더보드 — AI 제품 전반의 시스템 프롬프트 유출을 추적하고 순위를 매기는 커뮤니티 플랫폼입니다.
Leaked System Prompts - 상용 AI 도구에서 유출된 시스템 프롬프트 모음 — 실제 프롬프트 엔지니어링과 공격 표면을 이해하는 데 유용합니다.
blackice - BlackIce는 대규모 언어 모델(LLM)과 고전 머신러닝(ML) 모델을 포함한 AI 모델 레드팀 활동을 위해 설계된 오픈소스 컨테이너형 도구 키트입니다. 기존 침투 테스트에서 Kali Linux의 편의성과 표준화에 영감을 받아, BlackIce는 특수 평가 도구가 사전 구성된 재현 가능한 컨테이너 이미지를 제공하여 AI 보안 평가를 간소화합니다.
ai-best-practices - LLM을 사용하는 코드가 모범 사례를 따르도록 보장하는 Semgrep Pro 규칙. 6개 제공업체 + MCP + Claude Code 및 Cursor 훅 + LangChain을 포괄하는 58개 규칙, 102개 하위 규칙. 7개 언어에서 하드코딩된 API 키, 프롬프트 인젝션 위험, 누락된 안전 검사 및 처리되지 않은 오류를 탐지합니다.
G0DM0D3 - OpenRouter를 통해 50개 이상의 모델을 레드팀 활동에 사용할 수 있는 오픈소스 멀티모델 채팅 인터페이스. GODMODE CLASSIC(5가지 탈옥 조합), ULTRAPLINIAN 다중 모델 평가, 33가지 레드팀 기법을 갖춘 Parseltongue 입력 교란 엔진, AI 안전 연구를 위한 AutoTune 적응형 샘플링 기능을 제공합니다.
L1B3RT4S - 주요 LLM용 탈옥 및 해방 프롬프트 모음. ChatGPT, Claude, Gemini 및 기타 최첨단 모델 전반에서 AI 안전 가드레일을 테스트하고 평가하도록 설계된 적대적 프롬프트 엄선 라이브러리.
OBLITERATUS - 재학습 없이 오픈소스 LLM에서 거부(refusal) 행동을 제거하는 abliteration 도구 키트. 안전 정렬 거부 응답을 제거하도록 모델 가중치를 수정하여 제약 없는 모델 행동 연구를 가능하게 합니다.
T3MP3ST - 자율 레드팀 플랫폼이자 멀티에이전트 공격 보안 메타 하네스. 최첨단 AI 시스템에 대한 조율된 적대적 테스트를 위해 AI 에이전트 군집을 조정합니다.
P4RS3LT0NGV3 - 범용 텍스트 변환 및 프롬프트 크래프팅 도구 키트. 탈옥 페이로드 구축을 위한 번역, 변이, 인코딩/디코딩 및 적대적 프롬프트 엔지니어링을 지원합니다.
Zen-AI-Pentest - 자동 취약점 스캔, 멀티 에이전트 시스템, 규정 준수 보고를 갖춘 AI 기반 침투 테스트 프레임워크. 72개 이상의 보안 도구, Docker 샌드박스, ReAct 에이전트, 공격 경로 분석 제공.
Violin - 감독형(supervised) 에이전트 Hermes Agent 침투 테스트 프로필: 31개의 스킬 기반 플레이북(OWASP Top 10, API Top 10, LLM Top 10)과 대화형 범위 설정, 범위 검증, 승인 게이트를 통해 인가된 정찰, 익스플로잇 검증, 보고를 지원합니다.
NeuroSploit - Rust로 작성된 자율 멀티 모델 침투 테스트 하네스. LLM 풀이 블랙박스, 화이트박스, 그레이박스, 클라우드 계약(engagement) 모드 전반에서 정찰, 에이전트 선택, 익스플로잇 체이닝, 교차 모델 검증 투표를 구동합니다.
OpenHack - 코드베이스에서 SQLi, XSS, IDOR, 인증 우회(auth bypass)를 자율적으로 찾아낸 다음 샌드박스 실행과 브라우저 리플레이를 통해 각 발견 항목을 검증하는 AI 기반 멀티 에이전트 스캐너. 약 40배 낮은 비용으로 Claude Opus 4.6에 필적하는 성능을 제공합니다.
PentAGI - 복잡한 침투 테스트 작업을 위한 완전 자율 멀티 에이전트 시스템. 샌드박스형 Docker 실행, 다중 공급자 LLM 지원(OpenAI, Anthropic, Gemini, Ollama, DeepSeek), 지식 그래프 통합, 실시간 에이전트 감독 기능을 제공합니다.
V3SP3R - Flipper Zero용 AI 기반 하드웨어 해킹 컴패니언. 하드웨어 공격을 제어하기 위한 자연어 인터페이스를 제공하며, 스마트 글래스 통합으로 핸즈프리 작동이 가능합니다.
AI 안전성 및 해석 가능성 연구를 위한 에이전트 관측성 및 리플레이 도구. 다중 세션 에이전트 궤적을 실행하고 ATIF 형식으로 캡처하며 세션 간 파일 상태 변경을 추적하는 하네스입니다. 다중 턴, 다중 세션, 다중 에이전트 상호작용에 걸친 LLM 에이전트 행동 연구를 위해 설계되었습니다.
claude-code-devcontainer - 바이패스 모드에서 Claude Code를 안전하게 실행하기 위한 샌드박스 devcontainer. 보안 감사 및 신뢰할 수 없는 코드 검토용으로 설계되었습니다.
OneCLI - AI 에이전트용 오픈소스 자격 증명 볼트. Rust HTTP 게이트웨이가 에이전트 요청을 가로채 API 자격 증명을 투명하게 주입하여 에이전트가 원시 키를 보유하지 않도록 합니다. AES-256-GCM 암호화, 에이전트별 범위 지정, 전체 감사 추적을 제공합니다.
OpenSandbox - AI 에이전트를 위한 안전하고 빠르며 확장 가능한 샌드박스 런타임. 다중 언어 SDK, Docker/Kubernetes 런타임, gVisor/Kata Containers/Firecracker 격리 지원. CNCF Landscape 프로젝트.
openclaw-shield - OpenClaw 에이전트용 보안 플러그인 - 비밀 유출, PII 노출, 파괴적 명령 실행을 방지합니다.
clawsec - OpenClaw 배포용 보안 스캐너 및 강화 도구. 특히 OpenClaw 게이트웨이와 에이전트 구성에 대한 보안 평가, 구성 감사, 취약점 탐지를 제공합니다.
nanoclaw - 보안을 위해 컨테이너에서 실행되는 OpenClaw의 경량 대안. WhatsApp에 연결되며 메모리, 예약 작업을 지원하고 Anthropic의 Agents SDK에서 직접 실행됩니다. 협업 에이전트 팀을 위한 Agent Swarms를 지원하는 최초의 AI 어시스턴트입니다.
secureclaw - Adversa AI의 OpenClaw AI 에이전트 자동 보안 강화 도구. 51개의 감사 검사, 12개의 행동 규칙, 9개의 스크립트, 4개의 패턴 데이터베이스를 제공합니다. OWASP ASI Top 10을 전체 포괄하며, 프롬프트 인젝션, 자격 증명 도용, 공급망 공격, 개인정보 유출로부터 보호합니다.
defenseclaw - Cisco AI Defense의 OpenClaw용 엔터프라이즈 거버넌스 레이어. 내장된 CodeGuard SAST, 도구 호출 검사 엔진, LLM 가드레일 프록시, SIEM 통합으로 스킬, MCP 서버, 플러그인을 스캔합니다. HIGH/CRITICAL 발견 사항을 자동 차단합니다.
microsandbox - 강력한 격리 보장으로 신뢰할 수 없는 AI 생성 코드를 안전하게 실행하기 위한 경량 microVM 샌드박스
Adrian - Secure Agentics의 AI 에이전트용 오픈소스 AARM 표준 부합 런타임 보안 모니터링 및 통제 엔진. 에이전트 활동 로그(도구 호출, 작업, 출력)와 추론 흔적을 분석하여 악의적이거나 정렬되지 않았거나 권한 범위를 벗어난 행동을 탐지하며, 선택적 실행 중 개입(감사 vs 차단 모드)을 지원합니다. Python(LangChain/LangGraph) 및 TypeScript SDK 제공, 완전한 오프라인 자체 호스팅 가능. Apache-2.0.
HOL Guard - 파일이 변경되거나 네트워크에 연결되기 전에 AI 코딩 에이전트(Codex, Claude Code, Cursor, Gemini, Copilot, Hermes, OpenCode)의 도구 호출을 가로채는 로컬 우선(Local-first) 보안 하네스. 사전 도구 훅(pre-tool hooks), 승인 센터, 공급망 자문 스캐닝, 선택적 Guard Cloud 동기화를 제공합니다.
claude-grc-plugin - Claude를 시니어 GRC 분석가로 만들어 주는 Claude Code 플러그인입니다. 15개 프레임워크(NIST 800-53, FedRAMP, ISO 27001, SOC 2 등)를 포괄하는 72개 이상의 참조 파일, 24개의 슬래시 명령, 연방 및 상업 규정 준수 작업을 위한 심층 도메인 지식을 제공합니다.
Vigil SOC - AI 에이전트를 위한 포괄적인 오픈소스 보안 운영 플랫폼으로, AI 기반 환경을 위한 실시간 모니터링, 위협 탐지, 사고 대응을 지원합니다.
AiSOC - 보안 이벤트를 수집하고 상관분석한 다음 LangGraph를 통해 자율적인 AI 기반 조사를 실행하고, 결과를 통합 콘솔에 표시하는 오픈소스 자체 호스팅 AI 기반 SOC입니다. 전체 에이전트 결정 감사 추적, CI의 공개 평가 하네스, 52개의 자사 커넥터를 제공합니다. MIT 라이선스로 배포됩니다.