자율적 레드 팀 플랫폼; 다중 에이전트 공격 보안 메타 하네스
▄▄▄█████▓▓█████ ███▄ ▄███▓ ██▓███ ▓█████ ██████ ▄▄▄█████▓
▓ ██▒ ▓▒▓█ ▀ ▓██▒▀█▀ ██▒▓██░ ██▒▓█ ▀ ▒██ ▒ ▓ ██▒ ▓▒
▒ ▓██░ ▒░▒███ ▓██ ▓██░▓██░ ██▓▒▒███ ░ ▓██▄ ▒ ▓██░ ▒░
░ ▓██▓ ░ ▒▓█ ▄ ▒██ ▒██ ▒██▄█▓▒ ▒▒▓█ ▄ ▒ ██▒░ ▓██▓ ░
▒██▒ ░ ░▒████▒▒██▒ ░██▒▒██▒ ░ ░░▒████▒▒██████▒▒ ▒██▒ ░
▒ ░░ ░░ ▒░ ░░ ▒░ ░ ░▒▓▒░ ░ ░░░ ▒░ ░▒ ▒▓▒ ▒ ░ ▒ ░░
░ ░ ░ ░░ ░ ░░▒ ░ ░ ░ ░░ ░▒ ░ ░ ░
░ ░ ░ ░ ░░ ░ ░ ░ ░ ░
░ ░ ░ ░ ░ ░
당신이 이미 사용 중인 AI 코딩 에이전트를 제로데이 헌터로 바꿔주는 멀티에이전트 오펜시브 시큐리티 프레임워크.
당신의 AI 코딩 에이전트는 이미 해커입니다 — T3MP3ST가 무기고를 쥐어줍니다.
권한이 있는 대상에 지시하면 킬 체인이 자동으로 실행됩니다: 정찰 → 익스플로잇 → 보고서, 브라우저 War Room이나 CLI에서, 당신이 이미 로그인한 에이전트(Claude Code, Codex, Hermes) 또는 완전히 오프라인으로 실행하는 모델(Ollama, LM Studio, vLLM)에 의해 구동됩니다. 새 API 키, 클라우드 테넌트, 두 번째 청구서는 없습니다. 당신의 에이전트가 두뇌이고, T3MP3ST는 그 주위에 조립된 전쟁 기계입니다. 자체 호스팅 스톰. 키리스 워페어. ⚡
그리고 그 결과를 믿으라고 요구하지 않습니다. XBOW의 자체 104개 챌린지 제품군에서 90.1% pass@1을 기록했습니다 — XBOW가 자체 보고한 85%보다 높은 점수이며, 힌트 없는 CTF 해결과 모델이 본 적 없는 실제 포스트-컷오프 CVE에 대한 콜드 헌트도 포함됩니다. 이 README의 모든 숫자는 하나의 명령(npm run verify-claims)으로 커밋된 데이터에서 다시 계산됩니다. 임무에 대해 크게 말하고, 빌드에 대해 정직합니다 — 상태 테이블은 무엇이 실제로 작동하는지, 무엇이 스캐폴딩인지, 무엇이 아직 로드맵인지 정확히 표시합니다. 전체 영수증은 벤치마크에 있습니다.
세 가지가 이 프레임워크를 차별화합니다:
npm run verify-claims는 모두를 다시 도출하며, 24/24 초록색입니다. 재현할 수 없는 주장은 출시되지 않습니다. 절대 신뢰만 요구하는 숫자는 없습니다.바로가기 → 빠른 시작 · 헌팅 대상 · 현재 출시된 기능 · 벤치마크 · 아키텍처 · 문서
T3MP3ST는 공격적인 보안 도구로, 승인된 테스트, 연구, 교육을 위해 제작되었습니다. 오직 소유하고 있거나 명시적, 서면 승인을 받은 시스템에만 지시하십시오. 무단 컴퓨터, 네트워크 또는 데이터 접근은 대부분의 관할권에서 불법입니다 — 이 소프트웨어를 사용하는 방법과 법 및 행동 규칙을 준수하는 것은 전적으로 귀하의 책임입니다. 폭풍을 당신의 대상에 가져오세요, 다른 사람의 것이 아닙니다.
T3MP3ST는 AGPL-3.0 라이선스에 따라 "있는 그대로" 제공되며, 어떠한 손해, 손실 또는 오용에 대한 보증이나 책임도 없습니다. 저자는 무단 활동을 지지, 지원 또는 묵인하지 않습니다. 허가를 받으십시오. 범위를 지키십시오. 위협이 되지 마십시오. 🫡
오펜시브 시큐리티는 수년간의 경험과 값비싼 도구 뒤에 있습니다. T3MP3ST 뒤에 있는 가설은 조정된 에이전트 떼가 초대를 받지 못한 사람들에게 실제 버그 헌팅을 가능하게 할 수 있다는 것입니다. 웹 앱, CTF, 스마트 계약, 소스 코드, 임베디드/로보틱스 OSS 전반에 걸쳐 말이죠. 이것은 야심찬 가설이며, 아래 섹션들은 이미 작동하는 것과 여전히 가설인 것을 신중하게 분리합니다.
| 도메인 | 설명 | 상태 |
|---|---|---|
| 🕸️ 웹 앱 | 블랙박스, 외부 공격자 정찰 → 익스플로잇 (XBEN 제품군) | ✅ 안정적 |
| 🚩 CTF | 힌트 없음, 샌드박스 격리 해결 (Cybench) | ✅ 안정적 |
| 🤖 로보틱스 / OT / 임베디드 | OSS 취약점 헌팅을 위한 조정된 공개 제보 파이프라인 (OSV + 라이브 PoC + 반박자) | ✅ 파이프라인 안정적 |
| 📂 소스 코드 | 블라인드 마스터 빌더 분해를 통한 화이트박스 리포지토리 분석 | ⚠️ Python 전용 입력 |
| 💰 스마트 계약 | Damn Vulnerable DeFi | ⚠️ 재현, 새로운 발견 아님 |
| ☁️ 클라우드 (IaC) | 오설정 탐지 벤치마크 (cloud:bench) + 옵트인 클라우드 무기고 (aws/az/gcloud + scoutsuite/cloudfox/pmapper; pacu 게이트됨) | 🚧 IaC 오설정 스캐폴딩 — 라이브 클라우드 익스플로잇은 아직 벤치마킹되지 않음 |
| 📱 모바일 | 내장 정적 분석기 (매니페스트 오설정 + 비밀/평문 탐지, mobile:bench) + 옵트인 무기고 (mobsfscan/objection/drozer; frida 게이트됨) | 🚧 정적 탐지 스캐폴딩 — 동적 익스플로잇은 벤치마킹되지 않음 |
| 🔩 바이너리 / 역공학 | 디컴파일 출력 싱크 탐지 (안전하지 않은 복사 / 포맷 문자열 / 명령어 주입 / 정수 오버플로우, binary:bench) + 옵트인 무기고 (ghidra/radare2/objdump/checksec/strings; gdb 게이트됨) | 🚧 정적 싱크 탐지 스캐폴딩 — 해결/pwn은 벤치마킹되지 않음 |
실행 중인 War Room으로 가는 가장 빠른 경로 (키리스, 설정 약 2분; 임무 시간은 대상에 따라 다름):
npm install
npm run server # War Room → http://127.0.0.1:3333/ui/
War Room에서 Settings를 열고 로컬 에이전트(Claude Code / Codex / Hermes)를 연결하세요. 그런 다음 Op Admiral에게 일반 영어로 대상을 설명하고 실행하세요. 연결한 에이전트가 두뇌입니다. 키가 필요 없습니다.
키를 사용하고 싶으신가요? 하나를 설정하고 연결 단계를 건너뛰세요:
export OPENROUTER_API_KEY=... # 또는 VENICE_API_KEY / ANTHROPIC_API_KEY / OPENAI_API_KEY
export XAI_API_KEY=... # Grok Build (grok-build-0.1) — xAI의 코딩 모델, 네이티브 도구 호출
느린 로컬 에이전트에게 더 많은 시간을 주려면 각 CLI 호출에 T3MP3ST_LOCAL_AGENT_TIMEOUT_MS, 임무 작업에 T3MP3ST_TASK_TIMEOUT_MS, 계획 요청에 T3MP3ST_GENERAL_TIMEOUT_MS를 설정하십시오. 값은 밀리초입니다.
또는 완전히 오프라인으로 자신의 모델에서 실행하세요 — 키도, 클라우드도 필요 없습니다. 기본적으로 Ollama를 사용합니다; OpenAI 호환 서버(LM Studio, vLLM, llama.cpp)로 지정할 수 있습니다:
ollama serve && ollama pull llama3 # 또는 OpenAI 호환 서버
export TEMPEST_LOCAL_BASE_URL=http://localhost:11434/api # LM Studio: http://localhost:1234/v1
export TEMPEST_LOCAL_MODEL=llama3
npx tempest # → "Change default provider" → local
도구 호출은 모든 로컬 모델에서 작동합니다 (텍스트로 구동됨), 따라서 네이티브 함수 호출이 없는 모델에서도 Arsenal이 실행됩니다.
직접 숫자를 확인하세요:
npm run verify-claims # bench/에 커밋된 JSON에서 모든 헤드라인을 다시 도출
라이브러리/SDK 사용법, 전체 HTTP API, MCP 설정은 docs/에 있습니다.
프레임워크는 8개 운영자 킬 체인이며, 이 테이블은 허튼소리를 하지 않을 것입니다. Recon은 살아있는 도구 기반 엔진입니다 — 그리고 이빨은 이미 현실적입니다: XBEN에서 90.1% pass@1, 보류된 10개 중 8개의 포스트-컷오프 CVE를 정확한 파일/라인/CWE에 고정, 그리고 현재 공급업체 조정을 위해 초안이 보류될 정도로 살아있는 조정된 공개 제보 파이프라인입니다. 입증되지 않은 것은 떼(swarm)입니다. 각 하위 운영자(Exploiter, Infiltrator, Exfiltrator, Ghost)는 recon과 동일한 실제 도구 기반 ReAct 루프를 실행하지만(스텁이 아닌 실제 익스플로잇 도구), 헤드라인 숫자는 단일 에이전트에서 나온 것이지 조정된 8-운영자 셀에서 나온 것이 아니며, 엔드-투-엔드 떼 익스플로잇은 벤치마킹되지 않았고 여전히 신뢰할 수 없습니다. 엔진은 현실적입니다. 떼는 아직 실력을 입증하는 중인 부분입니다. 입증한 부분은 크게 말하고, 나머지는 솔직하게 말합니다.
| 구성 요소 | 상태 | 비고 |
|---|---|---|
재현 가능한 측정 (verify-claims) | ✅ 안정적 | 모든 헤드라인이 커밋된 아티팩트에서 다시 계산됨 |
| Recon 엔진 | ✅ 안정적 | nmap / DNS / HTTP / 지문인식 구동; 모든 발견이 실제 도구 출력으로 추적됨 |
| Mission 엔진 + War Room + Op Admiral | ✅ 안정적 | 연결된 로컬 에이전트를 통해 키리스 |
| Arsenal, MCP 서버, HTTP API | ✅ 안정적 | 기본 35개의 내장 도구; 옵트인 T3MP3ST_FULL_ARSENAL (+48개 어댑터, 위험한 포스트-익스플로잇 드라이버(metasploit, hydra)는 인간 승인 게이트 뒤에 있음)로 83개 — 두 개수 모두 verify-claims를 통해 재도출됨. MCP를 통한 security_recon |
| 이그레스 범위 격리 | ✅ 안정적 (기본 켜짐) | 미션 대상이 설정되면 내장 네트워크 도구가 범위 외부 공용 호스트를 거부함 — 대상/서브도메인, 루프백/프라이빗이 아님 (SCOPE DENIED) — 기본 도구 실행기가 아닌 강화된 기본값 |
| 조정된 공개 제보 파이프라인 | ✅ 안정적 | OSV 참신성 + 라이브 PoC + 반박자 패널 + CVSS; 초안만, 인간이 전송 |
| 화이트박스 소스 분석 | ⚠️ 실험적 | Python 전용 정규식 입력; 다중 모델 분해는 토큰을 더 많이 소모함, 더 적지 않음 |
| DeFi (Damn Vulnerable DeFi) | ⚠️ 실험적 | 알려진 익스플로잇 클래스 재현; 새로운 발견 아님 |
| Exploiter / Infiltrator / Exfiltrator / Ghost | ⚠️ 실험적 | 실제 도구 기반 ReAct 루프 실행 (recon과 동일한 엔진); 조정된 떼로 입증되지 않음 — 단일 에이전트가 벤치마킹된 경로이며, 라이브 떼 익스플로잇은 여전히 신뢰할 수 없음 |
| 고급 모듈 (클라우드, 지속성, 떼, 인지) | 🚧 계획됨 | src/stubs/에 인터페이스만 있음 |
| 자기 개선 루프 | 🧪 연구 | 현재 교훈 + 제안 기록; 이를 계획에 다시 공급하는 것은 로드맵 |
기능별 전체 분석: FEATURES.md.
오늘날 폭풍이 도달하는 곳 — 그리고 향할 곳. 다른 모든 것과 동일한 규율: 도메인은 그 뒤에 영수증이 있을 때만 ✅입니다.