
автономная платформа для red teaming; мультиагентная мета-обвязка для наступательной безопасности
▄▄▄█████▓▓█████ ███▄ ▄███▓ ██▓███ ▓█████ ██████ ▄▄▄█████▓
▓ ██▒ ▓▒▓█ ▀ ▓██▒▀█▀ ██▒▓██░ ██▒▓█ ▀ ▒██ ▒ ▓ ██▒ ▓▒
▒ ▓██░ ▒░▒███ ▓██ ▓██░▓██░ ██▓▒▒███ ░ ▓██▄ ▒ ▓██░ ▒░
░ ▓██▓ ░ ▒▓█ ▄ ▒██ ▒██ ▒██▄█▓▒ ▒▒▓█ ▄ ▒ ██▒░ ▓██▓ ░
▒██▒ ░ ░▒████▒▒██▒ ░██▒▒██▒ ░ ░░▒████▒▒██████▒▒ ▒██▒ ░
▒ ░░ ░░ ▒░ ░░ ▒░ ░ ░▒▓▒░ ░ ░░░ ▒░ ░▒ ▒▓▒ ▒ ░ ▒ ░░
░ ░ ░ ░░ ░ ░░▒ ░ ░ ░ ░░ ░▒ ░ ░ ░
░ ░ ░ ░ ░░ ░ ░ ░ ░ ░
░ ░ ░ ░ ░ ░
Мультиагентный фреймворк для наступательной кибербезопасности, созданный, чтобы превратить ИИ-агента для написания кода, которого вы уже запускаете, в охотника за zero-day-уязвимостями.
Ваш ИИ-агент для написания кода уже хакер — T3MP3ST выдаёт ему арсенал.
Нацельте его на авторизованную цель — и цепочка атак (kill chain) выполнится сама: recon → exploit → report, из War Room в браузере или из CLI, на базе агента, в которого вы уже вошли, — Claude Code, Codex, Hermes — или модели, которую вы запускаете полностью офлайн (Ollama, LM Studio, vLLM). Никаких новых API-ключей, никакого облачного тенанта, никакого второго счёта. Ваш агент — мозг; T3MP3ST — военная машина, смонтированная вокруг него. Шторм на своём хостинге. Война без ключей. ⚡
И он не попросит вас поверить ему на слово. На собственном наборе XBOW из 104 заданий он набирает 90.1% pass@1 — выше заявленных самой XBOW 85% — наряду с решениями CTF без подсказок и «холодной» охотой на реальные CVE после даты отсечки, которых модель никогда не видела. Каждая цифра в этом README пересчитывается из закоммиченных данных одной командой (npm run verify-claims). Громко о миссии, честно о реализации — таблица статусов точно говорит, что уже работает, что является каркасом, а что ещё в дорожной карте; полные подтверждения — в разделе Бенчмарки.
Три вещи выделяют его:
npm run verify-claims заново выводит их все, 24/24 зелёные. Утверждение, которое нельзя воспроизвести, не публикуется. Никаких цифр «поверь мне на слово», никогда.Перейти к разделам → Быстрый старт · Что он ищет · Что доступно сегодня · Бенчмарки · Архитектура · Документация
T3MP3ST — это инструмент наступательной кибербезопасности, созданный для авторизованного тестирования, исследований и обучения. Направляйте его только на системы, которыми владеете или на тестирование которых имеете явное письменное разрешение. Несанкционированный доступ к компьютерам, сетям или данным незаконен в большинстве юрисдикций — только вы несёте ответственность за то, как используете это ПО, и за соблюдение закона и ваших правил взаимодействия (rules of engagement). Обращайте бурю на свои цели, а не на чужие.
T3MP3ST предоставляется как есть, по лицензии AGPL-3.0, без гарантий и без ответственности за любой ущерб, потери или неправомерное использование. Авторы не одобряют, не поддерживают и не оправдывают несанкционированную деятельность. Получите разрешение. Оставайтесь в рамках. Не будьте угрозой. 🫡
Наступательная кибербезопасность отделена годами практики и дорогостоящим инструментарием. Ставка T3MP3ST в том, что скоординированный рой агентов делает реальную охоту за багами доступной людям, которых так и не пригласили, — в веб-приложениях, CTF, смарт-контрактах, исходном коде и OSS для встраиваемых систем и робототехники. Это амбициозная ставка, и разделы ниже аккуратно разделяют то, что уже работает, и то, что пока остаётся ставкой.
Самый быстрый путь к работающему War Room (без ключей, ~2 минуты на настройку; время миссии зависит от цели):
npm install
npm run server # War Room → http://127.0.0.1:3333/ui/
В War Room откройте Settings и подключите локального агента (Claude Code / Codex / Hermes). Затем опишите цель Op Admiral обычным языком и запускайте. Подключённый вами агент — это мозг. Ключ не требуется.
Предпочитаете использовать ключ? Задайте его и пропустите шаг подключения:
export OPENROUTER_API_KEY=... # or VENICE_API_KEY / ANTHROPIC_API_KEY / OPENAI_API_KEY
export XAI_API_KEY=... # Grok Build (grok-build-0.1) — xAI's coding model, native tool-calling
Медленным локальным агентам можно дать больше времени с помощью T3MP3ST_LOCAL_AGENT_TIMEOUT_MS на каждый CLI-вызов, T3MP3ST_TASK_TIMEOUT_MS на задачи миссии и T3MP3ST_GENERAL_TIMEOUT_MS на запросы планирования. Значения указываются в миллисекундах.
Или запустите его полностью офлайн на собственной модели — без ключа, без облака. По умолчанию — Ollama; можно направить на любой OpenAI-совместимый сервер (LM Studio, vLLM, llama.cpp):
ollama serve && ollama pull llama3 # or an OpenAI-compatible server
export TEMPEST_LOCAL_BASE_URL=http://localhost:11434/api # LM Studio: http://localhost:1234/v1
export TEMPEST_LOCAL_MODEL=llama3
npx tempest # → "Change default provider" → local
Tool-calling работает на любой локальной модели (он управляется через текст), так что Арсенал работает даже на моделях без нативного вызова функций.
Проверьте цифры самостоятельно:
npm run verify-claims # re-derives every headline from committed JSON in bench/
Использование библиотеки/SDK, полный HTTP API и настройка MCP описаны в docs/.
Фреймворк — это цепочка атак из 8 операторов, и эта таблица не будет пускать пыль в глаза. Recon — это живой движок на реальных инструментах — и «зубы» уже настоящие: 90.1% pass@1 на XBEN, 8/10 отложенных CVE после даты отсечки, привязанных к точным файл/строка/CWE, и конвейер скоординированного раскрытия, который уже настолько живой, что черновики прямо сейчас находятся на удержании для координации с вендорами. Что не доказано — так это рой. Каждый последующий оператор — Exploiter, Infiltrator, Exfiltrator, Ghost — выполняет тот же реальный цикл ReAct с инструментами, что и recon (реальные эксплойт-инструменты, а не заглушки), но заглавные цифры получены одним агентом, а не скоординированной ячейкой из 8 операторов, и сквозная эксплуатация роем не бенчмаркнута и всё ещё ненадёжна. Движок настоящий; рой — та часть, которая всё ещё зарабатывает нашивки. Громко там, где заслужили; без прикрас об остальном.
Полная разбивка по функциям: FEATURES.md.
Куда буря дотягивается сегодня — и куда направляется. Та же дисциплина, что и везде: область получает ✅ только тогда, когда за ней есть подтверждение.
Архитектура классов/отрядов означает, что новые области компонуются, а не форкаются: каждая — это набор снаряжения (специализированные классы + арсенал + адаптер цели + бенчмарк). Области 🚧 поставляются «тёмными», пока у них не появится число.
Главные результаты. Каждый пересчитывается из закоммиченного JSON командой npm run verify-claims; полная методология и оговорки — в документах по ссылкам.
Как читать эти результаты:
verify-claims пересчитывает результат pass/fail. Сырые пошаговые транскрипты удаляются ради приватности операторов, поэтому вы перепроверяете оценённый вердикт, а не сырой вывод инструментов. Ноль выдуманных результатов — это обеспечивает анти-подгоночный страж, запускаемый при каждом пуше.Самоцель — не цифра, а подтверждение. Бесключевой опенсорсный харнесс, который даёт вам запуск для перепроверки вместо просьбы доверять ему: клонируйте, выполните npm run verify-claims, и каждый вердикт выше пересчитается из своего закоммиченного оракула прямо у вас на глазах.
Для более глубокого изучения: WALL_FORENSICS (промахи по каждому челленджу), CYBENCH, INTEGRITY_LEDGER (аудит контаминации и все отзывы результатов), OBSIDIVM (наш собственный живой веб-полигон).
┌─────────────────────────────────────────────────────────────────┐
│ T3MP3ST COMMAND │
├─────────────────────────────────────────────────────────────────┤
│ MISSION CONTROL ◄── TARGET MODEL ──► ARSENAL (TOOLS) │
│ ▲ │
│ AGENT CELL: RECON · SCANNER · EXPLOITER · INFILTRATOR · │
│ EXFILTRATOR · GHOST · COORDINATOR · ANALYST │
│ ▲ │
│ EVIDENCE VAULT · CREDENTIAL STORE · FINDINGS LEDGER │
│ ▲ │
│ OPSEC LAYER · COMMS CHANNEL · LLM BACKBONE │
└─────────────────────────────────────────────────────────────────┘
Операторы сопоставляются с фазами MITRE ATT&CK и Cyber Kill Chain (recon жив; последующие фазы — это каркас):
Провайдеры: OpenRouter, Venice, Anthropic, OpenAI или бесключевой локальный агент (Claude Code / Codex / Hermes). Задайте OPENROUTER_API_KEY / VENICE_API_KEY / ANTHROPIC_API_KEY либо подключите агента в Settings.
Интеграции: node dist/mcp-server.js открывает security_recon для агентов с поддержкой MCP. npm run server запускает HTTP API (POST /api/mission/start, GET /api/mission/status и другие). Полный справочник — в docs/.
Red teaming не должен быть жреческой кастой. Приносите адаптер, набор промптов, ранбук, новый инструмент в арсенал или баг-репорт.
Одно правило, без обсуждений: всё здесь — только для авторизованного тестирования. Собственные, входящие в согласованные рамки или одобренные владельцем цели. Стройте для защитников — или не стройте здесь.
npm run verify-claims должен оставаться зелёным.Процесс релиза и ворота: RELEASE_CHECKLIST.
AGPL-3.0. См. LICENSE.
Fortes fortuna iuvat — удача благоволит смелым.
⊰•-•✧ LOVE PLINY ✧•-•⊱ 🌩️
| Область | Что делает | Статус |
|---|
| 🕸️ Веб-приложения | Black-box рекон в роли внешнего атакующего → эксплойт (набор XBEN) | ✅ Стабильно |
| 🚩 CTF | Решения без подсказок, в песочнице (Cybench) | ✅ Стабильно |
| 🤖 Робототехника / OT / встраиваемые системы | Конвейер скоординированного раскрытия для поиска уязвимостей в OSS (OSV + живой PoC + refuter) | ✅ Конвейер стабилен |
| 📂 Исходный код | White-box анализ репозитория со слепой декомпозицией master-builder | ⚠️ Приём только Python |
| 💰 Смарт-контракты | Damn Vulnerable DeFi | ⚠️ воспроизведение, а не новые находки |
| ☁️ Облако (IaC) | Бенчмарк обнаружения некорректных конфигураций (cloud:bench) + опциональный облачный арсенал (aws/az/gcloud + scoutsuite/cloudfox/pmapper; pacu за гейтом) | 🚧 Каркас для IaC-мисконфигов — эксплуатация живого облака ещё не бенчмаркнута |
| 📱 Мобильные приложения | Встроенный статический анализатор (некорректный манифест + обнаружение секретов/открытого текста, mobile:bench) + опциональный арсенал (mobsfscan/objection/drozer; frida за гейтом) | 🚧 Каркас статического обнаружения — динамическая эксплуатация не бенчмаркнута |
| 🔩 Бинарный анализ / RE | Детектор sink-ов в декомпилированном выводе (unsafe-copy / format-string / cmd-injection / int-overflow, binary:bench) + опциональный арсенал (ghidra/radare2/objdump/checksec/strings; gdb за гейтом) | 🚧 Каркас статического обнаружения sink-ов — решение/pwn не бенчмаркнуты |
| Компонент | Статус | Примечания |
|---|
Воспроизводимое измерение (verify-claims) | ✅ Стабильно | каждый заголовочный показатель пересчитывается из закоммиченных артефактов |
| Движок Recon | ✅ Стабильно | управляет nmap / DNS / HTTP / fingerprinting; каждая находка прослеживается до реального вывода инструментов |
| Движок миссий + War Room + Op Admiral | ✅ Стабильно | без ключей, через подключённого локального агента |
| Арсенал, MCP-сервер, HTTP API | ✅ Стабильно | 35 встроенных инструментов по умолчанию; 83 с опциональным T3MP3ST_FULL_ARSENAL (+48 адаптеров, при этом опасные пост-эксплуатационные драйверы — metasploit, hydra — за гейтом одобрения человеком) — оба числа заново выводятся через verify-claims. security_recon через MCP |
| Сдерживание egress-трафика в рамках области действия | ✅ Стабильно (включено по умолчанию) | после установки цели миссии встроенные сетевые инструменты отказываются работать с публичными хостами вне области действия — ни цель/поддомены, ни loopback/приватные адреса (SCOPE DENIED) — ужесточённый дефолт, а не голый запуск инструментов |
| Конвейер скоординированного раскрытия | ✅ Стабильно | новизна по OSV + живой PoC + панель refuter + CVSS; только черновики, отправляет человек |
| White-box анализ исходного кода | ⚠️ Экспериментально | приём только Python через regex; мультимодельная декомпозиция требует больше токенов, а не меньше |
| DeFi (Damn Vulnerable DeFi) | ⚠️ Экспериментально | воспроизводит известные классы эксплойтов; не новые находки |
| Exploiter / Infiltrator / Exfiltrator / Ghost | ⚠️ Экспериментально | выполняют реальный цикл ReAct с инструментами (тот же движок, что и recon); не доказаны как скоординированный рой — путь с одним агентом бенчмаркнут, живая эксплуатация роем всё ещё ненадёжна |
| Расширенные модули (cloud, persistence, swarm, cognition) | 🚧 Запланировано | только интерфейсы в src/stubs/ |
| Цикл самоулучшения | 🧪 Исследование | уже записывает уроки и предложения; обратная подача их в планирование — в дорожной карте |
| Область | Что покрывает | Статус |
|---|
| 🕸️ Web | приложения, API, потоки аутентификации, OWASP Top 10 | ✅ Ядро — XBEN 90.1% pass@1 |
| 📂 Код | white-box аудиты исходного кода, охота за уязвимостями в стиле SAST | ✅ Доказано (результат охоты) — отложенный CVE-Zero: один агент 8/10 точных файл/строка/CWE, 10/10 найдено (7 языков); сам движок приёма репозиториев всё ещё ⚠️ экспериментальный |
| 🚩 CTF | варгеймы, тренировочные полигоны, челленджи | ✅ Доказано — Cybench 23/40 без подсказок |
| 🔌 Сеть / Инфраструктура | рекон, fingerprinting сервисов/стека; lateral + privesc | ✅ рекон (живой движок nmap/DNS/HTTP) · ⚠️ lateral/privesc экспериментально |
| 🤖 Встраиваемые системы / IoT / OT | прошивки, робототехника, OSS для ICS/SCADA | ✅ Конвейер CVE жив — черновики скоординированного раскрытия подготовлены для вендоров |
| 📦 Цепочка поставок | аудит зависимостей, установка без подтверждения | ⚠️ Реально — выделенный класс; попадание в CWE-829 на отложенном наборе |
| 💰 Блокчейн | смарт-контракты, DeFi, Solidity | ⚠️ Только воспроизведение — Damn Vulnerable DeFi, не новые находки |
| ☁️ Облако | некорректные конфигурации AWS/GCP/Azure, IAM, serverless | 🚧 В разработке |
| 📱 Мобильные приложения | безопасность приложений Android/iOS | 🚧 В разработке |
| 🏢 Идентификация / AD | Kerberos, pass-the-hash, атаки на AD | 🚧 В разработке |
| 🔐 Бинарный анализ / RE | переполнения, ROP, разработка эксплойтов | 🚧 В разработке — требуется специализированный инструментарий |
| Набор | Результат | Контекст |
|---|
| XBEN — набор XBOW из 104 заданий, black-box | pass@1 в среднем 90.1% (Wilson-95 86.2–92.9), минимум 91/104 · gpt-5.5 | XBOW заявляет о 85% на том же наборе; наш результат заново выводит оценённый вердикт из закоммиченных артефактов (сырые транскрипты удалены ради приватности) |
| XBEN — white-box (указывается отдельно) | pass@1 98.7%, best-ball 104/104 · gpt-5.5 | никогда не смешивается с black-box показателем |
| Cybench — академический бенчмарк из 40 задач, Opus 4.8, без подсказок | 23/40 (58%) без подсказок, single-run pass@1 (гарантируется verify-claims) | это не рекорд по сырым очкам (Anthropic: 76.5% pass@10); каждый флаг проверяется по закоммиченному оракулу |
| CVE-Zero — 10 реальных CVE после даты отсечки (2026), отложенные, 7 языков | один агент: 8/10 точных совпадений файл/строка/CWE (проверено: всё точно, стабильно) · 10/10 найдено (полный набор) | устойчиво к запоминанию и подгонке: после даты отсечки, а ужесточённые промпты никогда не настраивались на этих CVE; verify-claims пересчитывает результат. n=10, ориентировочный показатель; преимущество роя здесь — полнота (recall), а не доказательство «координация бьёт соло» |
| Документ | Содержание |
|---|
| FEATURES.md | статус по каждой функции ([x] готово / [~] частично / [ ] запланировано) |
| SCOPE_AND_AUTHORIZATION | модель полномочий, подтверждения области действия, правила доказательств и повторного тестирования |
| VERIFIED_PROVENANCE | как находки становятся подтверждёнными инструментами, а не утверждениями модели |
| TEAM_PREVIEW | путь первого запуска и скрипт ревью |
| INSTALL_MATRIX | таблица готовности macOS / Linux |
| ARSENAL_ACTIVATION_PLAN | опциональная настройка внешних инструментов |
| CYBENCH · WALL_FORENSICS · INTEGRITY_LEDGER · COGNITIVE_ARCHITECTURE | методология бенчмарков |
| RELEASE_CHECKLIST | ворота, которые должен пройти релиз |
| Оператор | Фаза | MITRE | Функция |
|---|
| Recon | Разведка | TA0043 | OSINT, обнаружение сети, перечисление активов |
| Scanner | Обнаружение | TA0007 | сканирование уязвимостей, fingerprinting сервисов |
| Exploiter | Начальный доступ | TA0001 | эксплуатация, доставка полезной нагрузки |
| Infiltrator | Боковое перемещение | TA0008 | пост-эксплуатация, повышение привилегий |
| Exfiltrator | Сбор / Exfil | TA0009/10 | извлечение данных, сбор учётных данных |
| Ghost | Персистентность | TA0003 | персистентность, скрытность, зачистка следов |
| Coordinator | Управление и контроль | TA0011 | управление миссией, оркестрация |
| Analyst | Анализ | — | анализ паттернов, формирование отчётов |