
منصة مستقلة لاختبارات الاختراق؛ أداة تشغيل متعددة الوكلاء للأمن الهجومي
▄▄▄█████▓▓█████ ███▄ ▄███▓ ██▓███ ▓█████ ██████ ▄▄▄█████▓
▓ ██▒ ▓▒▓█ ▀ ▓██▒▀█▀ ██▒▓██░ ██▒▓█ ▀ ▒██ ▒ ▓ ██▒ ▓▒
▒ ▓██░ ▒░▒███ ▓██ ▓██░▓██░ ██▓▒▒███ ░ ▓██▄ ▒ ▓██░ ▒░
░ ▓██▓ ░ ▒▓█ ▄ ▒██ ▒██ ▒██▄█▓▒ ▒▒▓█ ▄ ▒ ██▒░ ▓██▓ ░
▒██▒ ░ ░▒████▒▒██▒ ░██▒▒██▒ ░ ░░▒████▒▒██████▒▒ ▒██▒ ░
▒ ░░ ░░ ▒░ ░░ ▒░ ░ ░▒▓▒░ ░ ░░░ ▒░ ░▒ ▒▓▒ ▒ ░ ▒ ░░
░ ░ ░ ░░ ░ ░░▒ ░ ░ ░ ░░ ░▒ ░ ░ ░
░ ░ ░ ░ ░░ ░ ░ ░ ░ ░
░ ░ ░ ░ ░ ░
إطار عمل أمني هجومي متعدد الوكلاء (multi-agent)، صُمم ليحوّل وكيل البرمجة بالذكاء الاصطناعي الذي تشغّله أصلًا إلى صائد ثغرات zero-day.
وكيل البرمجة بالذكاء الاصطناعي لديك قرصان بالفعل — T3MP3ST يضع في يديه ترسانة.
وجّهه إلى هدف مصرّح به وستعمل سلسلة القتل (kill chain) من تلقاء نفسها: استطلاع (recon) ← استغلال (exploit) ← تقرير (report)، من غرفة حرب (War Room) داخل المتصفح أو من سطر الأوامر (CLI)، بقيادة الوكيل الذي سجّلت الدخول به أصلًا — Claude Code، أو Codex، أو Hermes — أو نموذج تشغّله بالكامل دون اتصال (Ollama, LM Studio, vLLM). لا مفاتيح API جديدة، لا حساب سحابي، لا فاتورة ثانية. وكيلك هو الدماغ؛ وT3MP3ST هو آلة الحرب المثبّتة حوله. عاصفة ذاتية الاستضافة. حرب بلا مفاتيح. ⚡
ولن يطلب منك أن تصدّقه على كلامه. ففي مجموعة XBOW الخاصة المكوّنة من 104 تحديات يسجّل 90.1% بمقياس pass@1 — أعلى من 85% التي أعلنتها XBOW عن نفسها — إلى جانب حلول CTF دون تلميحات ومطاردة باردة لثغرات CVE حقيقية لاحقة على تاريخ قطع بيانات النموذج (post-cutoff) لم يرها النموذج من قبل. كل رقم في هذا README يُعاد احتسابه من بيانات مُلتزمة في المستودع بأمر واحد (npm run verify-claims). صاخبون بشأن المهمة، صادقون بشأن البناء — جدول الحالة يبيّن بدقة ما هو مباشر، وما هو هيكل أولي، وما لا يزال على خارطة الطريق؛ الإثباتات الكاملة في المعايير.
ثلاثة أمور تميّزه:
npm run verify-claims يعيد اشتقاقها جميعًا، 24/24 خضراء. أي ادعاء لا يمكن إعادة إنتاجه لا يُنشر. لا أرقام «ثق بي» أبدًا.انتقل إلى → بدء سريع · ما يصطاده · ما يُشحن اليوم · المعايير · البنية · التوثيق
T3MP3ST أداة أمنية هجومية، صُممت للاختبار المصرّح به والبحث والتعليم. وجّهها فقط إلى أنظمة تملكها أو لديك إذن صريح كتابي لاختبارها. الوصول غير المصرّح به إلى الحواسيب أو الشبكات أو البيانات غير قانوني في معظم الدول — أنت وحدك المسؤول عن طريقة استخدامك لهذا البرنامج وعن البقاء داخل القانون وقواعد الاشتباك الخاصة بك. اجلب العاصفة إلى أهدافك أنت، لا إلى أهداف غيرك.
T3MP3ST مقدَّم كما هو بموجب رخصة AGPL-3.0، دون أي ضمان أو مسؤولية عن أي ضرر أو خسارة أو إساءة استخدام. لا يقرّ المؤلفون أي نشاط غير مصرّح به ولا يدعمونه ولا يتغاضون عنه. احصل على الإذن. التزم بالنطاق. لا تكن خطرًا. 🫡
الأمن الهجومي يقف خلف سنوات من الممارسة وأدوات باهظة الثمن. الرهان الذي يقوم عليه T3MP3ST هو أن سربًا منسقًا من الوكلاء (agent swarm) يجعل صيد الثغرات الحقيقي في متناول من لم يحصلوا على الدعوة أبدًا، عبر تطبيقات الويب ومسابقات CTF والعقود الذكية والكود المصدري والبرمجيات مفتوحة المصدر للأنظمة المدمجة والروبوتات. هذا رهان طموح، والأقسام أدناه حريصة على الفصل بين ما يعمل فعلًا وما لا يزال رهانًا.
أسرع طريق إلى غرفة حرب (War Room) عاملة (بلا مفاتيح، ~دقيقتان للإعداد؛ زمن المهمة يعتمد على الهدف):
npm install
npm run server # War Room → http://127.0.0.1:3333/ui/
في غرفة الحرب، افتح الإعدادات واربط وكيلًا محليًا (Claude Code / Codex / Hermes). ثم صِف هدفًا إلى Op Admiral بالإنجليزية العادية وأطلق المهمة. الوكيل الذي ربطته هو الدماغ. لا حاجة إلى أي مفتاح.
تفضّل إحضار مفتاح؟ اضبط واحدًا وتجاوز خطوة الربط:
export OPENROUTER_API_KEY=... # or VENICE_API_KEY / ANTHROPIC_API_KEY / OPENAI_API_KEY
export XAI_API_KEY=... # Grok Build (grok-build-0.1) — xAI's coding model, native tool-calling
يمكن منح الوكلاء المحليين البطيئين مساحة أكبر عبر T3MP3ST_LOCAL_AGENT_TIMEOUT_MS لكل استدعاء CLI، وT3MP3ST_TASK_TIMEOUT_MS لمهام العملية، وT3MP3ST_GENERAL_TIMEOUT_MS لطلبات التخطيط. القيم بالمللي ثانية.
أو شغّله بالكامل دون اتصال على نموذجك الخاص — لا مفتاح، لا سحابة. الافتراضي هو Ollama؛ وجّهه إلى أي خادم متوافق مع OpenAI (LM Studio, vLLM, llama.cpp):
ollama serve && ollama pull llama3 # or an OpenAI-compatible server
export TEMPEST_LOCAL_BASE_URL=http://localhost:11434/api # LM Studio: http://localhost:1234/v1
export TEMPEST_LOCAL_MODEL=llama3
npx tempest # → "Change default provider" → local
استدعاء الأدوات (tool-calling) يعمل على أي نموذج محلي (لأنه يُدار عبر النص)، لذا تعمل الترسانة حتى على النماذج التي لا تدعم استدعاء الدوال بشكل أصلي.
تحقّق من الأرقام بنفسك:
npm run verify-claims # re-derives every headline from committed JSON in bench/
استخدام المكتبة/SDK، وواجهة HTTP API الكاملة، وإعداد MCP موجودة في docs/.
الإطار عبارة عن سلسلة قتل من 8 عوامل تشغيل (operators)، وهذا الجدول لن يجمّل الحقيقة بشأنها. الاستطلاع محرك مباشر مدعوم بأدوات حقيقية — والأنياب حقيقية فعلًا: 90.1% بمقياس pass@1 على XBEN، و8 من 10 ثغرات CVE محجوزة (held-out) لاحقة على تاريخ قطع البيانات مثبّتة بدقة على الملف/السطر/CWE، وخط أنابيب إفصاح منسق مباشر بما يكفي لوجود مسودات محتجزة للتنسيق مع البائعين الآن. ما غير مُثبت هو السرب. كل عامل تشغيل في المراحل اللاحقة — Exploiter وInfiltrator وExfiltrator وGhost — يشغّل حلقة ReAct الحقيقية المدعومة بالأدوات نفسها التي يعمل بها الاستطلاع (أدوات استغلال حقيقية، لا أدوات وهمية)، لكن الأرقام الرئيسية جاءت من وكيل واحد، لا من خلية العوامل الثمانية المنسقة، والاستغلال بالسرب من البداية إلى النهاية غير مُقيَّم بمعايير وما يزال غير موثوق. المحرك حقيقي؛ والسرب هو الجزء الذي ما يزال يثبت جدارته. صاخبون حيث استحقققنا ذلك، وصريحون بشأن الباقي.
التفصيل الكامل ميزة-بميزة: FEATURES.md.
أين تبلغ العاصفة اليوم — وإلى أين تتجه. الانضباط نفسه كما في كل شيء آخر: أي مجال يحصل على ✅ فقط عندما يوجد إثبات (receipt) خلفه.
بنية الفئات/الفرق (class/squad) تعني أن المجالات الجديدة تتألف بدلًا من أن تتفرع — كل مجال هو عدة (loadout) (فئات متخصصة + ترسانة + محوّل أهداف + معيار). المجالات 🚧 تُطلق دون إعلان حتى يصبح لها رقم.
النتائج الرئيسية. كل نتيجة يُعاد احتسابها من ملفات JSON المُلتزمة في المستودع عبر npm run verify-claims؛ المنهجية الكاملة والتحفظات في الوثائق المرتبطة.
كيف تقرأ هذه النتائج:
verify-claims يعيد احتساب النجاح/الفشل. النصوص الخام خطوة-بخطوة محذوفة لخصوصية عوامل التشغيل، لذا أنت تعيد التحقق من الحكم المُصحَّح، لا من مخرجات الأدوات الخام. صفر تلفيق، مفروض بحارس ضد الملاءمة (anti-fitting) يعمل مع كل push.الرقم ليس موضع التباهي — الإثبات (receipt) هو. حزام (harness) مفتوح المصدر بلا مفاتيح يضع بين يديك إعادة التشغيل بدلًا من أن يطلب منك الثقة به: استنسخه، شغّل npm run verify-claims، وكل حكم أعلاه يُعاد احتسابه أمامك من مُحكِّمه المُلتزم في المستودع.
قراءة أعمق: WALL_FORENSICS (الأخطاء لكل تحدٍّ)، CYBENCH، INTEGRITY_LEDGER (تدقيق التلوث وكل تراجع عن نتيجة)، OBSIDIVM (ميدان الويب المباشر الخاص بنا).
┌─────────────────────────────────────────────────────────────────┐
│ T3MP3ST COMMAND │
├─────────────────────────────────────────────────────────────────┤
│ MISSION CONTROL ◄── TARGET MODEL ──► ARSENAL (TOOLS) │
│ ▲ │
│ AGENT CELL: RECON · SCANNER · EXPLOITER · INFILTRATOR · │
│ EXFILTRATOR · GHOST · COORDINATOR · ANALYST │
│ ▲ │
│ EVIDENCE VAULT · CREDENTIAL STORE · FINDINGS LEDGER │
│ ▲ │
│ OPSEC LAYER · COMMS CHANNEL · LLM BACKBONE │
└─────────────────────────────────────────────────────────────────┘
تتقابل عوامل التشغيل مع مراحل MITRE ATT&CK وسلسلة القتل السيبراني (الاستطلاع مباشر؛ المراحل اللاحقة هيكل أولي):
المزوّدون: OpenRouter، Venice، Anthropic، OpenAI، أو وكيل محلي بلا مفاتيح (Claude Code / Codex / Hermes). اضبط OPENROUTER_API_KEY / VENICE_API_KEY / ANTHROPIC_API_KEY، أو اربط وكيلًا في الإعدادات.
التكاملات: node dist/mcp-server.js يوفّر security_recon للوكلاء المتوافقين مع MCP. npm run server يشغّل HTTP API (POST /api/mission/start, GET /api/mission/status, والمزيد). المرجع الكامل في docs/.
الاختراق الأخلاقي (red-teaming) لا ينبغي أن يكون حكرًا على نخبة. قدّم محوّلًا (adapter)، أو حزمة طلبات (prompt pack)، أو دليل تشغيل (runbook)، أو أداة ترسانة جديدة، أو تقرير خطأ.
قاعدة واحدة غير قابلة للتفاوض: كل شيء هنا مخصص للاختبار المصرّح به فقط. أهداف مملوكة، أو محدّدة النطاق، أو بموافقة أصحابها. ابنِ للمدافعين، أو لا تبنِ هنا أصلًا.
npm run verify-claims أخضر.عملية الإصدار والبوابات: RELEASE_CHECKLIST.
AGPL-3.0. انظر LICENSE.
Fortes fortuna iuvat — الحظ يخدم الجريئين.
⊰•-•✧ LOVE PLINY ✧•-•⊱ 🌩️
| المجال | ما يفعله | الحالة |
|---|
| 🕸️ تطبيقات الويب | استطلاع الصندوق الأسود من منظور مهاجم خارجي ← استغلال (مجموعة XBEN) | ✅ مستقر |
| 🚩 CTF | حلول دون تلميحات داخل صندوق رمل معزول (sandbox) (Cybench) | ✅ مستقر |
| 🤖 الروبوتات / التقنيات التشغيلية OT / الأنظمة المدمجة | خط أنابيب إفصاح منسق لصيد ثغرات البرمجيات مفتوحة المصدر (OSV + PoC حي + داحض refuter) | ✅ خط الأنابيب مستقر |
| 📂 الكود المصدري | تحليل المستودع بالصندوق الأبيض مع تفكيك أعمى عبر باني رئيسي (master-builder) | ⚠️ الإدخال بلغة Python فقط |
| 💰 العقود الذكية | Damn Vulnerable DeFi | ⚠️ إعادة إنتاج، لا اكتشاف جديد |
| ☁️ السحابة (IaC) | معيار كشف سوء الإعداد (cloud:bench) + ترسانة سحابية اختيارية (aws/az/gcloud + scoutsuite/cloudfox/pmapper؛ pacu خلف بوابة) | 🚧 هيكل أولي لكشف سوء إعداد IaC — استغلال السحابة المباشر غير مُقيَّم بمعايير بعد |
| 📱 الأجهزة المحمولة | محلّل ثابت مدمج (سوء إعداد manifest + كشف الأسرار/النصوص الصريحة، mobile:bench) + ترسانة اختيارية (mobsfscan/objection/drozer؛ frida خلف بوابة) | 🚧 هيكل أولي للكشف الثابت — الاستغلال الديناميكي غير مُقيَّم بمعايير |
| 🔩 الثنائيات / الهندسة العكسية | كاشف نقاط الالتقاء (sink) في المخرجات المفكوكة (نسخ غير آمن / سلسلة تنسيق / حقن أوامر / تجاوز أعداد صحيحة، binary:bench) + ترسانة اختيارية (ghidra/radare2/objdump/checksec/strings؛ gdb خلف بوابة) | 🚧 هيكل أولي لكشف الالتقاء الثابت — الحل/الاختراق pwn غير مُقيَّم بمعايير |
| المكوّن | الحالة | ملاحظات |
|---|
القياس القابل لإعادة الاشتقاق (verify-claims) | ✅ مستقر | كل عنوان رئيسي يُعاد احتسابه من القطع الأثرية المُلتزمة في المستودع |
| محرك الاستطلاع | ✅ مستقر | يقود nmap / DNS / HTTP / بصمة النظام؛ كل نتيجة يُتتبّع أثرها إلى مخرجات أدوات حقيقية |
| محرك المهام + غرفة الحرب + Op Admiral | ✅ مستقر | بلا مفاتيح عبر وكيل محلي مربوط |
| الترسانة، خادم MCP، HTTP API | ✅ مستقر | 35 أداة مدمجة افتراضيًا؛ و83 مع الترسانة الاختيارية T3MP3ST_FULL_ARSENAL (+48 محوّلًا، مع برامج التشغيل الخطرة بعد الاستغلال (post-exploitation) — metasploit, hydra — خلف بوابة موافقة بشرية) — كلا العددين يُعاد اشتقاقه عبر verify-claims. وsecurity_recon عبر MCP |
| احتواء نطاق الخروج (egress) | ✅ مستقر (مفعّل افتراضيًا) | بمجرد تعيين هدف المهمة، ترفض الأدوات الشبكية المدمجة المضيفات العامة خارج النطاق — لا الهدف/نطاقاته الفرعية، ولا الحلقة المحلية/الخاصة (SCOPE DENIED) — إعداد افتراضي مشدّد، وليس مجرد مشغّل أدوات |
| خط أنابيب الإفصاح المنسق | ✅ مستقر | جِدّة OSV + PoC حي + لوحة دحض (refuter) + CVSS؛ مسودات فقط، والإرسال من إنسان |
| تحليل المصدر بالصندوق الأبيض | ⚠️ تجريبي | إدخال عبر regex بلغة Python فقط؛ التفكيك متعدد النماذج يكلّف رموزًا (tokens) أكثر، لا أقل |
| DeFi (Damn Vulnerable DeFi) | ⚠️ تجريبي | يعيد إنتاج أصناف الاستغلال المعروفة؛ لا اكتشافًا جديدًا |
| Exploiter / Infiltrator / Exfiltrator / Ghost | ⚠️ تجريبي | يشغّل حلقة ReAct الحقيقية المدعومة بالأدوات (نفس محرك الاستطلاع)؛ غير مُثبت كسرب منسق — المسار المُقيَّم بالمعايير هو الوكيل الواحد، واستغلال السرب المباشر ما يزال غير موثوق |
| الوحدات المتقدمة (السحابة، الثبات، السرب، الإدراك) | 🚧 مخطط لها | واجهات فقط في src/stubs/ |
| حلقة التحسين الذاتي | 🧪 بحث | يوثّق الدروس والمقترحات اليوم؛ وإعادة تغذيتها في التخطيط على خارطة الطريق |
| المجال | ما يغطيه | الحالة |
|---|
| 🕸️ الويب | التطبيقات، واجهات API، تدفقات المصادقة، OWASP Top 10 | ✅ أساسي (Core) — XBEN 90.1% pass@1 |
| 📂 الكود | تدقيق المصدر بالصندوق الأبيض، صيد ثغرات بأسلوب SAST | ✅ مُثبت (نتيجة صيد) — CVE-Zero محجوزة: وكيل واحد 8/10 بتطابق دقيق للملف/السطر/CWE، و10/10 تم العثور عليها (7 لغات)؛ محرك إدخال المستودع نفسه ما يزال ⚠️ تجريبيًا |
| 🚩 CTF | ألعاب حربية، ميادين تدريب، تحديات | ✅ مُثبت — Cybench 23/40 دون تلميحات |
| 🔌 الشبكة / البنية التحتية | استطلاع، بصمة الخدمات/الحزم التقنية؛ حركة جانبية + تصعيد صلاحيات | ✅ استطلاع (محرك nmap/DNS/HTTP مباشر) · ⚠️ حركة جانبية/تصعيد صلاحيات تجريبيان |
| 🤖 المدمجة / إنترنت الأشياء / التقنيات التشغيلية | برامج ثابتة (firmware)، روبوتات، برمجيات ICS/SCADA مفتوحة المصدر | ✅ خط أنابيب CVE مباشر — مسودات إفصاح منسق محتجزة للبائعين |
| 📦 سلسلة التوريد | تدقيق التبعيات، تثبيت دون تأكيد | ⚠️ حقيقي — فئة مخصصة؛ التقط CWE-829 على المجموعة المحجوزة |
| 💰 سلسلة الكتل | عقود ذكية، DeFi، Solidity | ⚠️ إعادة إنتاج فقط — Damn Vulnerable DeFi، لا اكتشافًا جديدًا |
| ☁️ السحابة | سوء إعداد AWS/GCP/Azure، IAM، الحوسبة بلا خوادم (serverless) | 🚧 قيد التطوير |
| 📱 الأجهزة المحمولة | أمان تطبيقات Android/iOS | 🚧 قيد التطوير |
| 🏢 الهوية / الدليل النشط AD | Kerberos، تمرير التجزئة (pass-the-hash)، هجمات AD | 🚧 قيد التطوير |
| 🔐 الثنائيات / الهندسة العكسية | تجاوزات الذاكرة (overflows)، ROP، تطوير الاستغلال (exploit dev) | 🚧 قيد التطوير — يحتاج أدوات متخصصة |
| المجموعة | النتيجة | السياق |
|---|
| XBEN — مجموعة XBOW الخاصة المكوّنة من 104 تحديات، صندوق أسود | متوسط pass@1 90.1% (Wilson-95 86.2–92.9)، الحد الأدنى 91/104 · gpt-5.5 | XBOW تعلن عن 85% على المجموعة نفسها؛ نحن نعيد اشتقاق الحكم المُصحَّح من القطع الأثرية المُلتزمة (النصوص الخام محذوفة للخصوصية) |
| XBEN — صندوق أبيض (يُبلَغ عنه منفصلًا) | pass@1 98.7%، أفضل محاولة (best-ball) 104/104 · gpt-5.5 | لا يُدمج أبدًا مع رقم الصندوق الأسود |
| Cybench — معيار أكاديمي من 40 مهمة، Opus 4.8، دون تلميحات | 23/40 (58%) دون تلميحات، pass@1 من تشغيل واحد (مفروض عبر verify-claims) | ليس الرقم القياسي للنتيجة الخام (Anthropic: 76.5% pass@10)؛ كل عَلَم يُصحَّح مقابل المُحكِّم (oracle) المُلتزم في المستودع |
| CVE-Zero — 10 ثغرات CVE حقيقية لاحقة على تاريخ قطع بيانات النموذج (2026)، محجوزة (held-out)، 7 لغات | وكيل واحد 8/10 بتطابق دقيق للملف/السطر/CWE (مُتحقق منه: كلها مطابقة تمامًا، مستقر) · 10/10 تم العثور عليها (الحزمة الكاملة) | مقاوم للحفظ والملاءمة (memorization- & fitting-proof): لاحقة على تاريخ قطع البيانات، والطلبات المشدّدة لم تُضبط أبدًا على هذه الثغرات؛ verify-claims يعيد احتسابها. n=10، اتجاهية؛ ميزة السرب هنا هي الاسترجاع (recall)، وليست إثباتًا بأن التنسيق يتفوق على العمل الفردي |
| الوثيقة | المحتويات |
|---|
| FEATURES.md | الحالة ميزة-بميزة ([x] مُشحونة / [~] جزئية / [ ] مخطط لها) |
| SCOPE_AND_AUTHORIZATION | نموذج الصلاحية، إثباتات النطاق، قواعد الأدلة وإعادة الاختبار |
| VERIFIED_PROVENANCE | كيف تتحول النتائج إلى مُثبتة بالأدوات بدلًا من مُدّعاة من النموذج |
| TEAM_PREVIEW | مسار التشغيل الأول وسكربت المراجعة |
| INSTALL_MATRIX | جدول الجاهزية لنظامي macOS / Linux |
| ARSENAL_ACTIVATION_PLAN | إعداد الأدوات الخارجية الاختيارية |
| CYBENCH · WALL_FORENSICS · INTEGRITY_LEDGER · COGNITIVE_ARCHITECTURE | منهجية المعايير |
| RELEASE_CHECKLIST | البوابات التي يجب أن يجتازها أي إصدار |
| عامل التشغيل | المرحلة | MITRE | الوظيفة |
|---|
| Recon | الاستطلاع | TA0043 | OSINT، اكتشاف الشبكة، تعداد الأصول |
| Scanner | الاكتشاف | TA0007 | مسح الثغرات، بصمة الخدمات |
| Exploiter | الوصول الأولي | TA0001 | الاستغلال، تسليم الحمولة |
| Infiltrator | الحركة الجانبية | TA0008 | ما بعد الاستغلال، تصعيد الصلاحيات |
| Exfiltrator | الجمع / النقل للخارج | TA0009/10 | استخراج البيانات، حصاد بيانات الاعتماد |
| Ghost | الثبات | TA0003 | الثبات، التخفي، التنظيف |
| Coordinator | القيادة والتحكم | TA0011 | التحكم بالمهمة، التنظيم |
| Analyst | التحليل | — | تحليل الأنماط، إعداد التقارير |