Skip to content
KitploitKITPLOIT
أدواتالمدونة
إرسال
أدواتالمدونة
إرسال

أدوات الاختراق واختبار الاختراق والأمن السيبراني لترسانتك الأمنية!

Kitploit هو دليل لأدوات الاختراق والأمن السيبراني واختبار الاختراق. اكتشف آخر تحديثات المشاريع للعثور على الثغرات وتحليل الأنظمة وأتمتة الاختبارات وتعزيز أمنك.

··الخلاصات·اتصال·الخصوصية·© 2026 Kitploit

دليل الأدوات

الفئات

عرض جميع الفئات
Loading categories
T3MP3ST — منصة مستقلة لاختبارات الاختراق؛ أداة تشغيل متعددة الوكلاء للأمن الهجومي | Kitploit
أدوات/GitHubGitHub/elder-plinius/t3mp3st
أطر اختبار الاختراقالاستطلاعأطر الاستغلالتحليل الثغرات الأمنيةاستغلال تطبيقات الويبCTFأمن السحابةأمن الجوالتحليل الملفات الثنائيةالتعلم والتعليمالفريق الأحمرأمن الذكاء الاصطناعي
5.5k1.1k1منذ 8 أيامتمت المراجعة من قبل Kitploit

الأكثر شعبية

عرض الكل →

اكتشف الأدوات الأكثر استخدامًا من قبل مجتمعنا.

استكشف جميع الأدوات

تصفح مجموعتنا من الأدوات

عرض جميع الأدوات →
مشاركة
GitHubelder-plinius/t3mp3st

T3MP3ST

منصة مستقلة لاختبارات الاختراق؛ أداة تشغيل متعددة الوكلاء للأمن الهجومي

عرض المستودع

🌩️ T3MP3ST 🌩️

root@kitploit:~
 ▄▄▄█████▓▓█████  ███▄ ▄███▓ ██▓███  ▓█████   ██████ ▄▄▄█████▓
 ▓  ██▒ ▓▒▓█   ▀ ▓██▒▀█▀ ██▒▓██░  ██▒▓█   ▀ ▒██    ▒ ▓  ██▒ ▓▒
 ▒ ▓██░ ▒░▒███   ▓██    ▓██░▓██░ ██▓▒▒███   ░ ▓██▄   ▒ ▓██░ ▒░
 ░ ▓██▓ ░ ▒▓█  ▄ ▒██    ▒██ ▒██▄█▓▒ ▒▒▓█  ▄   ▒   ██▒░ ▓██▓ ░
   ▒██▒ ░ ░▒████▒▒██▒   ░██▒▒██▒ ░  ░░▒████▒▒██████▒▒  ▒██▒ ░
   ▒ ░░   ░░ ▒░ ░░ ▒░   ░  ░▒▓▒░ ░  ░░░ ▒░ ░▒ ▒▓▒ ▒ ░  ▒ ░░
     ░     ░ ░  ░░  ░      ░░▒ ░      ░ ░  ░░ ░▒  ░ ░    ░
   ░         ░   ░      ░   ░░          ░   ░  ░  ░    ░
             ░  ░       ░               ░  ░      ░

إطار عمل أمني هجومي متعدد الوكلاء (multi-agent)، صُمم ليحوّل وكيل البرمجة بالذكاء الاصطناعي الذي تشغّله أصلًا إلى صائد ثغرات zero-day.

scores: re-derivable   verify-claims 24/24   PRs welcome   License: AGPL-3.0

وكيل البرمجة بالذكاء الاصطناعي لديك قرصان بالفعل — T3MP3ST يضع في يديه ترسانة.

وجّهه إلى هدف مصرّح به وستعمل سلسلة القتل (kill chain) من تلقاء نفسها: استطلاع (recon) ← استغلال (exploit) ← تقرير (report)، من غرفة حرب (War Room) داخل المتصفح أو من سطر الأوامر (CLI)، بقيادة الوكيل الذي سجّلت الدخول به أصلًا — Claude Code، أو Codex، أو Hermes — أو نموذج تشغّله بالكامل دون اتصال (Ollama, LM Studio, vLLM). لا مفاتيح API جديدة، لا حساب سحابي، لا فاتورة ثانية. وكيلك هو الدماغ؛ وT3MP3ST هو آلة الحرب المثبّتة حوله. عاصفة ذاتية الاستضافة. حرب بلا مفاتيح. ⚡

ولن يطلب منك أن تصدّقه على كلامه. ففي مجموعة XBOW الخاصة المكوّنة من 104 تحديات يسجّل 90.1% بمقياس pass@1 — أعلى من 85% التي أعلنتها XBOW عن نفسها — إلى جانب حلول CTF دون تلميحات ومطاردة باردة لثغرات CVE حقيقية لاحقة على تاريخ قطع بيانات النموذج (post-cutoff) لم يرها النموذج من قبل. كل رقم في هذا README يُعاد احتسابه من بيانات مُلتزمة في المستودع بأمر واحد (npm run verify-claims). صاخبون بشأن المهمة، صادقون بشأن البناء — جدول الحالة يبيّن بدقة ما هو مباشر، وما هو هيكل أولي، وما لا يزال على خارطة الطريق؛ الإثباتات الكاملة في المعايير.

ثلاثة أمور تميّزه:

  1. قابل لإعادة الإنتاج. كل رقم في هذا README يُعاد احتسابه من بيانات مُلتزمة في المستودع — npm run verify-claims يعيد اشتقاقها جميعًا، 24/24 خضراء. أي ادعاء لا يمكن إعادة إنتاجه لا يُنشر. لا أرقام «ثق بي» أبدًا.
  2. بلا مفاتيح. وكيل البرمجة بالذكاء الاصطناعي الموجود أصلًا على جهازك هو العمود الفقري. لا مفاتيح API، لا فاتورة ثانية، لا بوّاب.
  3. صادق بشأن النطاق. جدول الحالة يحدّد بدقة ما هو مستقر، أو تجريبي، أو على خارطة الطريق — لأن الاختراق الأخلاقي (red-teaming) لا ينبغي أن يكون حكرًا على نخبة، وبالتأكيد لا ينبغي أن يعمل على الانطباعات.

انتقل إلى → بدء سريع · ما يصطاده · ما يُشحن اليوم · المعايير · البنية · التوثيق

⚠️ للاستخدام المصرّح به فقط

T3MP3ST أداة أمنية هجومية، صُممت للاختبار المصرّح به والبحث والتعليم. وجّهها فقط إلى أنظمة تملكها أو لديك إذن صريح كتابي لاختبارها. الوصول غير المصرّح به إلى الحواسيب أو الشبكات أو البيانات غير قانوني في معظم الدول — أنت وحدك المسؤول عن طريقة استخدامك لهذا البرنامج وعن البقاء داخل القانون وقواعد الاشتباك الخاصة بك. اجلب العاصفة إلى أهدافك أنت، لا إلى أهداف غيرك.

T3MP3ST مقدَّم كما هو بموجب رخصة AGPL-3.0، دون أي ضمان أو مسؤولية عن أي ضرر أو خسارة أو إساءة استخدام. لا يقرّ المؤلفون أي نشاط غير مصرّح به ولا يدعمونه ولا يتغاضون عنه. احصل على الإذن. التزم بالنطاق. لا تكن خطرًا. 🫡

لماذا وُجد

الأمن الهجومي يقف خلف سنوات من الممارسة وأدوات باهظة الثمن. الرهان الذي يقوم عليه T3MP3ST هو أن سربًا منسقًا من الوكلاء (agent swarm) يجعل صيد الثغرات الحقيقي في متناول من لم يحصلوا على الدعوة أبدًا، عبر تطبيقات الويب ومسابقات CTF والعقود الذكية والكود المصدري والبرمجيات مفتوحة المصدر للأنظمة المدمجة والروبوتات. هذا رهان طموح، والأقسام أدناه حريصة على الفصل بين ما يعمل فعلًا وما لا يزال رهانًا.

ما يصطاده

بدء سريع

أسرع طريق إلى غرفة حرب (War Room) عاملة (بلا مفاتيح، ~دقيقتان للإعداد؛ زمن المهمة يعتمد على الهدف):

root@kitploit:~
npm install
npm run server        # War Room → http://127.0.0.1:3333/ui/

في غرفة الحرب، افتح الإعدادات واربط وكيلًا محليًا (Claude Code / Codex / Hermes). ثم صِف هدفًا إلى Op Admiral بالإنجليزية العادية وأطلق المهمة. الوكيل الذي ربطته هو الدماغ. لا حاجة إلى أي مفتاح.

تفضّل إحضار مفتاح؟ اضبط واحدًا وتجاوز خطوة الربط:

root@kitploit:~
export OPENROUTER_API_KEY=...     # or VENICE_API_KEY / ANTHROPIC_API_KEY / OPENAI_API_KEY
export XAI_API_KEY=...            # Grok Build (grok-build-0.1) — xAI's coding model, native tool-calling

يمكن منح الوكلاء المحليين البطيئين مساحة أكبر عبر T3MP3ST_LOCAL_AGENT_TIMEOUT_MS لكل استدعاء CLI، وT3MP3ST_TASK_TIMEOUT_MS لمهام العملية، وT3MP3ST_GENERAL_TIMEOUT_MS لطلبات التخطيط. القيم بالمللي ثانية.

أو شغّله بالكامل دون اتصال على نموذجك الخاص — لا مفتاح، لا سحابة. الافتراضي هو Ollama؛ وجّهه إلى أي خادم متوافق مع OpenAI (LM Studio, vLLM, llama.cpp):

root@kitploit:~
ollama serve && ollama pull llama3                          # or an OpenAI-compatible server
export TEMPEST_LOCAL_BASE_URL=http://localhost:11434/api    # LM Studio: http://localhost:1234/v1
export TEMPEST_LOCAL_MODEL=llama3
npx tempest                                                 # → "Change default provider" → local

استدعاء الأدوات (tool-calling) يعمل على أي نموذج محلي (لأنه يُدار عبر النص)، لذا تعمل الترسانة حتى على النماذج التي لا تدعم استدعاء الدوال بشكل أصلي.

تحقّق من الأرقام بنفسك:

root@kitploit:~
npm run verify-claims             # re-derives every headline from committed JSON in bench/

استخدام المكتبة/SDK، وواجهة HTTP API الكاملة، وإعداد MCP موجودة في docs/.

ما يُشحن اليوم

الإطار عبارة عن سلسلة قتل من 8 عوامل تشغيل (operators)، وهذا الجدول لن يجمّل الحقيقة بشأنها. الاستطلاع محرك مباشر مدعوم بأدوات حقيقية — والأنياب حقيقية فعلًا: 90.1% بمقياس pass@1 على XBEN، و8 من 10 ثغرات CVE محجوزة (held-out) لاحقة على تاريخ قطع البيانات مثبّتة بدقة على الملف/السطر/CWE، وخط أنابيب إفصاح منسق مباشر بما يكفي لوجود مسودات محتجزة للتنسيق مع البائعين الآن. ما غير مُثبت هو السرب. كل عامل تشغيل في المراحل اللاحقة — Exploiter وInfiltrator وExfiltrator وGhost — يشغّل حلقة ReAct الحقيقية المدعومة بالأدوات نفسها التي يعمل بها الاستطلاع (أدوات استغلال حقيقية، لا أدوات وهمية)، لكن الأرقام الرئيسية جاءت من وكيل واحد، لا من خلية العوامل الثمانية المنسقة، والاستغلال بالسرب من البداية إلى النهاية غير مُقيَّم بمعايير وما يزال غير موثوق. المحرك حقيقي؛ والسرب هو الجزء الذي ما يزال يثبت جدارته. صاخبون حيث استحقققنا ذلك، وصريحون بشأن الباقي.

التفصيل الكامل ميزة-بميزة: FEATURES.md.

التغطية حسب المجال

أين تبلغ العاصفة اليوم — وإلى أين تتجه. الانضباط نفسه كما في كل شيء آخر: أي مجال يحصل على ✅ فقط عندما يوجد إثبات (receipt) خلفه.

بنية الفئات/الفرق (class/squad) تعني أن المجالات الجديدة تتألف بدلًا من أن تتفرع — كل مجال هو عدة (loadout) (فئات متخصصة + ترسانة + محوّل أهداف + معيار). المجالات 🚧 تُطلق دون إعلان حتى يصبح لها رقم.

المعايير

النتائج الرئيسية. كل نتيجة يُعاد احتسابها من ملفات JSON المُلتزمة في المستودع عبر npm run verify-claims؛ المنهجية الكاملة والتحفظات في الوثائق المرتبطة.

كيف تقرأ هذه النتائج:

  • كل عَلَم محلول يُصحَّح مقابل مُحكِّم (oracle) للحقيقة الأرضية مُلتزم في المستودع — لا تقريرًا ذاتيًا — وverify-claims يعيد احتساب النجاح/الفشل. النصوص الخام خطوة-بخطوة محذوفة لخصوصية عوامل التشغيل، لذا أنت تعيد التحقق من الحكم المُصحَّح، لا من مخرجات الأدوات الخام. صفر تلفيق، مفروض بحارس ضد الملاءمة (anti-fitting) يعمل مع كل push.
  • الصندوق الأسود (المصدر محجوب) والصندوق الأبيض (المصدر مُجهَّز) يُبلَغ عنهما منفصلين ولا يُدمجان أبدًا.
  • هذه النتائج شغّلت حلقة ReAct بوكيل واحد، لا سرب العوامل الثمانية. السرب هو بنية إطار العمل؛ وليس هو ما سجّل هذه الأرقام.
  • النتائج نظام-مقابل-نظام: هذا الحزام (harness) يقود نموذجًا حاليًا قويًا، وليست ادعاءً لحزام معزول.

الرقم ليس موضع التباهي — الإثبات (receipt) هو. حزام (harness) مفتوح المصدر بلا مفاتيح يضع بين يديك إعادة التشغيل بدلًا من أن يطلب منك الثقة به: استنسخه، شغّل npm run verify-claims، وكل حكم أعلاه يُعاد احتسابه أمامك من مُحكِّمه المُلتزم في المستودع.

قراءة أعمق: WALL_FORENSICS (الأخطاء لكل تحدٍّ)، CYBENCH، INTEGRITY_LEDGER (تدقيق التلوث وكل تراجع عن نتيجة)، OBSIDIVM (ميدان الويب المباشر الخاص بنا).

التوثيق

البنية

root@kitploit:~
┌─────────────────────────────────────────────────────────────────┐
│                        T3MP3ST COMMAND                          │
├─────────────────────────────────────────────────────────────────┤
│   MISSION CONTROL  ◄──  TARGET MODEL  ──►  ARSENAL (TOOLS)       │
│                          ▲                                       │
│   AGENT CELL:  RECON · SCANNER · EXPLOITER · INFILTRATOR ·       │
│                EXFILTRATOR · GHOST · COORDINATOR · ANALYST       │
│                          ▲                                       │
│   EVIDENCE VAULT  ·  CREDENTIAL STORE  ·  FINDINGS LEDGER        │
│                          ▲                                       │
│   OPSEC LAYER  ·  COMMS CHANNEL  ·  LLM BACKBONE                 │
└─────────────────────────────────────────────────────────────────┘

تتقابل عوامل التشغيل مع مراحل MITRE ATT&CK وسلسلة القتل السيبراني (الاستطلاع مباشر؛ المراحل اللاحقة هيكل أولي):

المزوّدون: OpenRouter، Venice، Anthropic، OpenAI، أو وكيل محلي بلا مفاتيح (Claude Code / Codex / Hermes). اضبط OPENROUTER_API_KEY / VENICE_API_KEY / ANTHROPIC_API_KEY، أو اربط وكيلًا في الإعدادات.

التكاملات: node dist/mcp-server.js يوفّر security_recon للوكلاء المتوافقين مع MCP. npm run server يشغّل HTTP API (POST /api/mission/start, GET /api/mission/status, والمزيد). المرجع الكامل في docs/.

المساهمة — انضم إلى السرب

الاختراق الأخلاقي (red-teaming) لا ينبغي أن يكون حكرًا على نخبة. قدّم محوّلًا (adapter)، أو حزمة طلبات (prompt pack)، أو دليل تشغيل (runbook)، أو أداة ترسانة جديدة، أو تقرير خطأ.

قاعدة واحدة غير قابلة للتفاوض: كل شيء هنا مخصص للاختبار المصرّح به فقط. أهداف مملوكة، أو محدّدة النطاق، أو بموافقة أصحابها. ابنِ للمدافعين، أو لا تبنِ هنا أصلًا.

  1. انسخه (fork) وافترع منه (branch).
  2. افتح طلب سحب (PR) مع اختبارات. إذا لمست رقمًا رئيسيًا، يجب أن يبقى npm run verify-claims أخضر.

عملية الإصدار والبوابات: RELEASE_CHECKLIST.

الترخيص

AGPL-3.0. انظر LICENSE.


Fortes fortuna iuvat — الحظ يخدم الجريئين.

⊰•-•✧ LOVE PLINY ✧•-•⊱ 🌩️

تنزيل الأداة
المجالما يفعلهالحالة
🕸️ تطبيقات الويباستطلاع الصندوق الأسود من منظور مهاجم خارجي ← استغلال (مجموعة XBEN)✅ مستقر
🚩 CTFحلول دون تلميحات داخل صندوق رمل معزول (sandbox) (Cybench)✅ مستقر
🤖 الروبوتات / التقنيات التشغيلية OT / الأنظمة المدمجةخط أنابيب إفصاح منسق لصيد ثغرات البرمجيات مفتوحة المصدر (OSV + PoC حي + داحض refuter)✅ خط الأنابيب مستقر
📂 الكود المصدريتحليل المستودع بالصندوق الأبيض مع تفكيك أعمى عبر باني رئيسي (master-builder)⚠️ الإدخال بلغة Python فقط
💰 العقود الذكيةDamn Vulnerable DeFi⚠️ إعادة إنتاج، لا اكتشاف جديد
☁️ السحابة (IaC)معيار كشف سوء الإعداد (cloud:bench) + ترسانة سحابية اختيارية (aws/az/gcloud + scoutsuite/cloudfox/pmapper؛ pacu خلف بوابة)🚧 هيكل أولي لكشف سوء إعداد IaC — استغلال السحابة المباشر غير مُقيَّم بمعايير بعد
📱 الأجهزة المحمولةمحلّل ثابت مدمج (سوء إعداد manifest + كشف الأسرار/النصوص الصريحة، mobile:bench) + ترسانة اختيارية (mobsfscan/objection/drozer؛ frida خلف بوابة)🚧 هيكل أولي للكشف الثابت — الاستغلال الديناميكي غير مُقيَّم بمعايير
🔩 الثنائيات / الهندسة العكسيةكاشف نقاط الالتقاء (sink) في المخرجات المفكوكة (نسخ غير آمن / سلسلة تنسيق / حقن أوامر / تجاوز أعداد صحيحة، binary:bench) + ترسانة اختيارية (ghidra/radare2/objdump/checksec/strings؛ gdb خلف بوابة)🚧 هيكل أولي لكشف الالتقاء الثابت — الحل/الاختراق pwn غير مُقيَّم بمعايير
المكوّنالحالةملاحظات
القياس القابل لإعادة الاشتقاق (verify-claims)✅ مستقركل عنوان رئيسي يُعاد احتسابه من القطع الأثرية المُلتزمة في المستودع
محرك الاستطلاع✅ مستقريقود nmap / DNS / HTTP / بصمة النظام؛ كل نتيجة يُتتبّع أثرها إلى مخرجات أدوات حقيقية
محرك المهام + غرفة الحرب + Op Admiral✅ مستقربلا مفاتيح عبر وكيل محلي مربوط
الترسانة، خادم MCP، HTTP API✅ مستقر35 أداة مدمجة افتراضيًا؛ و83 مع الترسانة الاختيارية T3MP3ST_FULL_ARSENAL (+48 محوّلًا، مع برامج التشغيل الخطرة بعد الاستغلال (post-exploitation) — metasploit, hydra — خلف بوابة موافقة بشرية) — كلا العددين يُعاد اشتقاقه عبر verify-claims. وsecurity_recon عبر MCP
احتواء نطاق الخروج (egress)✅ مستقر (مفعّل افتراضيًا)بمجرد تعيين هدف المهمة، ترفض الأدوات الشبكية المدمجة المضيفات العامة خارج النطاق — لا الهدف/نطاقاته الفرعية، ولا الحلقة المحلية/الخاصة (SCOPE DENIED) — إعداد افتراضي مشدّد، وليس مجرد مشغّل أدوات
خط أنابيب الإفصاح المنسق✅ مستقرجِدّة OSV + PoC حي + لوحة دحض (refuter) + CVSS؛ مسودات فقط، والإرسال من إنسان
تحليل المصدر بالصندوق الأبيض⚠️ تجريبيإدخال عبر regex بلغة Python فقط؛ التفكيك متعدد النماذج يكلّف رموزًا (tokens) أكثر، لا أقل
DeFi (Damn Vulnerable DeFi)⚠️ تجريبييعيد إنتاج أصناف الاستغلال المعروفة؛ لا اكتشافًا جديدًا
Exploiter / Infiltrator / Exfiltrator / Ghost⚠️ تجريبييشغّل حلقة ReAct الحقيقية المدعومة بالأدوات (نفس محرك الاستطلاع)؛ غير مُثبت كسرب منسق — المسار المُقيَّم بالمعايير هو الوكيل الواحد، واستغلال السرب المباشر ما يزال غير موثوق
الوحدات المتقدمة (السحابة، الثبات، السرب، الإدراك)🚧 مخطط لهاواجهات فقط في src/stubs/
حلقة التحسين الذاتي🧪 بحثيوثّق الدروس والمقترحات اليوم؛ وإعادة تغذيتها في التخطيط على خارطة الطريق
المجالما يغطيهالحالة
🕸️ الويبالتطبيقات، واجهات API، تدفقات المصادقة، OWASP Top 10✅ أساسي (Core) — XBEN 90.1% pass@1
📂 الكودتدقيق المصدر بالصندوق الأبيض، صيد ثغرات بأسلوب SAST✅ مُثبت (نتيجة صيد) — CVE-Zero محجوزة: وكيل واحد 8/10 بتطابق دقيق للملف/السطر/CWE، و10/10 تم العثور عليها (7 لغات)؛ محرك إدخال المستودع نفسه ما يزال ⚠️ تجريبيًا
🚩 CTFألعاب حربية، ميادين تدريب، تحديات✅ مُثبت — Cybench 23/40 دون تلميحات
🔌 الشبكة / البنية التحتيةاستطلاع، بصمة الخدمات/الحزم التقنية؛ حركة جانبية + تصعيد صلاحيات✅ استطلاع (محرك nmap/DNS/HTTP مباشر) · ⚠️ حركة جانبية/تصعيد صلاحيات تجريبيان
🤖 المدمجة / إنترنت الأشياء / التقنيات التشغيليةبرامج ثابتة (firmware)، روبوتات، برمجيات ICS/SCADA مفتوحة المصدر✅ خط أنابيب CVE مباشر — مسودات إفصاح منسق محتجزة للبائعين
📦 سلسلة التوريدتدقيق التبعيات، تثبيت دون تأكيد⚠️ حقيقي — فئة مخصصة؛ التقط CWE-829 على المجموعة المحجوزة
💰 سلسلة الكتلعقود ذكية، DeFi، Solidity⚠️ إعادة إنتاج فقط — Damn Vulnerable DeFi، لا اكتشافًا جديدًا
☁️ السحابةسوء إعداد AWS/GCP/Azure، IAM، الحوسبة بلا خوادم (serverless)🚧 قيد التطوير
📱 الأجهزة المحمولةأمان تطبيقات Android/iOS🚧 قيد التطوير
🏢 الهوية / الدليل النشط ADKerberos، تمرير التجزئة (pass-the-hash)، هجمات AD🚧 قيد التطوير
🔐 الثنائيات / الهندسة العكسيةتجاوزات الذاكرة (overflows)، ROP، تطوير الاستغلال (exploit dev)🚧 قيد التطوير — يحتاج أدوات متخصصة
المجموعةالنتيجةالسياق
XBEN — مجموعة XBOW الخاصة المكوّنة من 104 تحديات، صندوق أسودمتوسط pass@1 90.1% (Wilson-95 86.2–92.9)، الحد الأدنى 91/104 · gpt-5.5XBOW تعلن عن 85% على المجموعة نفسها؛ نحن نعيد اشتقاق الحكم المُصحَّح من القطع الأثرية المُلتزمة (النصوص الخام محذوفة للخصوصية)
XBEN — صندوق أبيض (يُبلَغ عنه منفصلًا)pass@1 98.7%، أفضل محاولة (best-ball) 104/104 · gpt-5.5لا يُدمج أبدًا مع رقم الصندوق الأسود
Cybench — معيار أكاديمي من 40 مهمة، Opus 4.8، دون تلميحات23/40 (58%) دون تلميحات، pass@1 من تشغيل واحد (مفروض عبر verify-claims)ليس الرقم القياسي للنتيجة الخام (Anthropic: 76.5% pass@10)؛ كل عَلَم يُصحَّح مقابل المُحكِّم (oracle) المُلتزم في المستودع
CVE-Zero — 10 ثغرات CVE حقيقية لاحقة على تاريخ قطع بيانات النموذج (2026)، محجوزة (held-out)، 7 لغاتوكيل واحد 8/10 بتطابق دقيق للملف/السطر/CWE (مُتحقق منه: كلها مطابقة تمامًا، مستقر) · 10/10 تم العثور عليها (الحزمة الكاملة)مقاوم للحفظ والملاءمة (memorization- & fitting-proof): لاحقة على تاريخ قطع البيانات، والطلبات المشدّدة لم تُضبط أبدًا على هذه الثغرات؛ verify-claims يعيد احتسابها. n=10، اتجاهية؛ ميزة السرب هنا هي الاسترجاع (recall)، وليست إثباتًا بأن التنسيق يتفوق على العمل الفردي
الوثيقةالمحتويات
FEATURES.mdالحالة ميزة-بميزة ([x] مُشحونة / [~] جزئية / [ ] مخطط لها)
SCOPE_AND_AUTHORIZATIONنموذج الصلاحية، إثباتات النطاق، قواعد الأدلة وإعادة الاختبار
VERIFIED_PROVENANCEكيف تتحول النتائج إلى مُثبتة بالأدوات بدلًا من مُدّعاة من النموذج
TEAM_PREVIEWمسار التشغيل الأول وسكربت المراجعة
INSTALL_MATRIXجدول الجاهزية لنظامي macOS / Linux
ARSENAL_ACTIVATION_PLANإعداد الأدوات الخارجية الاختيارية
CYBENCH · WALL_FORENSICS · INTEGRITY_LEDGER · COGNITIVE_ARCHITECTUREمنهجية المعايير
RELEASE_CHECKLISTالبوابات التي يجب أن يجتازها أي إصدار
عامل التشغيلالمرحلةMITREالوظيفة
ReconالاستطلاعTA0043OSINT، اكتشاف الشبكة، تعداد الأصول
ScannerالاكتشافTA0007مسح الثغرات، بصمة الخدمات
Exploiterالوصول الأوليTA0001الاستغلال، تسليم الحمولة
Infiltratorالحركة الجانبيةTA0008ما بعد الاستغلال، تصعيد الصلاحيات
Exfiltratorالجمع / النقل للخارجTA0009/10استخراج البيانات، حصاد بيانات الاعتماد
GhostالثباتTA0003الثبات، التخفي، التنظيف
Coordinatorالقيادة والتحكمTA0011التحكم بالمهمة، التنظيم
Analystالتحليل—تحليل الأنماط، إعداد التقارير