Skip to content
KitploitKITPLOIT
أدواتالمدونة
إرسال
أدواتالمدونة
إرسال

أدوات الاختراق واختبار الاختراق والأمن السيبراني لترسانتك الأمنية!

Kitploit هو دليل لأدوات الاختراق والأمن السيبراني واختبار الاختراق. اكتشف آخر تحديثات المشاريع للعثور على الثغرات وتحليل الأنظمة وأتمتة الاختبارات وتعزيز أمنك.

··الخلاصات·اتصال·الخصوصية·© 2026 Kitploit

دليل الأدوات

الفئات

عرض جميع الفئات
Loading categories
أدوات/GitHubGitHub/blevene/standalone_tdo
تحليل الثغرات الأمنيةجمع المعلوماتاستخبارات التهديداتتعلم الآلةالأوراق والأبحاثالتعلم والتعليم
GitHubblevene/standalone_tdo

standalone_tdo

يستخرج معلومات استخباراتية عن التهديدات السيبرانية المنظمة (CTI) من مستندات PDF و DOCX و TXT باستخدام نماذج اللغة الكبيرة (LLMs). يولّد تدفقات هجوم MITRE ATT&CK، وفرص الكشف، ورسومات بيانية شاملة للعلاقات بين الكيانات.

عرض المستودع
43منذ 8 أشهرلم تتم المراجعة بعد

الأكثر شعبية

عرض الكل →

اكتشف الأدوات الأكثر استخدامًا من قبل مجتمعنا.

استكشف جميع الأدوات

تصفح مجموعتنا من الأدوات

عرض جميع الأدوات →
مشاركة

أداة استخراج TDO المستقلة

أداة سطر أوامر قوية ومستقلة لاستخراج معلومات التهديدات السيبرانية (CTI) من المستندات باستخدام نماذج اللغة الكبيرة مع إمكانيات مخرجات منظمة متقدمة.

🚀 المميزات

  • دعم تنسيقات مستندات متعددة: PDF، DOCX، TXT، وملفات Markdown
  • تكامل LLM متقدم: نماذج Google Gemini مع مخرجات منظمة وتحليل احتياطي تلقائي
  • مخطط CTI شامل: 12 نوع كيان و24 نوع علاقة بخصائص غنية
  • توليد فرص الكشف: إنشاء قواعد كشف تهديدات قابلة للتنفيذ مدعومة بالأدلة
  • تجميع سير الهجوم: توليد مخططات تدفق MITRE ATT&CK قائمة على الأدلة
  • موثوقية المخرجات المنظمة: مخططات Pydantic مع نسبة نجاح 100% في تحليل JSON
  • معالجة متوازية: معالجة عدة ملفات في وقت واحد مع تتبع التقدم
  • قابلية النقل والاستقلالية: تبعيات قليلة مع تهيئة تعتمد على البيئة

📋 بداية سريعة

1. التثبيت

root@kitploit:~
# استنساخ أو تنزيل مجلد standalone-tdo
cd standalone-tdo

# إنشاء بيئة افتراضية (موصى به)
python -m venv .venv
source .venv/bin/activate  # على ويندوز: .venv\Scripts\activate

# تثبيت التبعيات
pip install -r requirements.txt

2. التهيئة

تستخدم الأداة متغيرات بيئة محملة من ملف .env للتهيئة:

root@kitploit:~
# نسخ ملف التهيئة النموذجي
cp env.example .env

# تحرير ملف .env بإعداداتك
# المتغيرات المطلوبة:
GEMINI_API_KEY=your-google-ai-api-key-here
GEMINI_MODEL=gemini-2.5-flash

الحصول على مفتاح Gemini API:

  1. زيارة Google AI Studio
  2. إنشاء مفتاح API جديد
  3. نسخ المفتاح إلى ملف .env

النماذج المتوفرة:

  • gemini-2.5-flash-preview-05-20 (موصى به - سريع وفعّال من حيث التكلفة)
  • gemini-2.5-pro-preview-06-05 (أكثر قوة، أبطأ)

3. الاستخدام الأساسي

root@kitploit:~
# معالجة ملف واحد مع جميع الميزات
python tdo_bulk.py report.pdf --flow --opps

# معالجة عدة ملفات
python tdo_bulk.py file1.pdf file2.docx file3.txt

# معالجة جميع الملفات في مجلد مع عمال متوازيين
python tdo_bulk.py reports/ -j 4

# توليد تحليل شامل مع تقييم
python tdo_bulk.py report.pdf --flow --opps --eval-opps

🎯 مرجع سطر الأوامر

root@kitploit:~
usage: tdo_bulk.py [options] FILE [FILE ...]

Positional Arguments:
  FILE                  ملف أو أكثر أو مجلدات للمعالجة

Core Options:
  -o, --output DIR      مجلد الإخراج (الافتراضي: ./extracted_data)
  --csv FILE            تصدير الملخص إلى ملف CSV
  -j, --jobs N          عدد العمال المتوازيين (الافتراضي: 1)
  --retries N           عدد محاولات LLM (الافتراضي: 2)
  --backoff SEC         أساس الإرجاع الأسي (الافتراضي: 1.5)

Analysis Features:
  --flow                توليد JSON لسير الهجوم
  --opps                توليد فرص كشف التهديدات
  --eval-opps           تقييم جودة فرص الكشف
  --debug-opps          إظهار معلومات التصحيح لتوليد الفرص

Output Control:
  -q, --quiet           إخراج وحدة التحكم محدود
  -v, --verbose         تسجيل مستوى التصحيح
  -h, --help            عرض رسالة المساعدة والخروج

أمثلة أوامر

root@kitploit:~
# استخراج CTI أساسي
python tdo_bulk.py threat_report.pdf

# تحليل كامل مع جميع الميزات
python tdo_bulk.py apt_report.pdf --flow --opps --eval-opps

# معالجة دفعية مع عمال متوازيين
python tdo_bulk.py reports_folder/ -j 8 --flow --opps

# تصدير النتائج إلى CSV
python tdo_bulk.py *.pdf --csv results.csv

# وضع هادئ للأتمتة
python tdo_bulk.py reports/ -q -o /var/soc/cti --opps

📊 ملفات الإخراج

لكل ملف تمت معالجته، تولد الأداة:

المخرجات الأساسية

  • {filename}_extracted.json: بيانات CTI منظمة بمخطط شامل
  • {filename}_{timestamp}.md: تقرير Markdown قابل للقراءة البشرية مع كل التحليلات

المخرجات الاختيارية (مع العلامات)

  • JSON لسير الهجوم: هيكل تدفق MITRE ATT&CK قائم على الأدلة (مع --flow)
  • فرص الكشف: قواعد كشف قابلة للتنفيذ مع أدلة (مع --opps)

🔍 نظرة عامة على مخطط CTI

أنواع الكيانات (12 نوعًا)

Entity TypeDescriptionKey Properties
ThreatActorمجموعات التهديدات السيبرانيةaliases, primary_motivation, first_seen
Toolبرامج مشروعةfamily, capabilities, kill_chain_phases
Malwareبرامج ضارةfamily, capabilities, first_seen, last_seen
Techniqueتقنيات MITRE ATT&CKid (T1234), description, kill_chain_phases
Tacticتكتيكات MITRE ATT&CKid (TA0001), description
Infrastructureعناوين IP، نطاقات، روابطtype, tags, first_seen, last_seen
Indicatorتجزئات ملفات، أنماطvalue, pattern, valid_from, valid_until
Vulnerabilityإدخالات CVEid, cvss_score, affected_software
Campaignحملات هجومية مسماةobjective, status, first_seen
Identityمؤسسات مستهدفةtype, description
CourseOfActionإجراءات تخفيف، تصحيحاتtype, description
Sourceمصدر المستندfilename, document_title,

أنواع العلاقات (24 نوعًا)

علاقات الإسناد والممثل:

  • USES_TOOL, USES_TECHNIQUE, CONDUCTS, ATTRIBUTED_TO, TARGETS

علاقات فنية:

  • TOOL_IMPLEMENTS_TECHNIQUE, HOSTS_ON, COMMUNICATES_WITH, VARIANT_OF
  • DROPS, DOWNLOADS, INDICATES, OBSERVED_ON, EXPLOITS

علاقات متقدمة:

  • MITIGATES, DETECTS, IS_SUBTECHNIQUE_OF, FLOW_CONTAINS_STEP
  • FLOW_USED_BY_ACTOR, OBSERVES, SOURCED_FROM

جميع العلاقات تدعم خصائص مثل confidence, source, first_seen, last_seen.

💡 فرص الكشف

تولد الأداة فرص كشف قائمة على الأدلة مع:

الميزات الأساسية

  • ربط التقنية: روابط لتقنيات MITRE ATT&CK محددة
  • المصنوعات القابلة للملاحظة: مؤشرات محددة للكشف
  • الأنماط السلوكية: متتاليات وأنماط للمراقبة
  • الاستشهادات بالأدلة: اقتباسات مباشرة من تقارير المصدر
  • درجات الثقة: تقييم الموثوقية (0.0-1.0)
  • تقييم الجودة: تسجيل تلقائي مع تفصيل المعايير

مثال على الإخراج

root@kitploit:~
{
  "id": "opp-001",
  "name": "كشف حقن عملية PowerShell",
  "technique_id": "T1055",
  "artefacts": ["powershell.exe مع استدعاءات WriteProcessMemory"],
  "behaviours": ["حقن العملية في العمليات المشروعة"],
  "rationale": "تستخدم مجموعات APT بشكل شائع PowerShell لحقن العملية",
  "confidence": 0.8,
  "source": "PowerShell المستخدمة لحقن العملية (T1055)",
  "evidence": [
    "• ينفذ PowerShell استدعاءات WriteProcessMemory (سطر 45)",
    "• العلاقة: ThreatActor USES_TECHNIQUE T1055"
  ]
}

🔗 تجميع سير الهجوم

توفر تدفقات الهجوم المحسّنة:

  • ترتيب قائم على الأدلة: خطوات مدعومة بأدلة زمنية وسببية
  • الإشارة إلى الكيانات: كل خطوة تشير إلى كيانات CTI المستخرجة
  • الاستدلال الصريح: تبرير لترتيب الخطوات مع الاستشهادات
  • تغطية شاملة: حتى 25 خطوة تغطي دورة حياة الهجوم الكاملة

مثال على سير الهجوم

root@kitploit:~
{
  "flow": {
    "label": "AttackFlow",
    "pk": "attack-flow--uuid",
    "properties": {
      "name": "هجوم متعدد المراحل APT29",
      "description": "تدفق تصيد احتيالي متطور إلى تسرب البيانات"
    }
  },
  "steps": [
    {
      "order": 1,
      "entity": {"label": "Technique", "pk": "T1566.001"},
      "description": "تسليم مرفق التصيد الاحتيالي",
      "reason": "طريقة الوصول الأولي المذكورة في القسم 2.1 من التقرير"
    }
  ]
}

🏗️ نظرة عامة على البنية

المكونات الأساسية

🎯 واجهة CLI الرئيسية (tdo_bulk.py)

  • نقطة دخول مع تحليل الوسائط والتحقق من البيئة
  • تحميل تهيئة .env باستخدام python-dotenv
  • تنسيق المعالجة المجمعة مع تتبع التقدم

⚙️ مشغل الدفعة (tdo_bulk_runner.py)

  • إدارة المعالجة المتوازية مع ThreadPoolExecutor
  • تنسيق مراحل خط أنابيب الاستخراج
  • معالجة استدعاءات التقدم واسترداد الأخطاء

🧠 مستخرج CTI (tdo_core/extractors/report_processor.py)

  • تحليل المستندات: دعم متعدد التنسيقات (PDF، DOCX، TXT، MD)
  • تكامل LLM: Google Gemini مع مخرجات منظمة
  • تحليل احتياطي: تحليل JSON يدوي عند فشل المخرجات المنظمة
  • إدارة الرموز: تقسيم تلقائي للمستندات الكبيرة
  • التحقق من المخططات: نماذج Pydantic تضمن اتساق البيانات

🔍 مولد TDO (tdo_core/detection/opportunity_generator.py)

  • إنشاء فرص كشف قائمة على الأدلة
  • ربط تقنيات MITRE ATT&CK
  • تقييم الجودة مع معايير التسجيل
  • وضع التصحيح للتحليل التفصيلي

🌊 مُجمّع سير الهجوم (tdo_core/flows/attack_flow_synthesizer.py)

  • توليد التدفق المدعوم بـ LLM مع دعم الأدلة
  • احتياطي قائم على القواعد للتدفقات البسيطة
  • ترتيب الخطوات مع الاستدلال الصريح
  • تحليل علاقات الكيانات

📝 مولد التقارير (tdo_core/report/md_export.py)

  • إنشاء تقارير Markdown قابلة للقراءة البشرية
  • عرض البيانات المنظمة
  • دمج جميع مكونات التحليل

🎨 إدارة المطالبات (tdo_core/llm/prompts.py)

  • قوالب مطالبات مركزية
  • تحسين المخرجات المنظمة
  • أفضل الممارسات للتفاعل مع LLM

تدفق البيانات

root@kitploit:~
إدخال المستند → استخراج النص → معالجة LLM → إخراج منظم
     ↓              ↓                 ↓               ↓
   PDF/DOCX      نص نظيف       API Gemini     JSON + احتياطي
     ↓              ↓                 ↓               ↓
 متعدد التنسيقات   معالجة مسبقة    مخطط Pydantic   تحقق من الصحة
     ↓              ↓                 ↓               ↓
دعم الملفات     تنقية النص     بيانات منظمة    رسم بياني CTI
                                      ↓
                              معالجة لاحقة
                                 ↓         ↓
                       تدفقات الهجوم   فرص الكشف
                                 ↓         ↓
                     تصدير تقرير Markdown

🛠️ تهيئة متقدمة

متغيرات البيئة

VariableRequiredDescriptionExample
GEMINI_API_KEY✅مفتاح Google AI APIAIza...
GEMINI_MODEL✅نموذج Gemini للاستخدامgemini-2.5-flash-preview-05-20

دليل اختيار النموذج

ModelSpeedQualityCostUse Case
gemini-2.5-flash-preview-05-20⚡ سريع🎯 جيد💰 منخفضإنتاج، معالجة مجمعة
gemini-2.5-pro-preview-06-05🐌 بطيء🏆 ممتاز💸 مرتفعتحليل معقد، بحث

🔧 استكشاف الأخطاء وإصلاحها

المشاكل الشائعة

متغيرات البيئة المفقودة

root@kitploit:~
خطأ: متغيرات البيئة المطلوبة مفقودة: GEMINI_API_KEY, GEMINI_MODEL

الحل: إنشاء ملف .env مع كلا المتغيرين المطلوبين

تنسيق ملف غير مدعوم

root@kitploit:~
تخطي ملف غير مدعوم: document.rtf

الحل: التحويل إلى تنسيق PDF، DOCX، TXT، أو MD

أخطاء معالجة LLM

root@kitploit:~
خطأ في Gemini API المنظم: ...

الحلول:

  • التحقق من صحة مفتاح API
  • التحقق من تهجئة اسم النموذج
  • المحاولة بمستندات أصغر أولاً
  • استخدام --verbose للحصول على سجلات أخطاء مفصلة

مشاكل تحليل JSON

تتعامل الأداة تلقائياً مع مشاكل تحليل JSON باستخدام:

  • الإخراج المنظم كطريقة أساسية
  • احتياطي التحليل اليدوي
  • إصلاح JSON للاستجابات المقتطعة
  • استرداد الأخطاء بأناقة

تحسين الأداء

  • المعالجة المتوازية: استخدم علامة -j لملفات متعددة
  • اختيار النموذج: استخدم نماذج أسرع للمعالجة المجمعة
  • الوضع الهادئ: استخدم -q لنصوص الأتمتة
  • إدارة الإخراج: التنظيم باستخدام مجلدات إخراج مخصصة

وضع التصحيح

root@kitploit:~
# تفعيل التسجيل المفصل
python tdo_bulk.py report.pdf -v

# تصحيح فرص الكشف
python tdo_bulk.py report.pdf --opps --debug-opps

# تصدير سجلات مفصلة
python tdo_bulk.py report.pdf -v > processing.log 2>&1

📦 التبعيات

تتطلب الأداة Python 3.9+ وهذه الحزم الرئيسية:

  • google-generativeai: عميل Google AI (Gemini) API مع إخراج منظم
  • PyMuPDF: استخراج نصوص PDF عالي الأداء
  • python-docx: معالجة مستندات Microsoft Word
  • pandas: معالجة البيانات وتصدير CSV
  • pydantic: التحقق من المخططات والإخراج المنظم
  • python-dotenv: إدارة متغيرات البيئة
  • cleantext: أدوات معالجة النص الأولية

🚧 القيود

هذا الإصدار المستقل:

  • لا يتضمن تكامل رسم المعرفة أو Neo4j
  • لا يدعم ميزات قاعدة البيانات المتجهة للبحث بالتشابه
  • لا توجد إمكانيات زيادة استرجاع في الوقت الفعلي
  • مبسط مقارنة بمنصة TDO الكاملة

ومع ذلك، فإنه يتضمن جميع قدرات استخراج وتحليل CTI الأساسية اللازمة لمعظم حالات الاستخدام.

🔄 التحسينات الأخيرة

  • تهيئة البيئة: الانتقال إلى إدارة ملف .env باستخدام dotenv
  • الإخراج المنظم: تحليل JSON موثوق بنسبة 100% مع Google Gemini
  • المخططات المحسّنة: 12 نوع كيان و24 نوع علاقة شامل
  • فرص الكشف: توليد قواعد كشف قائمة على الأدلة مع تقييم
  • تحسينات سير الهجوم: معزز بدعم الأدلة والاستدلال الصريح
  • لا توجد إعدادات افتراضية ثابتة: جميع التهيئة تأتي من متغيرات البيئة
  • معالجة أخطاء قوية: تحليل احتياطي تلقائي واسترداد الأخطاء بأناقة

🔒 اعتبارات الأمان

حماية مفتاح API

  • لا تلتزم أبداً بملف .env الخاص بك - فهو مستبعد بواسطة .gitignore
  • قم بتخزين GEMINI_API_KEY بأمان باستخدام متغيرات البيئة
  • قم بتدوير مفاتيح API بشكل دوري
  • راجع SECURITY.md للحصول على إرشادات أمان مفصلة

خصوصية البيانات

  • يتم إرسال نص المستند إلى واجهة Gemini API من Google للمعالجة
  • راجع سياسات استخدام بيانات Google AI قبل معالجة المستندات الحساسة
  • قد تحتوي البيانات المستخرجة على معلومات حساسة (IOCs، أسماء مؤسسات، مسارات ملفات)
  • راجع المخرجات قبل المشاركة خارج مؤسستك

بيانات الإخراج

قد تحتوي ملفات JSON وMarkdown المستخرجة على:

  • عناوين IP وأسماء نطاقات (مؤشرات بنية تحتية)
  • تجزئات ملفات ومؤشرات تقنية
  • معلومات مؤسسات وأهداف
  • بيانات مفصلة عن ممثلي التهديدات والحملات

قم دائماً بمراجعة المخرجات قبل المشاركة العامة.

الإبلاغ عن المشاكل الأمنية

يرجى الإبلاغ عن الثغرات الأمنية بشكل مسؤول. راجع SECURITY.md للتفاصيل.

📄 الترخيص

هذا المشروع مرخص بموجب رخصة MIT - راجع LICENSE للتفاصيل.

🤝 المساهمة

المساهمات مرحب بها! يرجى قراءة CONTRIBUTING.md للإرشادات.


هل تحتاج إلى مساعدة؟ قم بتشغيل python tdo_bulk.py --help للمرجع السريع أو راجع قسم استكشاف الأخطاء وإصلاحها أعلاه.

تنزيل الأداة
file_size_mb