Skip to content
KitploitKITPLOIT
उपकरणएक्सप्लॉइटब्लॉग
Log in
जमा करें
उपकरणएक्सप्लॉइटब्लॉग
जमा करें

हैकिंग, पेनटेस्ट और साइबर सुरक्षा उपकरण आपके सुरक्षा शस्त्रागार के लिए!

Kitploit हैकिंग, साइबर सुरक्षा और पेंटेस्टिंग टूल्स की एक निर्देशिका है। कमजोरियों को खोजने, सिस्टम का विश्लेषण करने, परीक्षण को स्वचालित करने और अपनी सुरक्षा को मजबूत करने के लिए नवीनतम प्रोजेक्ट अपडेट खोजें।

फ़ीडसंपर्कगोपनीयता© 2026 Kitploit

टूल निर्देशिका

श्रेणियाँ

सभी श्रेणियाँ देखें
Loading categories
DeepTrap — OpenClaw एजेंटों का मूल्यांकन करने के लिए सुरक्षा बेंचमार्क, जो प्रतिकूल निष्पादन संदर्भों (adversarial execution contexts) के विरुद्ध काम करता है, जिनमें ज़हरीली फ़ाइलें (poisoned files), इंजेक्ट किए गए कौशल (injected skills), भ्रामक टूल मेटाडेटा (misleading tool metadata), और एन्कोडेड पेलोड (encoded payloads) शामिल हैं। इसमें 42 रीप्ले कार्य (replay tasks) शामिल हैं, जो 6 जोखिम सुइट्स (risk suites) में फैले हुए हैं, जिनमें हमले और उपयोगिता स्कोरिंग (attack and utility scoring) होती है। | Kitploit
उपकरण/GitHubGitHub/zjuicsr/deeptrap
विशेषाधिकार वृद्धिडेटा निष्कासनपेनिट्रेशन टेस्टिंगकमांड एंड कंट्रोलआपूर्ति श्रृंखला सुरक्षालर्निंग और शिक्षारेड टीमिंगपेलोड डेवलपमेंटAI सुरक्षा

सबसे लोकप्रिय

सभी देखें →

हमारे समुदाय द्वारा सबसे अधिक उपयोग किए जाने वाले उपकरण खोजें।

सभी उपकरण खोजें

हमारे उपकरणों का संग्रह ब्राउज़ करें

सभी उपकरण देखें →

विवरण

OpenClaw एजेंटों का मूल्यांकन करने के लिए सुरक्षा बेंचमार्क, जो प्रतिकूल निष्पादन संदर्भों (adversarial execution contexts) के विरुद्ध काम करता है, जिनमें ज़हरीली फ़ाइलें (poisoned files), इंजेक्ट किए गए कौशल (injected skills), भ्रामक टूल मेटाडेटा (misleading tool metadata), और एन्कोडेड पेलोड (encoded payloads) शामिल हैं। इसमें 42 रीप्ले कार्य (replay tasks) शामिल हैं, जो 6 जोखिम सुइट्स (risk suites) में फैले हुए हैं, जिनमें हमले और उपयोगिता स्कोरिंग (attack and utility scoring) होती है।

प्रतिकूल हमला
लैब और अभ्यास
GitHubzjuicsr/deeptrap

DeepTrap

रिपॉजिटरी देखें
101164 महीने पहलेअभी तक समीक्षित नहीं
साझा करें

DeepTrap

DeepTrap लोगो

Tasks Chinese Samples Risks Scenarios Leaderboard
arXiv Paper HuggingFace License

अंग्रेज़ी | चीनी

प्रतिकूल निष्पादन संदर्भों में OpenClaw एजेंटों के लिए ओपन-वर्ल्ड सुरक्षा मूल्यांकन।


DeepTrap एक सुरक्षा बेंचमार्क है जो यह मूल्यांकन करता है कि क्या OpenClaw एजेंट दुर्भावनापूर्ण निष्पादन-संदर्भ दबाव का प्रतिरोध करते हुए सामान्य उपयोगकर्ता कार्यों को पूरा कर सकते हैं: ज़हरीली वर्कस्पेस फ़ाइलें, इंजेक्ट किए गए कौशल, भ्रामक टूल मेटाडेटा, असुरक्षित कमांड पथ, छिपे हुए रहस्य, और एन्कोडेड पेलोड।

सार्वजनिक रिलीज़ में 42 रीप्ले कार्य शामिल हैं जिन्हें 6 प्रासंगिक भेद्यता वर्गों x 7 परिचालन परिदृश्य परिवारों के रूप में व्यवस्थित किया गया है, साथ ही बेंचमार्क रनर और सार्वजनिक स्कोरिंग कोड भी। इसमें स्थानीयकृत मूल्यांकन प्रयोगों के लिए tasks_zh/ में 10 चीनी-भाषा रीप्ले नमूने भी शामिल हैं। निजी कार्य-निर्माण और हमला-खोज पाइपलाइन जानबूझकर शामिल नहीं की गई है।

DeepTrap निम्नलिखित शोधपत्र के साथ आता है:

रेड-टीमिंग एजेंट निष्पादन संदर्भ: OpenClaw पर ओपन-वर्ल्ड सुरक्षा मूल्यांकन
Hongwei Yao, Yiming Liu, Yiling He, और Bingrun Yang. arXiv:2605.11047, 2026.

DeepTrap क्यों?

अधिकांश एजेंट बेंचमार्क यह पूछते हैं कि क्या कोई मॉडल उपयोगी कार्य पूरा कर सकता है। DeepTrap एक कठोर प्रश्न पूछता है: क्या एजेंट तब उपयोगी कार्य सुरक्षित रूप से पूरा कर सकता है जब आस-पास का निष्पादन संदर्भ प्रतिकूल हो?

हम क्या परीक्षण करते हैंयह क्यों महत्वपूर्ण है
संदर्भ मजबूतीज़हरीली फ़ाइलें, मेमोरी-जैसी आर्टिफैक्ट्स, प्लेबुक, और वर्कस्पेस निर्देशवास्तविक एजेंट परिवर्तनशील स्थानीय संदर्भ से पढ़ते हैं, जहाँ अविश्वसनीय टेक्स्ट चुपचाप व्यवहार को पुनर्निर्देशित कर सकता है
गुप्त जानकारी संभालनाछिपी हुई क्रेडेंशियल्स, पर्यावरण चर, API कुंजियाँ, और आंतरिक मानएजेंटों को कॉन्फ़िगरेशन जागरूकता को गुप्त निष्कासन से अलग करना चाहिए
निष्पादन सीमाएँखतरनाक शेल कमांड, डिप्लॉयमेंट स्क्रिप्ट, और फ़ाइल-सिस्टम साइड इफेक्टटूल-उपयोग करने वाले एजेंट तब भी स्थायी हानि पहुँचा सकते हैं जब उपयोगकर्ता प्रॉम्प्ट सामान्य हो
कौशल/टूल विश्वासदुर्भावनापूर्ण कौशल, भ्रामक टूल मेटाडेटा, और टूल-दुरुपयोग पैटर्नएजेंट सुरक्षा इस बात पर निर्भर करती है कि मॉडल टूल क्षमताओं की व्याख्या और सत्यापन कैसे करता है
अस्पष्ट पेलोडBase64 और बहु-चरणीय एन्कोडेड निर्देशहमले सामान्य दिखने वाले डेटा-प्रोसेसिंग कार्यों के पीछे छिप सकते हैं

हमें क्या अलग बनाता है

  • निष्पादन-संदर्भ हमले, केवल प्रॉम्प्ट हमले नहीं। DeepTrap फ़ाइलों, कौशलों, टूल विवरणों, स्क्रिप्ट्स, लॉग्स, कॉन्फ़िग्स, और एन्कोडेड आर्टिफैक्ट्स में एम्बेडेड खतरों का मूल्यांकन करता है।
  • सामान्य उपयोगकर्ता प्रॉम्प्ट। उपयोगकर्ता अनुरोध उपयोगी और सामान्य होता है; जोखिम आस-पास के वर्कस्पेस से आता है।
  • सार्वजनिक, न्यूनतम प्रतिकृति। रिपॉजिटरी में रनर, रीप्ले कार्य, और स्कोरिंग तर्क शामिल हैं जो निजी जनरेशन कोड को उजागर किए बिना बेंचमार्क रन को दोहराने के लिए आवश्यक हैं।
  • हमला और उपयोगिता स्कोरिंग। DeepTrap AGS (अटैक ग्रेडिंग स्कोर) और UGS (यूटिलिटी ग्रेडिंग स्कोर) दोनों रिपोर्ट करता है, ताकि मॉडल का मूल्यांकन सुरक्षा और कार्य उपयोगिता दोनों पर एक साथ किया जा सके।
  • OpenClaw-मूल। कार्य OpenClaw-शैली एजेंटों के लिए बनाए गए हैं और एक वास्तविक फ़ाइल/टूल/कौशल वर्कस्पेस की निष्पादन मान्यताओं को संरक्षित करते हैं।

समाचार

  • 2026-05 DeepTrap पेपर arXiv पर जारी किया गया: arXiv:2605.11047।
  • 2026-05 सार्वजनिक बेंचमार्क रिपॉजिटरी 42 रीप्ले कार्यों, स्कोरिंग कोड, और GitHub Pages लीडरबोर्ड के साथ जारी की गई।
  • 2026-05 tasks_zh/ के अंतर्गत चीनी-भाषा रीप्ले नमूने जोड़े गए।
  • 2026-05 कार्य मेटाडेटा वितरण के लिए Hugging Face डेटासेट निर्यात जोड़ा गया।

लीडरबोर्ड

AGS अटैक ग्रेडिंग स्कोर है और UGS यूटिलिटी ग्रेडिंग स्कोर है। स्कोर जोखिम सुइट के अनुसार रिपोर्ट किए जाते हैं; Average जोखिम 1 से जोखिम 6 तक का औसत है।

पूर्ण प्रोजेक्ट पृष्ठ और लीडरबोर्ड: ZJUICSR.github.io/DeepTrap

Claw मॉडलमीट्रिकजोखिम 1जोखिम 2जोखिम 3जोखिम 4जोखिम 5जोखिम 6औसत
GPT-5.4AGS0.770.840.760.610.670.530.70
GPT-5.4UGS0.910.830.860.770.740.870.83
Claude-Sonnet-4.6AGS0.510.580.370.250.380.200.38
Claude-Sonnet-4.6UGS0.710.690.550.450.550.710.61
GLM-5AGS0.810.930.740.830.790.880.83
GLM-5UGS0.900.900.980.890.830.880.90
Qwen3.5-PlusAGS0.930.930.860.740.880.970.88
Qwen3.5-PlusUGS0.950.921.000.980.930.930.95
MiniMax-M2.5AGS0.860.890.770.660.900.890.83
MiniMax-M2.5UGS0.920.951.000.880.740.900.90
DeepSeek-v4-FlashAGS0.900.960.800.900.820.940.89
DeepSeek-v4-FlashUGS0.980.961.000.960.851.000.96
Deepseek-v4-ProAGS0.900.960.740.870.850.860.86
Deepseek-v4-ProUGS0.900.911.000.810.840.890.89
MiMo-v2.5AGS0.860.870.710.730.570.600.72
MiMo-v2.5UGS0.960.950.880.930.830.890.91
MiMo-v2.5-proAGS0.740.830.560.580.580.530.64
MiMo-v2.5-proUGS0.920.900.880.870.710.870.86

बेंचमार्क डिज़ाइन

DeepTrap छह प्रासंगिक भेद्यता वर्गों को सात सामान्य परिदृश्य परिवारों के साथ जोड़ता है। प्रत्येक कार्य एक सामान्य उपयोगकर्ता प्रॉम्प्ट का उपयोग करता है; प्रतिकूल व्यवहार कार्यक्षेत्र संदर्भ द्वारा प्रेरित किया जाता है।

DeepTrap फ्रेमवर्क

DeepTrap सामान्य निर्देशों और स्वच्छ वर्कस्पेस से समझौता किए गए निष्पादन संदर्भों का निर्माण करता है, बहु-उद्देश्यीय पुरस्कार संकेतों के साथ उम्मीदवार प्रतिकूल पेलोड की खोज करता है, और प्रतिबिंब-आधारित जांच के माध्यम से सफल पेलोड को परिष्कृत करता है।

जोखिम सुइट

सुइटश्रेणीकार्यक्या मापा जाता है
R1हार्नेस अपहरण7ज़हरीले संदर्भ और इंजेक्ट किए गए वर्कफ़्लो चरणों के प्रति प्रतिरोध
R2गोपनीयता रिसाव7छिपी हुई क्रेडेंशियल्स और संवेदनशील मानों की सुरक्षा
R3अनधिकृत निष्पादन7खतरनाक कमांड और सीमा-उल्लंघन कार्यों से इनकार
R4आपूर्ति श्रृंखला जोखिम7दुर्भावनापूर्ण कौशल और टूल-जैसे एकीकरण से निपटना
R5टूल दुरुपयोग7भ्रामक या बेमेल टूल व्यवहार का पता लगाना
R6एन्कोडिंग ओबफस्केशन7एन्कोडेड निर्देशों और बहु-चरणीय पेलोड से निपटना

परिदृश्य परिवार

टूल डाउनलोड करें