#1LLM सुरक्षा, प्रॉम्प्ट इंजेक्शन, मॉडल एक्सट्रैक्शन, एडवर्सरियल AI और AI रेड टीमिंग उपकरण।
Kitploit अनुशंसित

बड़े तर्क मॉडल में सुरक्षा तर्क को हाईजैक करने के लिए स्वचालित ढांचा, सिम्युलेटेड तर्क निशान और पुनरावृत्त प्रॉम्प्ट शोधन के माध्यम से प्रभावी…
OpenClaw एजेंटों का मूल्यांकन करने के लिए सुरक्षा बेंचमार्क, जो प्रतिकूल निष्पादन संदर्भों (adversarial execution contexts) के विरुद्ध काम करता है,…

होस्ट-अज्ञेय प्री-राइट सुरक्षा हुक कोडिंग एजेंट के लिए: सेमग्रेप के माध्यम से उपयोगकर्ता-इनपुट पैटर्न का पता लगाता है और नियतात्मक, एलएलएम-रहित…

Recon-Scan: AI-संचालित सुरक्षा विश्लेषण के साथ ओपन-सोर्स निष्क्रिय टोही। शून्य-स्पर्श, डेवलपर-प्रथम, और गोपनीयता-केंद्रित।

[CVPR 2025-ADVML] `Attacking Attention of Foundation Models Effectively Disrupts Downstream Tasks` के लिए आधिकारिक रिपॉज़िटरी

AI एजेंटों के लिए क्रिप्टोग्राफिक रूप से हस्ताक्षरित प्रतिनिधिमंडल रसीदें। ठीक-ठीक परिभाषित करें कि एक AI क्या कर सकता है और क्या नहीं — हस्ताक्षरित,…

वाइब-कोडिंग सुरक्षा संतरी। Apache-2.0 लाइसेंस के तहत AI-सहायता प्राप्त परियोजनाओं के लिए एजेंटिक सुरक्षा टूलकिट: 5 निर्धारणात्मक स्काउट्स + LLM ब्रेन…

Entropica repo का सार्वजनिक संस्करण

CVE-2024-3660 के लिए एक PoC। Keras में मनमाना कोड निष्पादन।

AGLS

# हेस्टियाCP सर्वर के लिए रीड-ओनली वर्डप्रेस सुरक्षा स्कैनर सभी होस्टेड साइटों पर wp2shell समझौता संकेतक (CVE-2026-63030 / CVE-2026-60137) का पता…

GitHub Action जो ML मॉडल फाइलों में दुर्भावनापूर्ण कोड और सुरक्षा कमजोरियों के लिए स्कैन करता है

रेड टीम AI बेंचमार्क: अधिकृत आपत्तिजनक-सुरक्षा कार्यों के लिए LLMs का मूल्यांकन करना। Red Team AI Benchmark एक CLI मॉडल-मूल्यांकन बेंचमार्क है। यह…

LLM-जनित टेक्स्ट में पता लगाने योग्य सिग्नल एम्बेड करने के लिए इष्टतम युग्मन-आधारित विरूपण-मुक्त टेक्स्ट वॉटरमार्किंग का कार्यान्वयन, गुणवत्ता बनाए…

Blackbox.ai एक्सटेंशन में जोखिमों की पहचान करने वाला सुरक्षा विश्लेषण उपकरण, जिसमें क्रेडेंशियल चोरी, अनपैच्ड CVE, और छिपे हुए पिक्सेल ट्रैकिंग से…

mlx-metal importlib के माध्यम से Docker कंटेनर एस्केप POC

सुरक्षा सलाह: एजेंट संदेशों के माध्यम से संग्रहीत क्रॉस-साइट स्क्रिप्टिंग जिससे सत्र टोकन की चोरी होती है (openclaw-dashboard)

AI मॉडलों के सुरक्षा-संबंधी मेटाडेटा के दस्तावेज़ीकरण के लिए खुला मानक, जिसमें प्रशिक्षण डेटा की उत्पत्ति, PII जोखिम, ज्ञात कमज़ोरियाँ और आपूर्ति…