Skip to content
KitploitKITPLOIT
उपकरणब्लॉग
जमा करें
उपकरणब्लॉग
जमा करें

हैकिंग, पेनटेस्ट और साइबर सुरक्षा उपकरण आपके सुरक्षा शस्त्रागार के लिए!

Kitploit हैकिंग, साइबर सुरक्षा और पेंटेस्टिंग टूल्स की एक निर्देशिका है। कमजोरियों को खोजने, सिस्टम का विश्लेषण करने, परीक्षण को स्वचालित करने और अपनी सुरक्षा को मजबूत करने के लिए नवीनतम प्रोजेक्ट अपडेट खोजें।

··फ़ीड·संपर्क·गोपनीयता·© 2026 Kitploit

टूल निर्देशिका

श्रेणियाँ

सभी श्रेणियाँ देखें
Loading categories
loglizer — लॉग-आधारित विसंगति पहचान के लिए एक मशीन लर्निंग टूलकिट [ISSRE'16] | Kitploit
उपकरण/GitHubGitHub/logpai/loglizer
मशीन लर्निंगविसंगति का पता लगानालॉग विश्लेषण
GitHublogpai/loglizer

loglizer

लॉग-आधारित विसंगति पहचान के लिए एक मशीन लर्निंग टूलकिट [ISSRE'16]

रिपॉजिटरी देखें
1.4k4372 साल पहलेKitploit द्वारा समीक्षित

सबसे लोकप्रिय

सभी देखें →

हमारे समुदाय द्वारा सबसे अधिक उपयोग किए जाने वाले उपकरण खोजें।

सभी उपकरण खोजें

हमारे उपकरणों का संग्रह ब्राउज़ करें

सभी उपकरण देखें →
साझा करें

loglizer

Loglizer स्वचालित विसंगति पहचान के लिए एक मशीन लर्निंग-आधारित लॉग विश्लेषण टूलकिट है.

Loglizer एक AI-आधारित लॉग बिग डेटा विश्लेषण टूल है, जिसका उपयोग स्वचालित विसंगति पहचान, बुद्धिमान दोष निदान आदि परिदृश्यों में किया जा सकता है।

कई सॉफ़्टवेयर सिस्टमों के विकास और अनुरक्षण प्रक्रिया में लॉग्स अनिवार्य होते हैं। वे सिस्टम संचालन के दौरान विस्तृत रनटाइम जानकारी दर्ज करते हैं, जिससे डेवलपर्स और सहायता इंजीनियर अपने सिस्टम की निगरानी कर सकते हैं और असामान्य व्यवहारों तथा त्रुटियों को ट्रैक कर सकते हैं। Loglizer एक टूलकिट प्रदान करता है जो स्वचालित विसंगति पहचान के लिए कई मशीन लर्निंग-आधारित लॉग विश्लेषण तकनीकों को लागू करता है।

🔭 यदि आप अपने शोध/प्रकाशन में loglizer का उपयोग करते हैं, तो कृपया निम्नलिखित पेपर को उद्धृत करें।

  • Shilin He, Jieming Zhu, Pinjia He, Michael R. Lyu. Experience Report: System Log Analysis for Anomaly Detection, IEEE International Symposium on Software Reliability Engineering (ISSRE), 2016. [Bibtex][चीनी संस्करण] (ISSRE सर्वाधिक प्रभावशाली पेपर)

ढाँचा

विसंगति पहचान का ढाँचा

विसंगति पहचान के लिए लॉग विश्लेषण ढाँचे में आमतौर पर निम्नलिखित घटक शामिल होते हैं:

  1. लॉग संग्रहण: लॉग्स रनटाइम पर उत्पन्न होते हैं और Flume तथा Kafka जैसी डेटा स्ट्रीमिंग पाइपलाइन के माध्यम से एक केंद्रीकृत स्थान पर एकत्र किए जाते हैं।
  2. लॉग पार्सिंग: लॉग पार्सिंग का लक्ष्य असंरचित लॉग संदेशों को संरचित घटनाओं के मानचित्र में परिवर्तित करना है, जिसके आधार पर परिष्कृत मशीन लर्निंग मॉडल लागू किए जा सकते हैं। लॉग पार्सिंग के विवरण हमारे logparser प्रोजेक्ट में पाए जा सकते हैं।
  3. फ़ीचर निष्कर्षण: संरचित लॉग्स को इंटरवल विंडो, स्लाइडिंग विंडो या सेशन विंडो के माध्यम से छोटे लॉग अनुक्रमों में विभाजित किया जा सकता है। फिर, प्रत्येक लॉग अनुक्रम को वेक्टराइज़ करने के लिए फ़ीचर निष्कर्षण किया जाता है, उदाहरण के लिए, इवेंट काउंटिंग वेक्टर का उपयोग करके।
  4. विसंगति पहचान: विसंगति पहचान मॉडल को यह जाँचने के लिए प्रशिक्षित किया जाता है कि दिया गया फ़ीचर वेक्टर विसंगति है या नहीं।

मॉडल

वर्तमान में उपलब्ध विसंगति पहचान मॉडल:

लॉग डेटा

हमने शोध उद्देश्यों के लिए loghub में लेबल किए गए लॉग डेटासेट का एक सेट एकत्र किया है। यदि आप डेटासेट में रुचि रखते हैं, तो कृपया एक्सेस अनुरोध सबमिट करने के लिए लिंक का अनुसरण करें।

इंस्टॉलेशन

root@kitploit:~
git clone https://github.com/logpai/loglizer.git
cd loglizer
pip install -r requirements.txt

API उपयोग

root@kitploit:~
# Load HDFS dataset. If you would like to try your own log, you need to rewrite the load function.
(x_train, y_train), (x_test, y_test) = dataloader.load_HDFS(...)

# Feature extraction and transformation
feature_extractor = preprocessing.FeatureExtractor()
feature_extractor.fit_transform(...) 

# Model training
model = PCA()
model.fit(...)

# Feature transform after fitting
x_test = feature_extractor.transform(...)
# Model evaluation with labeled data
model.evaluate(...)

# Anomaly prediction
x_test = feature_extractor.transform(...)
model.predict(...) # predict anomalies on given data

अधिक विवरण के लिए, आरंभ करने हेतु दस्तावेज़ों में डेमो देखें। कृपया ध्यान दें कि सभी ML मॉडल जादू नहीं हैं; आपको यह समझना होगा कि अपने डेटा पर उन्हें कारगर बनाने के लिए पैरामीटर कैसे ट्यून करें।

बेंचमार्किंग परिणाम

यदि आप निम्नलिखित परिणामों को दोहराना चाहते हैं, तो कृपया पूर्ण HDFS डेटासेट पर benchmarks/HDFS_bechmark.py चलाएँ (HDFS100k केवल डेमो के लिए है)।

योगदानकर्ता

  • Shilin He, The Chinese University of Hong Kong
  • Jieming Zhu, The Chinese University of Hong Kong, वर्तमान में Huawei Noah's Ark Lab में
  • Pinjia He, The Chinese University of Hong Kong, वर्तमान में ETH Zurich में

प्रतिक्रिया

किसी भी प्रश्न या प्रतिक्रिया के लिए, कृपया issue पेज पर पोस्ट करें।

इतिहास

  • 14 मई, 2016: प्रारंभिक कमिट
  • 21 सितंबर, 2017: कोड और readme अपडेट
  • 21 मार्च, 2018: अधिकांश कोड पुनर्लेखित किया गया और विस्तृत टिप्पणियाँ जोड़ी गईं
  • 18 फ़रवरी, 2019: हैंड्स-ऑन डेमो के साथ रिपॉज़िटरी को पुनर्गठित किया गया
टूल डाउनलोड करें
मॉडलपेपर संदर्भ
पर्यवेक्षित मॉडल
LR[EuroSys'10] Fingerprinting the Datacenter: Automated Classification of Performance Crises, by Peter Bodík, Moises Goldszmidt, Armando Fox, Hans Andersen. [Microsoft]
Decision Tree[ICAC'04] Failure Diagnosis Using Decision Trees, by Mike Chen, Alice X. Zheng, Jim Lloyd, Michael I. Jordan, Eric Brewer. [eBay]
SVM[ICDM'07] Failure Prediction in IBM BlueGene/L Event Logs, by Yinglung Liang, Yanyong Zhang, Hui Xiong, Ramendra Sahoo. [IBM]
अपर्यवेक्षित मॉडल
LOF[SIGMOD'00] LOF: Identifying Density-Based Local Outliers, by Markus M. Breunig, Hans-Peter Kriegel, Raymond T. Ng, Jörg Sander.
One-Class SVM[Neural Computation'01] Estimating the Support of a High-Dimensional Distribution, by John Platt, Bernhard Schölkopf, John Shawe-Taylor, Alex J. Smola, Robert C. Williamson.
Isolation Forest[ICDM'08] Isolation Forest, by Fei Tony Liu, Kai Ming Ting, Zhi-Hua Zhou.
PCA[SOSP'09] Large-Scale System Problems Detection by Mining Console Logs, by Wei Xu, Ling Huang, Armando Fox, David Patterson, Michael I. Jordan. [Intel]
Invariants Mining[ATC'10] Mining Invariants from Console Logs for System Problem Detection, by Jian-Guang Lou, Qiang Fu, Shengqi Yang, Ye Xu, Jiang Li. [Microsoft]
Clustering[ICSE'16] Log Clustering based Problem Identification for Online Service Systems, by Qingwei Lin, Hongyu Zhang, Jian-Guang Lou, Yu Zhang, Xuewei Chen. [Microsoft]
DeepLog (आगामी)[CCS'17] DeepLog: Anomaly Detection and Diagnosis from System Logs through Deep Learning, by Min Du, Feifei Li, Guineng Zheng, Vivek Srikumar.
AutoEncoder (आगामी)[Arxiv'18] Anomaly Detection using Autoencoders in High Performance Computing Systems, by Andrea Borghesi, Andrea Bartolini, Michele Lombardi, Michela Milano, Luca Benini.
HDFS
मॉडलप्रेसिज़नरिकॉलF1
LR0.9550.9110.933
Decision Tree0.9980.9980.998
SVM0.9590.9700.965
LOF0.9670.5610.710
One-Class SVM0.9950.2220.363
Isolation Forest0.8300.7760.802
PCA0.9750.6350.769
Invariants Mining0.8880.9450.915
Clustering1.0000.7200.837