
مراقب وسائل الإعلام لحرب إيران يجمع المقالات الإخبارية التي تغطي الحرب الأمريكية الإسرائيلية على إيران ويطبق تحليل المشاعر لكشف من يدعم ويعارض الحرب.

يراقب هذا المشروع التغطية الإخبارية للحرب بين إيران وإسرائيل والولايات المتحدة.
يمكنك استخدام هذا المستودع من أجل:
يمكنك قراءة الغوص التقني الكامل هنا. باختصار، ينفذ مراقب وسائل الإعلام الإيرانية سيرتي عمل.
سير العمل الأولى تشغّل الماسح الذي يجمع البيانات الوصفية والمقالات الإخبارية من خلاصات RSS. الخلاصة مضبوطة على Google RSS لكن يمكنك تغيير الخلاصة في rss.py.
سير العمل الثانية تجري تحليل المشاعر على المقالات المجمعة وتقوم بتحديث أو إدراج المقالات.

يستخدم المشروع MongoDB لتخزين المقالات. استخدم Docker لإنشاء نسخة من MongoDB.
يتم جمع نقاط البيانات التالية:
{
"collectionDate": str(datetime.now(timezone.utc).strftime("%Y-%m-%d %H:%M:%S")),
"processed": False,
"title": article.title,
"author": article.authors,
"publishedAt": str(article.publish_date),
"publisher": publisher,
"language": article.meta_lang,
"sourceUrl":article.source_url,
"summary":article.summary,
"keywords": article.keywords,
"description": article.meta_description,
"bodyText":article.text,
}
شغّل rss.py للحصول على قائمة بأحدث المقالات من خلاصة RSS.
شغّل scraper.py للحصول على عناوين URL من Google RSS وجمع المقالات.
استخدم sentiment.py لإجراء تحليل المشاعر على المقالات غير المعالجة. يتم تعيين حقل process على True عندما يتلقى المستند درجة مشاعر.