
Iran War Media Monitor collecte des articles de presse couvrant la guerre américano-israélienne contre l'Iran et applique une analyse des sentiments pour révéler qui soutient et qui s'oppose à cette guerre.

Ce projet surveille la couverture médiatique de la guerre entre l'Iran, Israël et les États-Unis.
Vous pouvez utiliser ce dépôt pour :
Vous pouvez lire l'analyse technique complète ici. En résumé, Iran Media Monitor exécute deux workflows.
Le premier workflow lance le scraper qui collecte les métadonnées et les articles de presse à partir des flux RSS. Le flux est réglé sur Google RSS, mais vous pouvez changer le flux dans rss.py.
Le second workflow effectue une analyse de sentiment sur les articles collectés et met à jour ou insère les articles.

Le projet utilise MongoDB pour stocker les articles. Utilisez Docker pour créer une instance de MongoDB.
Les points de données suivants sont collectés :
{
"collectionDate": str(datetime.now(timezone.utc).strftime("%Y-%m-%d %H:%M:%S")),
"processed": False,
"title": article.title,
"author": article.authors,
"publishedAt": str(article.publish_date),
"publisher": publisher,
"language": article.meta_lang,
"sourceUrl":article.source_url,
"summary":article.summary,
"keywords": article.keywords,
"description": article.meta_description,
"bodyText":article.text,
}
Exécutez rss.py pour obtenir une liste des derniers articles du flux RSS.
Exécutez scraper.py pour obtenir les URL depuis Google RSS et scraper les articles.
Utilisez sentiment.py pour effectuer une analyse de sentiment sur les articles non traités. Le champ processed passe à True lorsqu'un document a reçu un score de sentiment.