
Iran War Media Monitor raccoglie articoli di notizie che coprono la guerra USA-Israele contro l'Iran e applica l'analisi del sentiment per scoprire chi sostiene e chi si oppone alla guerra.
Leggi l'approfondimento completo

Questo progetto monitora la copertura mediatica della guerra tra Iran, Israele e Stati Uniti.
Puoi usare questo repository per:
Puoi leggere l'approfondimento tecnico completo qui. In sintesi, Iran Media Monitor esegue due flussi di lavoro.
Il primo flusso esegue lo scraper che raccoglie metadati e articoli di notizie dai feed RSS. Il feed è impostato su Google RSS ma puoi cambiare il feed in rss.py.
Il secondo flusso esegue l'analisi del sentiment sugli articoli raccolti e aggiorna gli articoli.

Il progetto utilizza MongoDB per memorizzare gli articoli. Usa Docker per creare un'istanza di MongoDB.
I seguenti punti dati vengono raccolti:
{
"collectionDate": str(datetime.now(timezone.utc).strftime("%Y-%m-%d %H:%M:%S")),
"processed": False,
"title": article.title,
"author": article.authors,
"publishedAt": str(article.publish_date),
"publisher": publisher,
"language": article.meta_lang,
"sourceUrl":article.source_url,
"summary":article.summary,
"keywords": article.keywords,
"description": article.meta_description,
"bodyText":article.text,
}
Esegui rss.py per ottenere un elenco degli ultimi articoli dal feed RSS.
Esegui scraper.py per ottenere URL dal feed RSS di Google e fare scraping degli articoli.
Usa sentiment.py per eseguire l'analisi del sentiment sugli articoli non elaborati. Il campo process viene impostato su True quando un documento ha ricevuto un punteggio di sentiment.