Skip to content
KitploitKITPLOIT
StrumentiExploitsBlog
Log in
Invia
StrumentiExploitsBlog
Invia

Strumenti di Hacking, PenTest e Cybersecurity per il tuo Arsenale di Sicurezza!

Kitploit è una directory di strumenti di hacking, cybersecurity e pentesting. Scopri gli ultimi aggiornamenti dei progetti per trovare vulnerabilità, analizzare sistemi, automatizzare i test e rafforzare la tua sicurezza.

FeedContattoPrivacy© 2026 Kitploit

Directory degli strumenti

Categorie

Vedi tutte le categorie
Loading categories
Strumenti/GitHubGitHub/shoucheng3/apache__uima-uimaj_cve-2022-32287_3-3-0
Utilità GenericheAnalisi del CodiceScripting e AutomazioneUtilità e FrameworkMachine LearningApprendimento e Formazione
GitHubshoucheng3/apache__uima-uimaj_cve-2022-32287_3-3-0

apache__uima-uimaj_CVE-2022-32287_3-3-0

SDK Java per la costruzione di pipeline di analisi che elaborano e arricchiscono dati testuali non strutturati con annotazioni, sistemi di tipi e motori di analisi modulari.

Vedi Repository
211 anno faNon ancora revisionato

Più Popolari

Vedi tutti →

Scopri gli strumenti più utilizzati dalla nostra community.

Esplora tutti gli strumenti

Sfoglia la nostra collezione di strumenti

Vedi tutti gli strumenti →
Condividi

Benvenuti in Apache UIMA Java SDK

[Apache UIMA][UIMA] ti aiuta a gestire dati non strutturati (come i testi) arricchiti con informazioni utili. Ad esempio, se vuoi identificare una menzione di un'entità in un testo o possibilmente collegare tale entità a un dataset di riferimento, Apache UIMA fornisce:

  • una struttura dati conveniente —la Common Analysis Structure (CAS)— per rappresentare tali dati
  • un concetto di sistema di tipi come schema per i dati arricchiti memorizzati nella CAS
  • un modello a componenti costituito da lettori, motori di analisi (processori) e consumatori (scrittori) per elaborare tali dati
  • un modello per aggregare più motori di analisi in pipeline e per eseguirli (opzionalmente parallelizzati)
  • varie opzioni per (de)serializzare la CAS da/verso diversi formati
  • e molte altre funzionalità aggiuntive!

Nota: Apache UIMA Java SDK fornisce solo un framework per costruire sistemi di analisi, ma non fornisce alcun sistema di analisi stesso. Tuttavia, esistono vari terze parti che si basano su Apache UIMA e che forniscono collezioni di componenti di analisi o soluzioni pronte.

Requisiti di sistema

Apache UIMA v3.6.0 e successive richiede Java versione 17 o successiva.

L'esecuzione del plugin Eclipse per UIMA richiede di avviare Eclipse 4.25 (2022-09) o successivo con Java 17 o successivo.

L'esecuzione dello strumento di migrazione su file class richiede l'esecuzione con un Java JDK, non un Java JRE.

Le piattaforme supportate sono: Windows, Linux e macOS. Altre implementazioni della piattaforma Java dovrebbero funzionare ma non sono state testate in modo significativo.

Molti degli script nella directory /bin invocano Java. Utilizzano il valore della variabile d'ambiente JAVA_HOME per individuare il Java da usare; se non è impostata, invocano java aspettandosi di trovare un Java appropriato nella variabile PATH.

Utilizzo di Apache UIMA Java SDK

Puoi aggiungere Apache UIMA Java SDK al tuo progetto facilmente nella maggior parte degli strumenti di build importandolo da [Maven Central][MAVEN-CENTRAL]. Ad esempio, se usi Maven, puoi aggiungere la seguente dipendenza al tuo progetto:

<dependency>
  <groupId>org.apache.uima</groupId>
  <artifactId>uimaj-core</artifactId>
  <version>3.6.0</version>
</dependency>

Successivamente, forniamo alcuni brevi esempi su come utilizzare Apache UIMA Java SDK e la libreria Apache uimaFIT. Apache uimaFIT è una dipendenza separata che puoi aggiungere:

<dependency>
  <groupId>org.apache.uima</groupId>
  <artifactId>uimafit-core</artifactId>
  <version>3.6.0</version>
</dependency>
Creazione di un sistema di tipi

Il sistema di tipi definisce il tipo di informazione che vogliamo allegare all'informazione non strutturata (qui un documento di testo). Nel nostro esempio, vogliamo identificare menzioni di entità, quindi definiamo un tipo my.Entity con una caratteristica category che può essere usata per memorizzare la categoria a cui appartiene l'entità.

Per illustrare le informazioni che UIMA mantiene internamente sullo schema di annotazione, scriviamo lo schema generato come XML a schermo.

String TYPE_NAME_ENTITY = "my.Entity";
String TYPE_NAME_TOKEN = "my.Token";
String FEAT_NAME_CATEGORY = "category";

var tsd = UIMAFramework.getResourceSpecifierFactory().createTypeSystemDescription();
tsd.addType(TYPE_NAME_TOKEN, "", CAS.TYPE_NAME_ANNOTATION);
var entityTypeDesc = tsd.addType(TYPE_NAME_ENTITY, "", CAS.TYPE_NAME_ANNOTATION);
entityTypeDesc.addFeature(FEAT_NAME_CATEGORY, "", CAS.TYPE_NAME_STRING);

tsd.toXML(System.out);
Creazione di un oggetto Common Analysis Structure

Ora creiamo un oggetto Common Analysis Structure (CAS) in cui memorizziamo il testo che vogliamo analizzare.

Ancora una volta, per illustrare le informazioni che UIMA memorizza internamente nell'oggetto CAS, scriviamo una rappresentazione XML dell'oggetto a schermo.

var cas = CasFactory.createCas(tsd);
cas.setDocumentText("Welcome to Apache UIMA.");
cas.setDocumentLanguage("en");

CasIOUtils.save(cas, System.out, SerialFormat.XMI_PRETTY);
Aggiunta e recupero di annotazioni

Ora, creiamo un'annotazione del tipo my.Entity per identificare la menzione di Apache UIMA nel testo di esempio.

Infine, iteriamo su tutte le annotazioni nella CAS e le stampiamo a schermo. Questo include l'DocumentAnnotation predefinita che viene sempre creata da UIMA, così come l'annotazione my.Entity che abbiamo creato noi stessi.

var entityType = cas.getTypeSystem().getType(TYPE_NAME_ENTITY);
var entity = cas.createAnnotation(entityType, 11, 22);
cas.addFsToIndexes(entity);

for (var anno : cas.<Annotation>select(entityType)) {
   System.out.printf("%s: [%s]%n", anno.getType().getName(), anno.getCoveredText());
}
Lavorare con i componenti di analisi

Per organizzare diversi tipi di analisi in passaggi, di solito li raggruppiamo in singoli motori di analisi. Illustriamo ora come tali componenti possono essere costruiti e come possono essere eseguiti come pipeline di analisi.

class TokenAnnotator extends CasAnnotator_ImplBase {
  public void process(CAS cas) throws AnalysisEngineProcessException {
    var tokenType = cas.getTypeSystem().getType(TYPE_NAME_TOKEN);
    var bi = BreakIterator.getWordInstance();
    bi.setText(cas.getDocumentText());
    int begin = bi.first();
    int end;
    for (end = bi.next(); end != BreakIterator.DONE; end = bi.next()) {
      var token = cas.createAnnotation(tokenType, begin, end);
      cas.addFsToIndexes(token);
      begin = end;
    }
  }
}

class EntityAnnotator extends CasAnnotator_ImplBase {
  public void process(CAS cas) throws AnalysisEngineProcessException {
    var tokenType = cas.getTypeSystem().getType(TYPE_NAME_TOKEN);
    var entityType = cas.getTypeSystem().getType(TYPE_NAME_ENTITY);
    for (var token : cas.<Annotation>select(tokenType)) {
      if (Character.isUpperCase(token.getCoveredText().charAt(0))) {
        var entity = cas.createAnnotation(entityType, token.getBegin(), token.getEnd());
        cas.addFsToIndexes(entity);
      }
    }
  }
}

cas = CasFactory.createCas(tsd);
cas.setDocumentText("John likes Apache UIMA.");
cas.setDocumentLanguage("en");

var pipeline = AnalysisEngineFactory.createEngineDescription(
  AnalysisEngineFactory.createEngineDescription(TokenAnnotator.class),
  AnalysisEngineFactory.createEngineDescription(EntityAnnotator.class));

SimplePipeline.runPipeline(cas, pipeline);

for (var anno : cas.<Annotation>select(entityType)) {
   System.out.printf("%s: [%s]%n", anno.getType().getName(), anno.getCoveredText());
}

Utilizzo di uimaFIT

Scarica lo strumento