Domanda:
Come funziona l'elaborazione Fulltext?
Risposta:
Dopo aver archiviato un documento in un archivio con il supporto Fulltext abilitato, l’indicizzazione Fulltext per questo documento ha inizio immediatamente.
Le attività di OCR e di indicizzazione Fulltext vengono generate nella tabella dwsystem.dbo.DWTASKS con TASK_TYPE rispettivamente pari a 0 e 2, e vengono quindi elaborate dal Background Process Service. Il Fulltext Server stesso è responsabile solo della ricerca Fulltext e non esegue l’indicizzazione Fulltext. Deve tuttavia essere in esecuzione per ricevere i dati Fulltext durante l’indicizzazione Fulltext.
Panoramica dei TASK_TYPE Fulltext nella tabella dwsystem.dbo.DWTASKS:
TASK_TYPE 0: OCR
TASK_TYPE 1: Creazione di «textshot» con l’Intelligent Indexing
TASK_TYPE 2: L’indice full-text viene aggiornato nel database ed esportato nel core SOLR, in modo che il Fulltext Server possa accedervi
TASK_TYPE 3: Pulizia SOLR dopo l’eliminazione di documenti
TASK_TYPE 4: Attività di aggiornamento da una versione precedente di DocuWare (non più in uso a partire da DocuWare 7; Eliminare manualmente questa attività se la si individua)
TASK_TYPE 5: Attività di ripristino del Fulltext (controllare la colonna delle impostazioni per lo stato attuale; i documenti vengono elaborati dal dwdocid più alto a quello più basso)
I dati Fulltext vengono scritti nelle tabelle _PAG e _PGT di un archivio. Questi dati possono essere eliminati in tutta sicurezza, se necessario, a condizione che vengano rimossi sia da _PGT che da _PAG. Sarà necessario eseguire un ripristino del testo completo se in seguito si desidera rigenerare i dati dell’indice di testo completo.
Nota: a differenza di DocuWare 6, la tabella _SEC non contiene dati di ricerca full-text! Non rimuovere mai le righe relative a documenti esistenti dalla tabella _SEC!
Una volta che un documentoè stato completamente indicizzato sul database, l’indicedi ricerca full-text viene trasferito al core SOLR. Questi core si trovano nella posizione di archiviazione dell’indice Fulltext definita nella connessione Fulltext. Questa può essere configurata nell’Admin Tool (nelle versioni 7.0 -7.13) o nel DocuWare Server Manager (nelle versioni 7.14 e successive) -> Connessioni dati.
I core prendono il nome dal GUID di un archivio. Questo GUID può essere verificato nella sezione di configurazione dell’archivio della configurazione web in Generale -> Altre opzioni.
Panoramica dei valori STATUS nella tabella _PGT:
0 = Nuovo
1 = Textshot creato con successo
2 = Errore durante la creazione del textshot
3 = Textshot trasferito con successo a SOLR
4 = Errore durante il trasferimento a SOLR
Solo dopo che i dati Fulltext relativi a un documento sono stati completamente trasferiti a SOLR sarà possibile trovare il documento tramite la ricerca Fulltext.
La KBA è applicabile SOLO alle organizzazioni on-premise.
Nota: questo articolo è una traduzione dall’inglese. Le informazioni contenute in questo articolo si basano sulle versioni originali del prodotto in lingua inglese. Potrebbero esserci piccoli errori, ad esempio di natura grammaticale, nella versione tradotta dei nostri articoli. Sebbene non possiamo garantire la completa accuratezza della traduzione, nella maggior parte dei casi la troverete sufficientemente informativa. In caso di dubbi, vi invitiamo a consultare la versione inglese di questo articolo.
