Vistas:






Pregunta:
¿Cómo funciona el procesamiento de texto completo?

Respuesta:
Tras archivar un documento en un archivador con la función de texto completo habilitada, se inicia inmediatamente la indexación de texto completo de dicho documento.

Las tareas de OCR y de indexación de texto completo se generan en la tabla dwsystem.dbo.DWTASKS con los tipos de tarea (TASK_TYPE) 0 y 2, respectivamente, y a continuación son procesadas por el Background Process Service. El Fulltext Server, por sí solo, solo se encarga de la Búsqueda de texto completo y no realiza la indexación de texto completo. Sin embargo, debe estar en ejecución para recibir datos de texto completo durante la indexación de texto completo.

Resumen de los TASK_TYPEs de texto completo en la tabla dwsystem.dbo.DWTASKS:
TASK_TYPE 0: OCR
TASK_TYPE 1: Creación de «text shot» de Intelligent Indexing
TASK_TYPE 2: El índice de texto completo se actualiza en la base de datos y se exporta al núcleo de SOLR, de modo que el Fulltext Server tiene acceso a él
TASK_TYPE 3: Limpieza de SOLR tras la eliminación de documentos
TASK_TYPE 4: Tarea de actualización desde una versión anterior de DocuWare (ya no se utiliza desde DocuWare 7; elimina esta tarea manualmente si la encuentras)
TASK_TYPE 5: Tarea de restablecimiento de texto completo (comprueba la columna de ajustes para ver el estado actual; los documentos se procesan de mayor a menor dwdocid)


Los datos de texto completo se escriben en las tablas _PAG y _PGT de un archivador. Estos datos pueden eliminarse de forma segura, si es necesario, siempre que se eliminen tanto de _PGT como de _PAG. Deberá realizar un restablecimiento de texto completo si desea volver a generar los datos del índice de texto completo posteriormente.

Nota: A diferencia de DocuWare 6, ¡la tabla _SEC no contiene ningún dato de texto completo! ¡Nunca elimine filas de documentos existentes de la tabla _SEC!

Una vez que un documento está completamente indexado en la base de datos, el índicede texto completo se transfiere al núcleo SOLR. Estos núcleos se encuentran en la ubicación de almacenamiento del índice de texto completo definida en su conexión de texto completo. Esto se puede configurar en la Herramienta de administración (en las versiones 7.0-7.13) o en el DocuWare Server Manager (en las versiones 7.14 y posteriores) -> Conexiones de datos.

Los núcleos reciben el nombre del GUID de un archivador. Este GUID se puede consultar en la sección de configuración del archivador de la configuración web, en General -> Más opciones.

Resumen de los valores de STATUS en la tabla _PGT:

Solo cuando los datos de texto completo de un documento se hayan transferido por completo a SOLR podrás encontrar el documento mediante la Búsqueda de texto completo.


La KBA es aplicable ÚNICAMENTE a organizaciones in situ.

Nota: Este artículo es una traducción del inglés. La información contenida en este artículo se basa en la(s) versión(es) original(es) del producto en inglés. Puede haber pequeños errores, como por ejemplo en la gramática utilizada en la versión traducida de nuestros artículos. Aunque no podemos garantizar la total exactitud de la traducción, en la mayoría de los casos te resultará suficientemente informativa. En caso de duda, vuelve a consultar la versión en inglés de este artículo.