← Blog

Integrar la catalogación con IA a tu catálogo (ILS)

Cómo integrar la catalogación con IA a un catálogo o ILS es, en lo habitual, una entrega. Collect lee los documentos y produce registros en el formato que la institución usa —MARC21, ISAD-G, Dublin Core, CDWA—. El catálogo es donde se consultan, se circulan y se corrigen. Collect no es un segundo catálogo: no guarda una copia de cada ficha alineada campo a campo con la que vive en el ILS.

Cuando el catalogador cambia un encabezamiento o una fecha en el catálogo, ese cambio se queda en el catálogo. No vuelve a Collect para «no desincronizar dos bases». Quien reprocesa un documento en Collect vuelve a leer el original y genera de nuevo el registro; no parte de la ficha ya editada en el ILS.

Cómo llega el registro

Hay varios caminos de salida, según cómo esté montado el destino.

El más directo para Janium es el lote de carga: un archivo por tanda, listo para entrar al catálogo. El intercambio por SFTP deja el mismo paquete (registros, adjuntos, manifiesto) en la bandeja del catálogo; el catálogo responde si el lote se procesó o si falló. Eso es una confirmación de carga, no el envío de las ediciones que después haga un catalogador sobre un registro suelto.

También se publica por SFTP o carpeta: el original, el JSON, la miniatura, el manifiesto. Un ILS que no es Janium consume ese paquete a su ritmo, o alguien lo carga a mano. Collect produce igual; lo que cambia es quién recorre el último metro.

Lo que Collect sí conserva

Collect conserva lo que necesita para volver a catalogar: el documento de origen, el markdown leído, la procedencia de los campos, el score. Eso sirve para reprocesar, para el filtro de lote y para mostrar de dónde salió un dato. No sustituye al registro vigente del catálogo.

El caso jerárquico: el árbol para el bubble-up

La excepción es un acervo descrito en ISAD-G con jerarquía. Ahí Collect no entrega solo documentos sueltos: genera los nodos de Fondo, Sección y Serie y sube a esos niveles lo que comparte la mayoría de los hijos —productor, rango de fechas, volumen—. Eso es el bubble-up, descrito en de documentos sueltos a Fondo y Serie.

Para recalcular esos padres hace falta conocer el árbol y las fechas de las unidades. El rango de un Fondo o una Serie no lo escribe el modelo: Collect lo calcula a partir de las fechas de los documentos que cuelgan de ese nodo. Si el catalogador corrige una fecha en el catálogo, esa fecha vuelve a Collect y se incorpora al índice. En un archivo histórico, esa corrección deja el rango del nodo listo para que la siguiente exportación lo vuelva a calcular.

Si el catalogador mueve un expediente de serie, crea un nivel o reordena el cuadro en el catálogo, ese cambio de jerarquía también se envía a Collect. Los registros nuevos se cuelgan del árbol vigente; el bubble-up usa ese árbol y las fechas ya corregidas. Un archivo de trámite recalcula rangos en cada exportación; uno histórico los puede congelar hasta que una fecha vuelva a cambiar.

Collect no mantiene un espejo de toda la ficha. Un encabezamiento o un título enmendados en el ILS no se reimportan para alinear dos catálogos. Lo que vuelve es lo que el bubble-up necesita: jerarquía y fechas.

Sin ubicación archivística en los documentos no hay árbol, y sin árbol no hay bubble-up. El resultado de la agregación se revisa antes de entrar al catálogo: es una heurística de mayoría.

Límites

Un catálogo que no consume el lote de carga ni el paquete por SFTP igual puede recibir los registros: alguien los carga, o un proceso propio lee la carpeta de publicación. El retorno a Collect, cuando aplica, es el de la jerarquía y las fechas de unidad, no el de cada campo de la ficha.

El destino de la descripción, una vez cargada, es el catálogo. Collect usa el árbol y las fechas actualizadas para agregar lo que viene después.

Si tu institución ya tiene un ILS y quieres ver qué canal de entrega encaja —FLAT, plugin SFTP, carpeta— y si tu cuadro de clasificación pide jerarquía ISAD-G, escríbenos a info@janium.com y lo vemos sobre tu caso.