En una revisión sistemática, el procedimiento habitual consiste en importar primero las referencias bibliográficas recuperadas en las bases de datos, hacer el cribado frente a título y resumen y, aquellas que pasan a la segunda fase de cribado, asociar a cada registro su correspondiente texto completo.
El problema que describo en esta entrada aparece en ese segundo momento: la referencia está correctamente importada en Rayyan, pero la plataforma no permite adjuntarle determinados PDF creados o modificados por nosotros.

Los documentos se abrían con normalidad en mi ordenador, todas sus páginas eran visibles y no parecían estar dañados. Sin embargo, Rayyan no conseguía procesarlos o asociarlos a la referencia correspondiente.
Una herramienta de inteligencia artificial me ayudó a analizar los archivos, comprender que el problema no estaba en las referencias bibliográficas, sino en la estructura interna de los PDF, y determinar qué transformaciones eran necesarias. También me ayudó a procesar los documentos y a generar nuevas versiones normalizadas que finalmente pude subir y asociar correctamente en Rayyan.
El problema no estaba en el archivo RIS
Las referencias ya habían sido importadas previamente en Rayyan mediante archivos RIS procedentes de las bases de datos o de los registros correspondientes.
El fallo se producía exclusivamente al intentar adjuntar el texto completo a una referencia ya existente.
Aunque la referencia estuviera perfectamente identificada, Rayyan podía rechazar el PDF por sus características técnicas internas.
Casos en los que encontré problemas
1. Artículos unidos a su material suplementario
En mi práctica habitual, cuando un artículo dispone de material suplementario, creo un único documento PDF en el que, al texto completo del artículo, le añado al final el material suplementario.
Este procedimiento resulta útil porque permite conservar conjuntamente toda la documentación necesaria para evaluar si el estudio pasa el segundo screening y para la posterior extracción de datos. Evita, además, que el suplemento quede separado o se pierda durante el proceso de revisión.
Sin embargo, el artículo principal y los suplementos pueden haberse generado con aplicaciones diferentes y presentar:
- Versiones distintas del estándar PDF.
- Tamaños y orientaciones de página diferentes.
- Capas de texto incompatibles.
- Fuentes incrustadas de forma distinta.
- Anotaciones, formularios o enlaces.
- Páginas digitales combinadas con páginas escaneadas., …
Aunque el documento combinado pueda abrirse sin problemas en un lector convencional, internamente puede seguir siendo un archivo heterogéneo. Rayyan puede no procesarlo correctamente y rechazarlo al intentar asociarlo a la referencia.

2. Páginas web impresas o guardadas como PDF
Otro caso frecuente aparece cuando no existe una opción para descargar un PDF y necesitamos conservar el contenido de una página web.
Es habitual en plataformas de registro de ensayos clínicos, informes publicados exclusivamente en HTML, etc.
En estas situaciones utilizo las opciones del navegador Imprimir o Guardar como PDF.
El archivo resultante puede visualizarse como un PDF normal, pero su estructura interna conserva elementos procedentes de la página web:
- Cabeceras y pies de impresión.
- URL y fecha de consulta.
- Menús de navegación.
- Avisos legales.
- Hipervínculos.
- Fuentes web.
- Elementos ocultos.
- Texto dividido en numerosos objetos. …
En algunos de los archivos, el contenido es perfectamente legible, pero no existía una capa de texto extraíble. En otros, el PDF generado por el navegador contiene una estructura que Rayyan no puede procesar correctamente.
3. Suplementos de revistas que incluyen muchos resúmenes de congreso
También encontré problemas con suplementos de revistas que recogen todas las comunicaciones orales y póster de un congreso.
El PDF tiene un PDF único e incluye:
- Varios títulos.
- Diferentes grupos de autores.
- Distintos números de resumen.
- Información correspondiente a varios estudios.
Aunque solo necesitaba asociar uno de los resúmenes, el archivo contenía varias referencias potenciales. En este caso fue necesario recortar la página y generar un PDF nuevo que incluyera únicamente el resumen pertinente.
4. PDF sin texto extraíble o con una capa defectuosa
En otros documentos, el texto era visible, pero no podía seleccionarse o buscarse. En algunos casos, al copiarlo aparecían caracteres desordenados o ilegibles.
Esto puede ocurrir cuando:
- El documento está formado por imágenes.
- La codificación de las fuentes es defectuosa.
- La capa de texto no coincide con la imagen.
- Se han superpuesto varias capas de OCR.
- El PDF procede de una digitalización o conversión deficiente.
Añadir simplemente otra capa de OCR no siempre resuelve el problema. Si ya existe una capa de texto incorrecta, puede ser necesario reconstruir previamente el documento.

Cómo me ayudó la inteligencia artificial
La inteligencia artificial tuvo un papel práctico en varias fases del proceso.

- Análisis del problema. La primera aportación fue ayudarme a diferenciar entre un problema bibliográfico y un problema técnico del PDF. La herramienta de inteligencia artificial me ayudó a determinar que no bastaba con aplicar OCR o guardar de nuevo el documento. En los casos problemáticos fue necesario realizar una combinación de operaciones:
- Reconstruir el PDF.
- Homogeneizar las páginas.
- Eliminar estructuras internas innecesarias.
- Recortar contenido no pertinente.
- Aplicar OCR cuando era necesario.
- Incorporar metadatos básicos.
- Simplificar el nombre del archivo.
- Procesamiento de los documentos. En los casos problemáticos fue necesario realizar una combinación de operaciones:
- Reconstruir el PDF.
- Homogeneizar las páginas.
- Eliminar estructuras internas innecesarias.
- Recortar contenido no pertinente.
- Aplicar OCR cuando era necesario.
- Incorporar metadatos básicos.
- Simplificar el nombre del archivo.
- Procesar los archivos y generar nuevas versiones técnicamente más sencillas. De esta forma se eliminaron o neutralizaron muchos elementos que podían causar incompatibilidades, como, por ejemplo, capas defectuosas.
Después se incorporó una nueva capa de texto mediante OCR cuando era necesario. Los PDF resultantes pudieron subirse y asociarse a las referencias correspondientes en Rayyan.

En mis documentos fue necesario: Reconstruir el PDF, simplificar su estructura, aplicar OCR cuando procedía, normalizar sus metadatos y cambiar el nombre del archivo.
Controles necesarios después del procesamiento
La utilización de inteligencia artificial no elimina la necesidad de revisión humana. Después de generar cada PDF comprobé:
- Que estaban todas las páginas.
- Que se había respetado el orden original.
- Que no se había eliminado contenido relevante.
- Que el artículo y el suplemento estaban completos.
- Que el OCR no modificaba la imagen visible.
- Que el título y el identificador eran correctos.
- Que el archivo podía abrirse.
- Que el PDF se asociaba a la referencia adecuada.
Conclusión
Cuando Rayyan no permite asociar un texto completo, el problema no siempre está en la plataforma ni en la referencia bibliográfica. Con frecuencia se encuentra en la estructura interna del PDF.
Esto puede suceder especialmente con:
- Artículos unidos a su material suplementario.
- Páginas web impresas o guardadas como PDF.
- Suplementos de revistas con varios resúmenes.
- PDF con capas de texto defectuosas.
En esta experiencia, la inteligencia artificial me ayudó a comprender qué estaba ocurriendo, identificar una solución técnica y procesar los documentos hasta obtener archivos compatibles con Rayyan.
La inteligencia artificial fue, en este caso, una herramienta de apoyo técnico. Permitió diagnosticar y resolver un problema que no era evidente al abrir los documentos, pero la comprobación final de la integridad, correspondencia y fidelidad de los PDF siguió siendo responsabilidad de la persona que realizaba la revisión.


























































































































