Skip to content
files.co

¿Por qué mi PDF se abre pero muestra páginas en blanco?

El PDF se abre sin problema, pero las páginas aparecen en blanco en vez de mostrar el texto. Te explicamos por qué pasa esto y cómo recuperar el contenido sin subir el archivo a ningún sitio.

DCDavid Carrero · · 6 min de lectura

Este caso es distinto al de un PDF que directamente se niega a abrirse. Aquí el archivo se abre sin quejarse. El visor carga, el número de páginas es correcto, puedes desplazarte por el documento… y cada página es un rectángulo blanco vacío. Sin mensaje de error, sin aviso, simplemente nada donde debería haber contenido. Es una avería rara, porque todo en el archivo parece correcto salvo lo único que realmente te interesa ver.

Por qué pasa esto

Una página de PDF no es “texto sobre papel”. Es un conjunto de instrucciones de dibujo, y esas instrucciones dependen de recursos incluidos dentro del propio archivo, sobre todo las fuentes tipográficas. Cuando esas instrucciones o los recursos a los que apuntan faltan o están dañados, el visor no tiene nada que dibujar, así que muestra una página vacía en lugar de inventarse algo.

Estas son las causas más habituales:

Fuentes incrustadas rotas o ausentes. La mayoría de PDF llevan dentro su propia copia de las fuentes que usan, para que el texto se vea igual en cualquier dispositivo. Si esa incrustación se corrompe, por una exportación mal hecha, una compresión demasiado agresiva o un generador de PDF con fallos, el visor no encuentra los glifos que necesita dibujar y deja la página vacía en vez de mostrar algo incorrecto. Puedes leer cómo funciona esto en nuestra entrada del glosario sobre fuentes incrustadas.

Un documento escaneado sin la capa de imagen renderizada. Los PDF escaneados suelen ser, en el fondo, una foto de cada página. Si el escaneo generó un objeto de página sin la imagen bien enlazada, o los datos de esa imagen se perdieron en algún paso intermedio (una conversión con pérdida, un OCR fallido), te queda una página con estructura pero sin la foto que debería contener.

Contenido en la capa equivocada. Algunas herramientas de PDF separan lo que se ve de lo que se puede seleccionar. Si un documento tiene una capa de texto buscable debajo de una imagen escaneada, y esa imagen falla al renderizar, puedes acabar con una página que técnicamente no está vacía, su capa de texto sigue ahí si seleccionas todo, pero visualmente parece en blanco porque lo que debía dibujarse encima nunca llegó a aparecer.

Un visor que no lleva bien alguna característica concreta del PDF. A veces el archivo está perfectamente bien, pero el visor que estás usando tropieza con un espacio de color raro, un grupo de transparencia o una configuración de capas poco habitual. Abrir el mismo archivo en otro lector descarta esto enseguida.

Cómo comprobar qué está pasando de verdad

Antes de temer lo peor, prueba un diagnóstico rápido: selecciona la página en blanco con Ctrl+A (o Cmd+A) y mira si se resalta texto aunque no se vea nada. Si ocurre, hay una capa de texto que funciona debajo de un renderizado roto, y eso es un problema mucho más fácil de resolver que una página realmente vacía.

Si no se selecciona ni se resalta nada, la página no tiene contenido visible de verdad guardado dentro, lo que normalmente apunta a que las fuentes o los datos de la imagen son los que han fallado.

Cómo arreglarlo

Si el archivo es un escaneo y la capa de texto parece intacta pero la imagen no se renderiza, pasarlo de nuevo por OCR puede reconstruir una versión limpia y funcional: lee lo que hay realmente en la página y genera una capa buscable nueva sobre una imagen bien incrustada, lo que de paso suele arreglar los fallos de renderizado del escaneo original.

Si lo que necesitas sobre todo es el texto y no tanto la maquetación visual, puedes esquivar el problema de las páginas en blanco directamente sacando el contenido con extraer texto. Como esta herramienta lee los objetos de texto que hay debajo en vez de renderizar la página, muchas veces funciona incluso cuando la capa visual está rota, así que recuperas el contenido aunque la página en sí se niegue a verse normal.

Si tienes acceso al documento original (el archivo de Word, el diseño, lo que sea que generó el PDF), volver a exportarlo desde ahí suele ser más rápido y limpio que intentar reparar la copia dañada. Los fallos al generar PDF son lo bastante comunes como para que una segunda exportación simplemente funcione.

Hacerlo sin entregar tu documento a un desconocido

Un PDF con las páginas en blanco suele ser algo que preferirías no subir a una web cualquiera de “arreglar PDF”, una factura, un contrato, un formulario con datos de alguien. Todo el sentido de pasar el OCR o extraer el texto es recuperar el contenido, no mandarlo a otro sitio en el proceso.

Todas las herramientas de files.co funcionan dentro de tu navegador con WebAssembly. Tu archivo se lee en la memoria de tu propio equipo, se procesa ahí, y el resultado se te devuelve a ti. Nunca cruza la red, algo que puedes comprobar tú mismo abriendo las herramientas de desarrollo del navegador, mirando el panel de red y ejecutando la herramienta. Así que, si una página se empeña en seguir en blanco, puedes investigar por qué sin preocuparte por dónde acaba el archivo mientras tanto.

Explora por categoría