Un PDF que no se abre parece una pérdida total, pero normalmente no lo es. En la inmensa mayoría de los casos el contenido de las páginas sigue dentro del archivo, intacto y legible; lo que se ha roto es esa pequeña pieza de contabilidad interna que le dice al lector dónde empieza cada página. Reparar el archivo consiste en reconstruir esa contabilidad, no en recrear el documento.
Esta guía explica qué se rompe de verdad, cómo distinguir un archivo recuperable de uno realmente destruido y cómo reparar un PDF en tu navegador sin instalar nada.
Qué se rompe realmente en un PDF dañado
Un PDF no es un flujo continuo de texto como lo es un archivo plano. Es una colección de objetos numerados —tipografías, imágenes, descripciones de página, metadatos— seguida, al final del archivo, de una tabla de consulta llamada tabla de referencias cruzadas, o xref. La xref registra el desplazamiento exacto en bytes de cada objeto. Cuando un lector abre un PDF, salta al final, lee la xref y la usa para localizar la página uno.
Ese diseño es rápido, pero tiene una debilidad concreta: el índice vive al final y apunta hacia atrás. Si algo desplaza la posición de los objetos, o si la cola del archivo nunca llega, todos los desplazamientos de la xref quedan mal a la vez. El lector busca la página uno en el byte 48.213, encuentra algo que no es una página y se rinde. Nada de la página en sí ha sufrido daño alguno.
- Tabla de referencias cruzadas rota. El índice existe, pero sus desplazamientos ya no coinciden con la realidad. Es con diferencia la forma más común de daño en un PDF y casi siempre tiene reparación.
- Archivo truncado. Una subida, una descarga o una copia se detuvo antes de tiempo, así que la última parte del archivo —incluida la xref— nunca llegó. Recuperable hasta el punto donde el archivo se corta.
- Flujos de objetos dañados. Objetos concretos han sido alterados, normalmente por un programa que escribió mal en el archivo. Reparable página a página; las páginas dañadas pueden perder formato.
- Tipografías incrustadas corruptas. El texto está ahí, pero la fuente a la que hace referencia es ilegible, así que las páginas salen en blanco o con recuadros. Suele arreglarse sustituyendo por una fuente estándar.
- Cabecera no válida. El archivo no empieza por
%PDF-. A menudo significa que en realidad no es un PDF, o que algo se le ha antepuesto.
Los mensajes de error más habituales, descifrados
El mensaje que muestra tu lector es una guía razonable de qué ha fallado. Estos son los que aparecen con más frecuencia:
| Mensaje de error | Qué suele significar | ¿Recuperable? |
|---|---|---|
| «Se ha producido un error al abrir este documento. El archivo está dañado y no se ha podido reparar.» | El propio intento de reparación de Adobe falló ante una xref rota | Normalmente sí, con otra herramienta |
| «No se ha podido cargar el documento PDF.» | Chrome no ha podido interpretar la cabecera o la xref | Normalmente sí |
| «El archivo no es de un tipo compatible o está dañado.» | Cabecera %PDF- ausente o no válida | A veces: comprueba que sea realmente un PDF |
| «Se esperaba un objeto dict.» / «Número de objeto no válido.» | Flujo de objetos dañado | Parcialmente: se recuperan las páginas intactas |
| Se abre, pero todas las páginas están en blanco | Tipografías incrustadas corruptas o ausentes | Normalmente sí |
| Se abre, pero se corta a mitad | Archivo truncado | Solo hasta el punto de corte |
| «Este documento está protegido.» | No es un daño en absoluto: está cifrado | No es un problema de reparación |
Esa última fila importa más de lo que parece. Una parte nada despreciable de los archivos que la gente lleva a una herramienta de reparación no están dañados: están protegidos con contraseña, y el mensaje del lector simplemente no es claro. Si conoces la contraseña, usa Proteger PDF para gestionar el cifrado del archivo en lugar de intentar repararlo.
Qué se puede recuperar y qué no
Ser honesto con las expectativas vale más que el optimismo, porque te dice cuándo dejar de perder tiempo con un archivo y ponerte a buscar el original.
- Casi siempre recuperable: tablas xref rotas, archivos que el lector se niega a abrir pero que por lo demás están completos, PDF guardados por un programa que se cerró a mitad de escritura y archivos que salen en blanco por problemas de tipografía.
- Parcialmente recuperable: archivos truncados. Obtienes todo hasta el byte donde el archivo se corta, y nada después. Una descarga que llegó al 80% suele dar aproximadamente el 80% de las páginas, intactas.
- Rara vez recuperable: archivos en los que los propios flujos de objetos han sido sobrescritos con datos ajenos, por ejemplo por un disco defectuoso o una tarjeta de memoria en mal estado. El índice puede reconstruirse, pero apuntará a contenido que ya no existe.
- Ni siquiera es un problema de reparación: archivos cifrados, archivos que nunca fueron PDF (una extensión
.pdfsobre un documento de Word, por ejemplo) y archivos de 0 bytes. Dentro de un archivo de 0 bytes no hay nada que recuperar.
Tres cosas que probar antes de reparar
Cada una de ellas lleva menos de un minuto y cada una resuelve una categoría real de problema que no es corrupción:
- Ábrelo en otro lector. Los lectores varían enormemente en su tolerancia ante archivos mal formados. Un PDF que Adobe Acrobat rechaza de plano se abrirá muchas veces en Chrome o Firefox, que reparan en silencio problemas estructurales menores. Si se abre en el navegador, imprímelo de nuevo a PDF y ya tienes una copia limpia.
- Descárgalo otra vez. Si el archivo llegó por red, la explicación más sencilla es que la transferencia falló. Vuelve a descargarlo y compara el tamaño con el del origen antes de dar por hecho que el archivo tiene la culpa.
- Comprueba que sea un PDF. Ábrelo en cualquier editor de texto plano y mira la primera línea. Un PDF real empieza por
%PDF-1.4o similar. Si vesPK, es un ZIP o un archivo de Office con la extensión equivocada; si ves<!DOCTYPE html>, has descargado una página de error en lugar del documento.
Reparar un PDF en tres pasos
Si el archivo está realmente dañado, repararlo con PdfDocShift lleva tres pasos. No hay instalación ni registro, y todos los archivos subidos se eliminan definitivamente de nuestros servidores a las dos horas.
Abre la herramienta Reparar PDF
Entra en pdfdocshift.com/repair-pdf y arrastra el archivo dañado a la zona de carga, o haz clic para buscarlo. Sube el archivo exactamente como está: no lo renombres, no lo vuelvas a guardar ni lo abras y reexportes antes, porque cualquiera de esas acciones puede sobrescribir estructura recuperable.
Deja que se ejecute la pasada de reparación
La herramienta recorre todo el archivo buscando objetos PDF válidos en lugar de fiarse del índice existente, reconstruye el árbol de páginas a partir de lo que encuentra, rehace la tabla de referencias cruzadas y sustituye por fuentes estándar cualquier tipografía incrustada que no pueda leerse. La mayoría de los archivos terminan en unos segundos; los muy grandes o muy dañados tardan más.
Descarga y verifica
Descarga el archivo reparado y compruébalo bien, no solo la página uno. Confirma que el número de páginas coincide con el que esperas y después revisa una página del medio y la última. Si faltan páginas, el archivo estaba truncado y lo que tienes es todo lo que sobrevivió.
Repara ahora un PDF dañado
Gratis, sin registro, archivos eliminados a las 2 horas. La mayoría se repara en menos de 10 segundos.
Abrir Reparar PDF →Reparar PDF escaneados y con muchas imágenes
Los documentos escaneados se corrompen de forma distinta a los de texto, y conviene tratarlos como un caso aparte. Un PDF escaneado es un contenedor de imágenes grandes, así que una proporción mucho mayor del archivo son datos de imagen: eso significa que el truncamiento te cuesta páginas enteras en lugar de un índice roto, y que un archivo parcial suele terminar a mitad de una imagen, dejando una última página dibujada a medias.
De ahí se derivan dos cosas. Primera: repara un PDF escaneado antes de hacerle cualquier otra cosa; aplicar compresión o conversión a un escaneo dañado tiende a fijar el daño de forma permanente. Segunda: si el archivo reparado se abre pero el texto ya no se puede seleccionar, la capa de texto no sobrevivió; puedes reconstruirla pasando el archivo reparado por OCR PDF, que lee las imágenes y escribe debajo una capa de texto nueva y buscable.
Si el escaneo recuperado resulta poco manejable después —la reparación produce a veces un archivo más grande que el original, porque no puede reutilizar las estructuras de compresión rotas—, Comprimir PDF lo reducirá sin tocar las páginas en sí.
Cómo se dañan los PDF y cómo evitarlo
Casi toda la corrupción real de PDF se explica por un número reducido de causas, y la mayoría son evitables:
- Transferencias interrumpidas. Una descarga que se corta, un recurso de red que se desconecta a mitad de copia o un USB retirado antes de que terminara la escritura. Expulsa siempre los medios extraíbles correctamente y verifica el tamaño del archivo tras transferencias grandes.
- Editar un archivo en la nube mientras se sincroniza. Guardar encima de un PDF que Dropbox, OneDrive o Google Drive está subiendo en ese momento es una forma fiable de producir un archivo mitad viejo mitad nuevo. Deja que termine la sincronización antes de abrirlo.
- Aplicaciones que se cierran durante el guardado. Un PDF escrito por un programa que se cerró de forma inesperada suele tener contenido pero ningún índice válido: el caso reparable clásico.
- Enviar PDF como adjuntos en línea a través de servidores antiguos. Algunos sistemas de correo heredados todavía aplican codificación de modo texto a adjuntos binarios, lo que los corrompe en tránsito. Comprime el archivo antes de enviarlo si tratas con un sistema del que no te fías.
- Almacenamiento defectuoso. Los sectores dañados y las tarjetas de memoria moribundas corrompen archivos en silencio. Si más de un archivo de una unidad se ha estropeado, el problema es la unidad: copia todo lo que puedas antes de hacer cualquier otra cosa.
Preguntas frecuentes
No, pero la mayoría sí. Las tablas de referencias cruzadas rotas —con diferencia la causa más común de que un PDF no se abra— casi siempre tienen reparación, porque el contenido de las páginas está intacto y solo hay que reconstruir el índice. Los archivos truncados se recuperan hasta el punto en que se cortan. Los archivos cuyo contenido real ha sido sobrescrito por un fallo de disco por lo general no se recuperan, y ninguna herramienta puede recuperar un archivo de 0 bytes.
No debería. Una reparación reconstruye el índice estructural y el árbol de páginas del archivo; el contenido de las páginas se copia sin cambios. La única excepción son las tipografías incrustadas: si una fuente es ilegible, la reparación la sustituye por una estándar, lo que puede alterar ligeramente el espaciado o la disposición del texto en la página. Las palabras en sí no se ven afectadas.
Los navegadores son mucho más tolerantes con los PDF mal formados que Acrobat. Chrome y Firefox sortean discretamente una tabla de referencias cruzadas rota recorriendo el archivo en busca de páginas, mientras que Acrobat valida la estructura y rechaza los archivos que no la cumplen. Es una señal útil: si se abre en el navegador, el contenido está intacto y una reparación casi con toda seguridad funcionará.
Normalmente es un problema de tipografía más que un daño en las páginas. El contenido está presente pero hace referencia a una fuente incrustada que el lector no puede descodificar, así que no se dibuja nada. Una pasada de reparación que sustituya por fuentes estándar suele restaurar el texto visible. Si las páginas siguen en blanco después, puede que el documento contenga páginas realmente vacías: prueba Eliminar páginas en blanco para confirmar cuántas páginas tienen contenido.
Es seguro cuando la herramienta cifra las subidas en tránsito y elimina los archivos con prontitud. PdfDocShift usa SSL de 256 bits en cada subida y elimina definitivamente los archivos de sus servidores a las dos horas. Para material especialmente sensible, repara el archivo y después añádele una contraseña con la herramienta Proteger PDF, que aplica cifrado AES de 256 bits, antes de compartirlo.
No. Reparación y descifrado son operaciones completamente distintas. Una herramienta de reparación reconstruye la estructura de un archivo dañado; no elimina ni recupera el cifrado. Si un PDF se abre con una petición de contraseña en lugar de un mensaje de error, el archivo no está dañado: está protegido, y necesitarás la contraseña.
¿Listo para recuperar tu archivo?
Gratis, sin registro, archivos eliminados a las 2 horas. Funciona en cualquier dispositivo, sin instalación.
Abrir Reparar PDF →