Cómo arreglar un PDF corrupto
"El archivo está dañado y no se pudo reparar." Son cuarenta páginas de trabajo, abrió ayer y la fecha límite es en una hora. Antes de aceptar ese veredicto: ese mensaje significa que tu lector admite que él no pudo entender el archivo. No es un informe forense, y falla más a menudo de lo que crees.
¿Qué hay realmente dentro de un PDF
Para entender por qué fallan los PDF —y por qué a menudo se pueden recuperar—, ayuda saber cómo están construidos. Un PDF es una colección de objetos numerados: páginas, fuentes, imágenes, bloques de texto. Dispersos por todo el archivo, sin un orden en particular.
Para encontrar algo, el lector consulta un índice al final del archivo: la tabla de referencias cruzadas. Es una búsqueda: el objeto 47 comienza en el byte 981,204. El lector abre el archivo, salta hasta el final, lee el índice y lo usa para encontrar todo lo demás.
Este diseño es la razón por la que los PDF abren documentos grandes al instante: el lector obtiene directamente la página 300 en lugar de leer las 299 páginas primero. También crea un único punto de fallo. Si el índice está mal, el lector no puede encontrar nada —aunque todo siga ahí.
Cómo se rompen
- Transferencias truncadas. Una descarga interrumpida, un disco lleno, un teléfono que se quedó sin espacio a mitad del guardado. El archivo termina antes — y dado que el índice está al final, la primera víctima es siempre el mapa.
- Retirar el almacenamiento demasiado pronto. Desconectar una memoria USB o perder la conexión de red mientras se está escribiendo un archivo. La escritura se reporta como terminada; el último fragmento nunca llegó.
- Conflictos de sincronización. Carpetas en la nube que reconcilian dos versiones de un archivo que ambas cambiaron. El resultado puede ser una mezcla que no es válida para ninguna de las dos.
- Software que escribe archivos defectuosos. No todos los generadores de PDF son cuidadosos, y algunos producen archivos técnicamente inválidos que los lectores permisivos toleran durante años, hasta que un lector estricto se niega a abrirlos.
- Fallo genuino del medio. Un disco defectuoso corrompiendo bytes en su lugar. La causa más rara y la más grave, porque aquí los datos realmente han desaparecido.
Antes de reparar cualquier cosa: ¿está realmente roto?
Dos minutos de comprobación ahorran muchos problemas, porque un número sorprendente de archivos «dañados» están bien:
- Ábrelo con un lector diferente. Intenta usar un navegador si usaste una aplicación de escritorio, o una aplicación de escritorio si usaste un navegador. Los lectores varían enormemente en cuanto a su estrictez — un archivo que uno rechaza puede abrirse perfectamente en otro lugar. Esto por sí solo resuelve una buena parte de los casos.
- Comprueba el tamaño del archivo. Si un documento de 12 MB ahora tiene 400 KB, está truncado y los bytes faltantes simplemente no existen. Si es de 0 KB, no hay nada que reparar; busca una copia de seguridad.
- Intenta obtener la fuente de nuevo. Si llegó por descarga o correo electrónico, descárgala otra vez. Una copia fresca soluciona completamente el problema, y una descarga corrupta es la causa más común.
- ¿Está dañado o está cifrado? Algunos lectores reportan un archivo protegido por contraseña con un esquema de cifrado inusual como "dañado". Si podría estar protegido, ese es un problema diferente: consulta explicación de contraseñas de PDF.
Qué hace realmente la reparación
Si el archivo está realmente mal formado, la reparación no realiza cirugía en tus páginas. Ignora el índice roto y lee el archivo desde el principio, buscando cualquier cosa que parezca un objeto válido y anotando dónde está cada uno realmente. De los supervivientes reconstruye la tabla de referencias cruzadas y reensambla un documento.
Por eso los resultados se agrupan en tres grupos:
- Recuperación completa. Los objetos estaban intactos; solo el mapa estaba mal. Es lo más común, y el caso más feliz: recuperas tu documento exactamente igual.
- Recuperación parcial. Algunos objetos están dañados o faltan. Obtienes las páginas que sobrevivieron. Un archivo truncado generalmente recupera sus primeras páginas y pierde el final, porque los archivos se escriben de principio a fin.
- Nada. Si el archivo es un fragmento, o los bytes están revueltos, no hay nada coherente que encontrar. Ninguna herramienta puede recuperar datos que no estén en el archivo.
Cómo reparar un PDF
- Trabaja con una copia. Siempre. Duplica primero el archivo dañado, para que un intento fallido no te cueste nada y puedas intentar algo más después.
- Abre la herramienta de reparación. Ve a Reparar PDF. Se ejecuta en tu navegador.
- Carga el archivo dañado y exporta el resultado.
- Revisa cada página, no solo la primera. Esto es importante. La recuperación parcial parece un éxito en la página uno y se revela en la página treinta. Desplázate por todo el documento antes de confiar en él.
- Guarda lo que recuperes. Si abre, guarda esa copia en un lugar seguro inmediatamente.
Abrir la herramienta de reparación de PDF
Establecer expectativas realistas
Las herramientas de reparación que prometen arreglar cualquier PDF están prometiendo algo que ningún software puede entregar. Los límites son la física, no el esfuerzo:
- Los bytes faltantes siguen faltando. Si una descarga se detuvo al 40%, el otro 60% no existe en ninguna parte de tu archivo. La reconstrucción no es invención.
- Las páginas recuperadas pueden perder fidelidad. Si un objeto de fuente o imagen estaba dañado, una página puede volver con fuentes sustituidas o gráficos faltantes. Legible, pero no idéntico.
- El daño encriptado es peor. La corrupción dentro de un archivo cifrado generalmente no se puede sortear, porque la estructura necesaria para descifrarlo es en sí misma ilegible.
- Un archivo reparado no es el original. Ha sido reconstruido. Si la identidad del documento byte por byte importa —un contrato con hash, por ejemplo—, una copia reparada no coincidirá con su antiguo hash, y eso es lo esperado en lugar de sospechoso. Consulta cómo demostrar que un documento no ha cambiado.
No perder el siguiente
La mayoría de los PDFs corruptos no nacen así, se hacen:
- No edites documentos directamente en unidades de red o carpetas en la nube. Cópialos localmente, trabaja y vuelve a copiarlos. La mayoría de los conflictos de sincronización y archivos a medio escribir empiezan aquí.
- Deja que las transferencias terminen. Expulsa el almacenamiento correctamente; espera a que se complete la carga antes de cerrar la tapa.
- Conserva la fuente. El escaneo original, la exportación original. Un archivo regenerado siempre supera a uno reparado.
- Para documentos importantes, mantén una copia en otro lugar. Reparar es lo que haces cuando no hiciste copias de seguridad.
¿Por qué reparar localmente?
Un archivo dañado sigue siendo un archivo confidencial. El contrato que no puedes abrir es el mismo contrato que no pudiste subir ayer; no ser legible no lo hace menos sensible, y subirlo a un servicio de reparación desconocido en un momento de pánico es una decisión tomada bajo exactamente las condiciones equivocadas. Reparar en tu propio dispositivo mantiene el archivo donde está. En CyvoDocOps, las operaciones compatibles de este tipo se ejecutan localmente en tu navegador y el documento no se sube a un servidor.
Preguntas frecuentes
¿Por qué mi PDF dice que está dañado si lo abrí ayer?
Normalmente, el archivo se truncó o se alteró en algún momento: una sincronización interrumpida, una transferencia fallida. A veces ni siquiera ha cambiado nada y simplemente lo abriste con un lector más estricto. Intenta usar otro visor primero.
¿Se puede reparar cualquier PDF corrupto?
No. Si el índice está roto, pero el contenido sobrevivió, la recuperación es probable. Si faltan bytes de verdad, no se pueden reconstruir; cualquiera que prometa lo contrario está exagerando.
¿Voy a perder páginas?
Posiblemente. Los archivos truncados suelen conservar sus primeras páginas y pierden las últimas. Revisa todo el documento después de la reparación, no solo la primera página.
El archivo reparado funciona pero se ve un poco diferente. ¿Por qué?
Si los objetos de fuente o imagen estaban dañados, la reconstrucción puede sustituir fuentes o eliminar gráficos. El texto se recupera; algunas presentaciones quizás no lo estén.
¿Se subió mi archivo dañado?
No. La reparación se ejecuta localmente en tu navegador y el documento no se envía a un servidor.