Por qué falla una conversión de PDF y cuál de los fallos estás viendo
¿Por qué ha fallado mi conversión de PDF?
Guarda tus herramientas favoritas
Crea una cuenta gratuita de iBuildPDF para guardar tus herramientas favoritas y encontrarlas rápido cuando quieras.
Cuenta gratuita. Las herramientas PDF nunca necesitan una.
Respuesta breve
Casi siempre por una de cinco razones: el archivo está protegido con contraseña, no tiene capa de texto porque es un escaneo, es demasiado grande o demasiado largo para terminar, no es realmente el tipo de archivo que dice ser, o algo se ha roto en nuestro lado. Cada una exige una respuesta completamente distinta: una necesita una contraseña, otra necesita OCR, otra que dividas el archivo y otra no necesita nada de ti. Una herramienta que solo te dice que algo ha salido mal te deja adivinar cuál era.
Cinco fallos que desde fuera parecen idénticos
Desde el lado de quien lo usa, toda conversión fallida se parece: esperaste y luego no funcionó. Por debajo no son ni de lejos el mismo suceso.
- Cifrado. El documento tiene contraseña y la herramienta no puede abrirlo. No hay nada roto en tu archivo.
- Sin capa de texto. Las páginas son imágenes. No hay nada que convertir a texto, así que el resultado estaría vacío.
- Demasiado grande o demasiado largo. El trabajo realmente no puede terminar dentro del tiempo que se permite a una petición web.
- No es el archivo que crees. Una extensión .pdf sobre algo que no es un PDF, o un PDF truncado por una descarga fallida.
- Culpa nuestra. El servicio de conversión estaba reiniciándose, saturado, o tiene un fallo.
Esto importa porque solo el último nos toca arreglarlo a nosotros, y solo en los tres primeros puedes hacer algo tú. Distinguirlos es todo el trabajo de un buen mensaje de error, y por eso nuestras herramientas indican la causa en lugar de un fallo genérico siempre que la causa se conoce de verdad.
El archivo está protegido con contraseña
Un PDF puede llevar dos contraseñas distintas y fallan de forma diferente. Una contraseña de apertura significa que el contenido está cifrado y nada puede leer una sola página sin ella: todos los conversores fallan de inmediato, y hacen bien. Una contraseña de propietario deja el archivo legible pero lo marca como restringido, y algunas herramientas se niegan a procesarlo por principio aunque puedan leerlo perfectamente. Qué protege realmente una contraseña de PDF explica la diferencia como es debido.
Si conoces la contraseña, quítala primero y convierte el resultado. Si no la conoces, ninguna herramienta puede ayudarte: eso es el cifrado funcionando como está diseñado, y cualquier cosa que afirme lo contrario sobre un archivo moderno cifrado con AES está adivinando contraseñas o mintiendo.
No hay texto en el archivo
Esta es la sorpresa más común, porque una página escaneada se ve en pantalla exactamente igual que una escrita. Una fotografía o un escaneo de un documento contiene una imagen de palabras, no palabras. Pídele un resultado en Word o Excel y la respuesta honesta es que no hay nada que extraer.
Puedes comprobarlo en dos segundos sin ninguna herramienta: abre el PDF e intenta seleccionar una línea de texto con el cursor. Si obtienes un rectángulo de selección sobre toda la página en vez de una línea resaltada, es una imagen. Contar páginas e información del archivo también te dirá si existe una capa de texto.
La solución es el OCR, que lee la imagen y escribe una capa de texto por debajo. Convierte el archivo con OCR, no el original. Ten en cuenta que el OCR es una conjetura muy buena, no una transcripción: OCR y PDF a Word no son el mismo trabajo, y los dígitos que confunde son justo los que más importan.
Es demasiado grande, o hay demasiado de él
Las conversiones en servidor se ejecutan dentro de un límite de tiempo, porque una petición web que no termina nunca es peor para todos que una que se detiene y lo dice. Un documento de seiscientas páginas, un archivo lleno de escaneos de alta resolución o una página con decenas de miles de objetos vectoriales pueden superarlo con toda legitimidad.
Tres cosas que suelen funcionar:
- Convierte un rango en vez del archivo entero. Casi todas las herramientas de aquí aceptan una selección de páginas, y casi todo el mundo solo necesita una parte del documento.
- Divídelo primero y convierte las partes.
- Comprímelo primero si el tamaño viene de las imágenes. Comprimir PDF suele llevar un documento escaneado de imposible a rutinario.
Aquí un tiempo agotado se informa como tiempo agotado y no como un fallo genérico, precisamente para que acabes leyendo este párrafo.
Cuándo somos nosotros
Algunos fallos son nuestros, y lo útil es que tienen otro aspecto: le ocurren a archivos que funcionaban ayer, le ocurren a varias herramientas a la vez, o ocurren al primer intento y no al segundo.
Si una conversión falla y el mismo archivo funciona un minuto después, te has encontrado con un servicio reiniciándose. Si falla dos veces con un archivo que crees correcto, merece la pena contárnoslo: di qué herramienta, cuántas páginas aproximadamente y qué tipo de documento es. Por favor, no nos envíes el archivo. No lo queremos y casi nunca lo necesitamos; saber qué es el documento acota un fallo mucho más rápido que el documento en sí.
Las herramientas que funcionan en el navegador fallan de otra manera. Esas se ejecutan por completo en tu máquina, así que un navegador antiguo, un archivo muy grande con poca memoria o un script bloqueado las detienen mientras todas las herramientas de servidor siguen funcionando.
Herramientas que cubre este artículo
Fuentes
Documentación primaria de las afirmaciones anteriores.