Haz buscable un PDF escaneado

Convierte la foto de una página en texto que puedes buscar y seleccionar.

Seleccionar un PDF escaneado

o arrástralos y suéltalos aquí

Formatos admitidos: PDF

Procesamiento seguro en servidor: se elimina automáticamenteEsta herramienta requiere procesamiento en el servidor. Tu archivo se envía por una conexión cifrada al servidor de procesamiento de iBuildPDF, se conserva solo mientras dura la conversión y se elimina automáticamente después.

Datos rápidos

Qué hace
Reconoce el texto de una página escaneada y lo añade como una capa invisible detrás de la imagen, dejando la página exactamente con el aspecto que tenía.
Entrada
PDF
Salida
PDF
Procesamiento
En nuestro servidor
¿Se suben los archivos?
Sí, temporalmente
¿Hace falta cuenta?
No
Ideal para
Hacer localizable un archivo de documentos escaneados, o preparar un escaneado para una herramienta que necesita texto de verdad: PDF a Word, PDF a Excel, extraer texto.
Limitación principal
El reconocimiento es una lectura de la imagen, no una transcripción. El texto impreso limpio a 300 DPI es muy preciso; la escritura a mano, un fax tenue, las páginas torcidas y las fuentes poco comunes lo son mucho menos. Las páginas que ya contienen texto se dejan como están en lugar de volver a reconocerlas.

Cómo usar esta herramienta

  1. Elige el PDF escaneado.
  2. Elige el idioma del texto de la página. El idioma correcto importa más que cualquier otra cosa que puedas ajustar.
  3. Haz clic en "Aplicar". El archivo se envía a reconocer por una conexión cifrada.
  4. Descarga el PDF buscable. Se ve idéntico y ahora responde a una búsqueda de texto.

Por qué usar iBuildPDF

Un escaneado es una fotografía de un documento. Parece texto y no contiene ninguno, que es la razón por la que buscar en él no encuentra nada y copiar de él no copia nada. El OCR lee la imagen y escribe lo que ve en una capa de texto situada detrás de la imagen, de modo que la página sigue viéndose exactamente igual que el escaneado y, de golpe, todas las herramientas que necesitan texto de verdad funcionan con ella. Este es el paso que convierte una carpeta de escaneados inservibles en un archivo en el que se puede buscar.

Cómo funciona

Se examina cada página; las páginas que ya tienen una capa de texto se omiten, así que un documento mixto no se degrada por volver a reconocer las partes que ya estaban bien. El resto se reconoce en el idioma que hayas elegido y el resultado se escribe detrás de la imagen original, que se deja intacta.

Preguntas frecuentes

¿Qué idiomas puede reconocer?

Los idiomas instalados en nuestro servidor de procesamiento, que son los que enumera el selector de esta página: actualmente árabe, chino (simplificado), alemán, inglés, francés, portugués y español. Solo se ofrecen los idiomas realmente instalados, así que cualquiera de esa lista funcionará.

¿La página se ve distinta después?

No. La imagen original se conserva exactamente como estaba y el texto reconocido se coloca detrás, invisible. Lo que cambia es que ahora se puede buscar en el archivo y copiar de él.

¿Cómo de preciso es?

Depende casi por completo del escaneado. El texto impreso recto y limpio a unos 300 DPI se reconoce muy bien. Una página torcida, una fotografía hecha en ángulo, un fax descolorido o una nota manuscrita producirán errores. Revisa todo aquello en lo que un dígito equivocado importe.

¿Y si mi documento solo está escaneado en parte?

Eso está contemplado. Las páginas que ya contienen texto se dejan como están y solo se reconocen las páginas escaneadas, así que un informe con anexos escaneados vuelve con los anexos buscables y el resto intacto.

He elegido el idioma equivocado y el resultado no tiene sentido.

Vuelve a ejecutarlo con el correcto. El reconocimiento compara formas contra un modelo de idioma, así que una página en francés leída como inglés produce basura con aspecto convincente. El escaneado original no cambia, así que no hay nada que deshacer.

Más información sobre esto