Ein gescanntes PDF durchsuchbar machen
Verwandle das Bild einer Seite in Text, den du durchsuchen und markieren kannst.
Speicher deine Lieblings-Tools
Leg ein kostenloses iBuildPDF-Konto an, um deine Lieblings-Tools zu behalten und jederzeit schnell wiederzufinden.
Kostenloses Konto. Die PDF-Tools selbst brauchen nie eins.
Gescanntes PDF auswählen
oder einfach hierher ziehen
Zulässige Formate: PDF
Wird verarbeitet…
Kurz gefasst
- Was das Tool macht
- Erkennt den Text auf einer gescannten Seite und fügt ihn als unsichtbare Ebene hinter dem Bild ein; die Seite sieht danach genau aus wie vorher.
- Eingabe
- Ausgabe
- Verarbeitung
- Auf unserem Server
- Werden Dateien hochgeladen?
- Ja, vorübergehend
- Konto nötig?
- Nein
- Am besten für
- Ein Archiv gescannter Dokumente auffindbar machen oder einen Scan für ein Tool vorbereiten, das echten Text braucht — PDF in Word, PDF in Excel, Text extrahieren.
- Wichtigste Einschränkung
- Erkennung ist eine Lesart des Bildes und keine Abschrift. Sauberer gedruckter Text bei 300 DPI wird sehr genau erkannt; Handschrift, blasse Faxausdrucke, schiefe Seiten und ungewöhnliche Schriften deutlich schlechter. Seiten, die bereits Text enthalten, bleiben unangetastet, statt erneut erkannt zu werden.
So verwendest du dieses Tool
- Wähl das gescannte PDF.
- Wähl die Sprache des Textes auf der Seite. Die richtige Sprache zählt mehr als alles andere, was du einstellen kannst.
- Klick auf „Anwenden“. Die Datei wird über eine verschlüsselte Verbindung zur Erkennung geschickt.
- Lade das durchsuchbare PDF herunter. Es sieht unverändert aus und antwortet jetzt auf eine Textsuche.
Warum iBuildPDF
Ein Scan ist eine Fotografie eines Dokuments. Er sieht aus wie Text und enthält keinen, deshalb findet die Suche darin nichts und das Kopieren daraus kopiert nichts. OCR liest das Bild und schreibt, was es sieht, in eine Textebene hinter dem Bild — die Seite sieht also weiterhin genau aus wie der Scan, und jedes Tool, das echten Text braucht, funktioniert plötzlich damit. Das ist der Schritt, der aus einem Ordner unbrauchbarer Scans ein durchsuchbares Archiv macht.
So funktioniert es
Jede Seite wird geprüft; Seiten, die bereits eine Textebene tragen, werden übersprungen, damit ein gemischtes Dokument nicht dadurch schlechter wird, dass die ohnehin guten Teile erneut erkannt werden. Der Rest wird in der von dir gewählten Sprache erkannt, und das Ergebnis wird hinter das ursprüngliche Bild geschrieben, das unangetastet bleibt.
Häufige Fragen
Welche Sprachen kann es erkennen?
Die Sprachen, die auf unserem Verarbeitungsserver installiert sind und die die Auswahl auf dieser Seite auflistet — derzeit Arabisch, Chinesisch (vereinfacht), Deutsch, Englisch, Französisch, Portugiesisch und Spanisch. Angeboten werden nur tatsächlich installierte Sprachen, alles aus dieser Liste funktioniert also.
Sieht die Seite danach anders aus?
Nein. Das ursprüngliche Bild bleibt genau wie es war, und der erkannte Text wird unsichtbar dahinter platziert. Was sich ändert: Die Datei lässt sich jetzt durchsuchen und daraus kopieren.
Wie genau ist die Erkennung?
Das hängt fast ausschließlich vom Scan ab. Gerader, sauberer, gedruckter Text bei rund 300 DPI wird sehr gut erkannt. Eine schiefe Seite, eine schräg aufgenommene Fotografie, ein verblasstes Fax oder eine handschriftliche Notiz erzeugen Fehler. Lies alles korrektur, wo eine falsche Ziffer zählen würde.
Was, wenn mein Dokument nur teilweise gescannt ist?
Das wird berücksichtigt. Seiten, die bereits Text enthalten, bleiben unangetastet, und nur die gescannten Seiten werden erkannt; ein Bericht mit angehängten gescannten Anlagen kommt also mit durchsuchbaren Anlagen und unverändertem Rest zurück.
Ich habe die falsche Sprache gewählt, und das Ergebnis ist Unsinn.
Lass es mit der richtigen noch einmal laufen. Die Erkennung gleicht Formen gegen ein Sprachmodell ab, eine französische Seite als Englisch gelesen erzeugt also selbstbewusst aussehendes Kauderwelsch. Der ursprüngliche Scan ist unverändert, es gibt also nichts rückgängig zu machen.
Mehr dazu lesen
Mach mit deinem PDF weiter
Deine Datei ist fertig. Das sind die Dinge, die man danach meistens macht.