Warum eine PDF-Umwandlung scheitert und welcher Fehler es gerade ist
Warum ist meine PDF-Umwandlung fehlgeschlagen?
Speicher deine Lieblings-Tools
Leg ein kostenloses iBuildPDF-Konto an, um deine Lieblings-Tools zu behalten und jederzeit schnell wiederzufinden.
Kostenloses Konto. Die PDF-Tools selbst brauchen nie eins.
Kurze Antwort
Fast immer aus einem von fünf Gründen: Die Datei ist passwortgeschützt, sie hat keine Textebene, weil sie ein Scan ist, sie ist zu groß oder zu lang, um fertig zu werden, sie ist gar nicht der Dateityp, als der sie auftritt, oder bei uns ist etwas kaputtgegangen. Jeder verlangt eine völlig andere Reaktion — einer braucht ein Passwort, einer braucht OCR, einer braucht ein geteiltes Dokument, und einer braucht von dir überhaupt nichts. Ein Werkzeug, das dir nur sagt, dass etwas schiefging, lässt dich raten, welcher es war.
Fünf Fehler, die von außen gleich aussehen
Aus Sicht der Besucherin sieht jede gescheiterte Umwandlung gleich aus: Du hast gewartet, und dann ging es nicht. Darunter sind es keineswegs dieselben Vorgänge.
- Verschlüsselt. Das Dokument hat ein Passwort und das Werkzeug kann es nicht öffnen. An deiner Datei ist nichts kaputt.
- Keine Textebene. Die Seiten sind Bilder. Es gibt nichts, was sich in Text umwandeln ließe, die Ausgabe wäre leer.
- Zu groß oder zu lang. Die Arbeit kann innerhalb der Zeit, die eine Web-Anfrage leben darf, wirklich nicht fertig werden.
- Nicht die Datei, für die du sie hältst. Eine .pdf-Endung auf etwas, das kein PDF ist, oder ein PDF, das ein abgebrochener Download abgeschnitten hat.
- Unsere Seite. Der Umwandlungsdienst startete gerade neu, war überlastet oder hat einen Fehler.
Das ist wichtig, weil nur der letzte Fall von uns zu beheben ist und nur bei den ersten dreien du selbst etwas tun kannst. Sie auseinanderzuhalten ist die ganze Aufgabe einer guten Fehlermeldung, und deshalb nennen unsere Werkzeuge eine Ursache statt eines allgemeinen Fehlschlags, wo die Ursache tatsächlich bekannt ist.
Die Datei ist passwortgeschützt
Ein PDF kann zwei verschiedene Passwörter tragen, und sie scheitern unterschiedlich. Ein Öffnungspasswort bedeutet, dass der Inhalt verschlüsselt ist und ohne es nichts auch nur eine Seite lesen kann — jeder Konverter scheitert sofort, und das zu Recht. Ein Besitzerpasswort lässt die Datei lesbar, markiert sie aber als eingeschränkt, und manche Werkzeuge verweigern die Verarbeitung aus Prinzip, obwohl sie sie problemlos lesen könnten. Was ein PDF-Passwort wirklich schützt erklärt den Unterschied ordentlich.
Wenn du das Passwort kennst, entferne es zuerst und wandle dann das Ergebnis um. Wenn du es nicht kennst, kann dir kein Werkzeug helfen — das ist Verschlüsselung, die tut, wofür sie gebaut wurde, und alles, was bei einer modernen AES-verschlüsselten Datei etwas anderes behauptet, rät Passwörter oder lügt.
In der Datei ist kein Text
Das ist die häufigste Überraschung, denn eine gescannte Seite sieht am Bildschirm genauso aus wie eine getippte. Ein Foto oder Scan eines Dokuments enthält ein Bild von Wörtern und keine Wörter. Verlange davon eine Word- oder Excel-Ausgabe, und die ehrliche Antwort ist, dass es nichts zu extrahieren gibt.
Du kannst es in zwei Sekunden ohne jedes Werkzeug prüfen: Öffne das PDF und versuche, eine Textzeile mit dem Cursor zu markieren. Bekommst du ein Auswahlrechteck über die ganze Seite statt einer hervorgehobenen Zeile, ist es ein Bild. Auch Seitenzahl und Dateiinfo sagt dir, ob eine Textebene vorhanden ist.
Die Lösung ist OCR, das das Bild liest und darunter eine Textebene schreibt. Wandle die OCR-Datei um, nicht das Original. Beachte, dass OCR eine sehr gute Vermutung ist und keine Abschrift — OCR und PDF zu Word sind nicht dieselbe Aufgabe, und die Ziffern, die es verwechselt, sind genau die wichtigsten.
Zu groß, oder zu viel davon
Serverseitige Umwandlungen laufen in einem Zeitlimit, weil eine Web-Anfrage, die nie endet, für alle schlimmer ist als eine, die abbricht und es sagt. Ein sechshundertseitiges Dokument, eine Datei voller hochaufgelöster Scans oder eine Seite mit Zehntausenden einzelner Vektorobjekte können es zu Recht überschreiten.
Drei Dinge, die meistens helfen:
- Wandle einen Bereich statt der ganzen Datei um. Die meisten Werkzeuge hier nehmen eine Seitenauswahl, und die meisten Leute brauchen ohnehin nur einen Teil.
- Teile sie zuerst und wandle die Teile um.
- Komprimiere sie zuerst, wenn die Größe von Bildern kommt. PDF komprimieren bringt ein gescanntes Dokument oft von unmöglich zu alltäglich.
Eine Zeitüberschreitung wird hier als Zeitüberschreitung gemeldet und nicht als allgemeiner Fehler — genau damit dieser Absatz der ist, den du am Ende liest.
Wann wir es sind
Manche Fehler sind unsere, und das Nützliche daran ist, dass sie anders aussehen: Sie treffen Dateien, die gestern funktionierten, sie treffen mehrere Werkzeuge gleichzeitig, oder sie treten beim ersten Versuch auf und beim zweiten nicht.
Scheitert eine Umwandlung und dieselbe Datei läuft eine Minute später durch, hast du einen gerade neu startenden Dienst erwischt. Scheitert sie zweimal mit einer Datei, bei der du sicher bist, lohnt sich eine Nachricht an uns: Sag welches Werkzeug, ungefähr wie viele Seiten und was für ein Dokument. Bitte schick uns die Datei nicht. Wir wollen sie nicht und brauchen sie fast nie; zu wissen, was das Dokument ist, grenzt einen Fehler viel schneller ein als das Dokument selbst.
Werkzeuge, die im Browser laufen, scheitern noch einmal anders. Die laufen vollständig auf deinem Rechner, also halten ein älterer Browser, eine sehr große Datei bei knappem Speicher oder ein blockiertes Skript sie an, während jedes Server-Werkzeug weiterarbeitet.
Tools, um die es in diesem Artikel geht
Quellen
Primärdokumentation zu den Aussagen oben.