OCR für eine gescannte PDF

Lesen Sie die Wörter aus einer PDF, die eigentlich ein Bild einer Seite ist. Sie erhalten den Text und eine durchsuchbare Kopie des Originals mit einer unsichtbaren Textebene über dem Scan — sie sieht also genau gleich aus und Strg-F findet etwas. Deine Dateien werden niemals hochgeladen — alles läuft auf deinem Gerät.

  1. Your PDF

    Drop a scanned PDF here

    PDF

    Your files are never uploaded — everything runs on your device.

  2. Before you start

  3. Text

So führen Sie OCR für eine PDF aus

  1. Gescannte PDF öffnen

    Ziehen Sie sie hierher oder klicken Sie, um sie auszuwählen. Das Dokument wird hier im Browser gelesen — nichts wird hochgeladen, was bei der Art von Papierkram, die Menschen scannen, mehr zählt als sonst.

  2. Kosten prüfen

    Bevor etwas läuft, sehen Sie Seitenzahl, den einmaligen Modell-Download und eine Zeitspanne. Seiten, die bereits Text enthalten, werden übersprungen; hat jede Seite Text, sagt das Werkzeug das, statt zu laufen.

  3. Lesen und herunterladen

    Nehmen Sie den reinen Text oder die durchsuchbare PDF. Es meldet außerdem Seiten, die leer zurückkamen, statt stillschweigend Lücken im Ergebnis zu lassen.

Was du tun kannst

Zusammenfügen & Teilen

Kombiniere mehrere PDFs zu einer Datei oder extrahiere genau die Seiten, die du benötigst, als separate Datei.

Bilder → PDF

Füge JPG- oder PNG-Bilder per Drag-and-Drop hinzu – sie werden zu PDF-Seiten, die du zusammen mit deinen Dokumenten anordnen und als eine PDF herunterladen kannst.

PDF → Bilder

Exportiere Seiten auch umgekehrt: Wandle jede Seite (oder eine Auswahl) in PNG oder JPG um und lade sie gemeinsam als ZIP-Datei herunter.

Per Drag-and-Drop sortieren

Zieh eine Seite am Anfasser, um sie zu verschieben. Funktioniert mit der Maus und per Touchscreen – so kannst du deine Seiten auch auf dem Smartphone neu anordnen.

Drehen & Auto-rotate

Drehe jede Seite schrittweise um 90° oder lass schiefe und auf dem Kopf stehende Scans mit Auto-rotate automatisch erkennen und ausrichten.

Vorschau jeder Seite

Klicke auf eine Seite für eine gestochen scharfe Vollbild-Vorschau und gehe das Dokument vor dem Herunterladen durch.

Löschen & Extrahieren

Entferne nicht benötigte Seiten oder extrahiere einen Bereich, indem du Seiten auswählst und nur diese herunterlädst.

Komprimieren

Verkleinere eine PDF: verlustfrei neu speichern für auswählbaren Text oder stärkere Bildkomprimierung für Scans und bildlastige Dateien.

Privat und kostenlos

Keine Registrierung, keine Seitenbegrenzung, keine Wasserzeichen. Deine Dateien werden niemals hochgeladen – alle Aktionen laufen lokal in deinem Browser.

Häufige Fragen

Welche OCR-Engine ist das?
Tesseract, nach WebAssembly kompiliert und in Ihrem Browser ausgeführt — dieselbe Engine wie hinter unserem Bild-zu-Text-Werkzeug. Das Erkennungsmodell ist etwa 5 MB groß, wird einmal geladen und dann zwischengespeichert, sodass das zweite Dokument nichts extra kostet.
Was ist eine durchsuchbare PDF?
Ihr Scan, unverändert, mit den erkannten Wörtern als unsichtbarem Text darüber. Die Seiten sehen genau aus wie zuvor — wir rendern sie nicht neu, also überleben Bilddaten, Komprimierung und Lesezeichen — aber Strg-F, Kopieren und Einfügen und alles, was Text extrahiert, findet die Wörter jetzt.
Meine PDF hat schon Text. Soll ich das nutzen?
Nein, und das Werkzeug sagt Ihnen das. Trägt eine Seite bereits Text, ist dieser Text das, was das Dokument tatsächlich sagt; die Erkennung kann dieselben Wörter nur anhand ihrer Formen raten und wird einige davon falsch raten. Vorhandener Text wird unverändert übernommen, ein vollständig durchsuchbares Dokument geht stattdessen zum Markdown-Konverter.
Wie gut wird das Ergebnis?
Das hängt fast vollständig vom Scan ab. Sauberer, gerader schwarzer Text auf Weiß bei 300 dpi gelingt sehr gut; ein Handyfoto eines zerknitterten Kassenbons nicht. Es gibt hier keine Bildaufbereitung — kein Geraderücken, keine Kontrastkorrektur — was Sie hineingeben, wird gelesen. Die mittlere Konfidenz und etwaige leere Seiten werden gemeldet, damit Sie urteilen statt raten.
Beherrscht es andere Sprachen als Englisch?
Noch nicht. Das hier ausgelieferte Modell ist das englische. Ein Dokument in einer anderen Sprache liefert etwas, und dieses Etwas ist auf schwer erkennbare Weise falsch — behandeln Sie Englisch also als Grenze, nicht als Voreinstellung.
Werden meine PDFs auf einen Server hochgeladen?
Nein. Alle Aktionen werden vollständig in deinem Browser auf deinem eigenen Gerät ausgeführt. Deine Dateien werden niemals hochgeladen und nach dem Schließen des Tabs wird nichts gespeichert.
Ist das wirklich kostenlos? Gibt es Limits?
Ja, es ist vollkommen kostenlos und erfordert kein Konto. Es gibt keine Limitierungen bei Seiten- oder Dateianzahl und keine Wasserzeichen – da alles auf deinem Gerät verarbeitet wird, müssen wir nichts beschränken.