Zum Inhalt springen

PDF OCR — Text aus gescanntem PDF extrahieren, gratis

Kostenlose PDF-OCR: Text aus gescannten PDFs oder reinen Bild-PDFs extrahieren, bis zu 20 Seiten pro Durchlauf, im Browser. OCR-Engine lädt per CDN.

Im Browser konvertieren · Ohne Registrierung

PDF bis 30 MB. OCR verarbeitet bis zu 20 Seiten auf einmal.

Bilder (PNG, JPG, WebP, AVIF) gehen auch: einfach hier ablegen.

Du kannst auch einen Screenshot mit Strg+V (⌘V auf dem Mac) einfügen.

Beim ersten Mal lädt dein Browser die OCR-Engine und die Daten der gewählten Sprache (mehrere Megabyte) von einem öffentlichen CDN und speichert sie im Cache. Dein Bild selbst wird nie hochgeladen.

Anwendung

  1. Wähle ein gescanntes PDF aus (bis 30 MB).
  2. Wähle die Sprache des Texts und die zu lesenden Seiten, zum Beispiel 1-3, 5 (bis zu 20 Seiten pro Durchlauf).
  3. Klicke auf „Text extrahieren“ und bearbeite, kopiere oder lade das Ergebnis als .txt-Datei herunter.

Beispiel

Ein gescannter Vertrag mit 3 Seiten, Seiten 1-3 → "--- Seite 1 ---\nVERTRAG\nDieser Vertrag wird geschlossen…\n\n--- Seite 2 ---\n…" als bearbeitbarer Text, gespeichert als vertrag.txt.

Details und Einschränkungen

Die Seiten werden mit etwa 200 DPI gerendert und nacheinander mit tesseract.js in deinem Browser erkannt; das PDF wird nicht hochgeladen. OCR-Engine und Sprachdaten werden beim ersten Mal von einem öffentlichen CDN (jsDelivr) geladen und zwischengespeichert.

Enthält das PDF bereits markierbaren Text, kopiere ihn lieber direkt; OCR ist für gescannte Seiten oder reine Bildseiten gedacht. Passwortgeschützte PDFs werden nicht unterstützt, und das Ergebnis ist reiner Text ohne Layout.

FAQ

Wie extrahiere ich kostenlos Text aus einem gescannten PDF?

Wähle das PDF, die Sprache und die Seiten (bis zu 20 pro Durchlauf) und klicke auf „Text extrahieren“. Das ist kostenlos, braucht kein Konto und läuft in deinem Browser. Bei längeren Dokumenten startest du einen weiteren Durchlauf mit dem nächsten Seitenbereich.

Kann es japanische oder chinesische PDFs mit vertikalem Text lesen?

Ja. Wähle Japanisch (vertikal), vereinfachtes Chinesisch (vertikal) oder traditionelles Chinesisch (vertikal). Für waagerechten Text nimm die normale Option für Japanisch oder Chinesisch.

Warum ist das Ergebnis leer oder voller Fehler?

OCR braucht klaren, gedruckten Text. Scans mit niedriger Auflösung, Handschrift, ungewöhnliche Schriften oder eine falsche Spracheinstellung verringern die Genauigkeit. Prüfe, ob die Sprache zum Dokument passt, und versuch es mit einem saubereren Scan.

Formatreferenzen

Tool-Seite aktualisiert: