PDF OCR
Mache aus einem gescannten PDF ein durchsuchbares. Die Texterkennung läuft lokal in deinem Browser, die Datei verlässt dein Gerät nicht.
Nichts wird hochgeladen
Die PDF-OCR-Engine läuft als WebAssembly in deinem Browser. Dein Scan wird nie an einen Server geschickt.
Sieh, was erkannt wurde
Jedes erkannte Wort wird auf der Seite hervorgehoben – so prüfst du das Ergebnis vor dem Download.
11 Sprachen
Lateinische, kyrillische und CJK-Schriften werden unterstützt, darunter Chinesisch, Japanisch, Koreanisch und Russisch.
Kostenlos, ohne Anmeldung
Kein Konto, kein Wasserzeichen, kein Seitenlimit. Die einzige echte Grenze ist der Arbeitsspeicher deines Geräts.
Kurz gesagt: PDF OCR liest den Text von einer gescannten Seite und schreibt ihn als unsichtbare Textebene zurück ins PDF. Die Seite sieht exakt gleich aus, aber du kannst sie endlich durchsuchen, markieren und kopieren. Dieses Werkzeug erledigt das komplett in deinem Browser.
Warum gescannte PDFs deinen Arbeitsablauf blockieren
Ein Kunde schickt einen Vertrag zurück. Du suchst eine Klausel. Du drückst Strg+F, tippst das Wort ein – und das PDF meldet null Treffer, obwohl das Wort direkt vor dir auf dem Bildschirm steht.
Das ist der Moment, in dem die meisten nach PDF OCR suchen. Das Dokument ist nicht kaputt. Es hat schlicht nie Text enthalten.
Ein Scan ist ein Bild, kein Dokument
Wenn ein Scanner oder eine Handykamera eine Seite erfasst, speichert er Pixel. Die Buchstaben, die du siehst, sind Formen, keine Zeichen. Für den PDF-Reader ist die ganze Seite ein einziges flaches Bild.
Was ohne Texterkennung fehlt
Keine Suche. Kein Kopieren und Einfügen. Keine Textmarkierung zum Zitieren. Screenreader lesen nichts vor. Dein Dokumentenmanagement indexiert eine leere Datei. All das setzt voraus, dass die Seite echte Zeichen enthält.
Wo es am meisten weh tut
Unterschriebene Verträge, Papierrechnungen, Belege, Arztbriefe, wissenschaftliche Aufsätze, alte Archive. Genau die Dokumente, die du später am dringendsten durchsuchen willst – und genau die, die als Scan ankommen.
Was ist PDF OCR?
PDF OCR bezeichnet das Auslesen von Text aus dem Bild einer gescannten Seite und das Zurückschreiben dieses Textes ins PDF als echte, unsichtbare Textebene – die Seite sieht unverändert aus, aber du kannst die Wörter jetzt suchen, markieren und kopieren.
OCR steht für optische Zeichenerkennung. Die Engine betrachtet die Formen auf der Seite, gleicht sie mit den Buchstabenformen einer Sprache ab und liefert Zeichen samt der exakten Position jedes Wortes.
So funktioniert die unsichtbare Textebene
Die erkannten Wörter werden im PDF-Textdarstellungsmodus 3 auf die Seite zurückgezeichnet – das bedeutet „zeichne diesen Text, aber zeige ihn nicht an“. Jedes Wort sitzt exakt über seinem Abbild im Scan.
Deshalb wirkt eine sauber per OCR bearbeitete Datei völlig unverändert und wird bei der Suche trotzdem korrekt hervorgehoben. Du markierst die unsichtbare Ebene, nicht das Bild.
Durchsuchbares PDF oder reine Textextraktion
Wann du ein durchsuchbares PDF willst
Wenn das Original erhalten bleiben muss – Unterschriften, Stempel, Briefkopf, Layout. Alles, was vorzeigbar oder rechtlich erkennbar bleiben soll, sollte ein PDF bleiben.
Wann dir der reine Text reicht
Du fügst es in eine E-Mail, eine Tabelle oder eine Notiz ein. Dann lass das PDF weg und nimm den Textexport. Dieses Werkzeug liefert beides in einem Durchgang.
Was OCR nicht reparieren kann
OCR liest, was da ist. Text, den der Scan verwischt hat, kann sie nicht zurückholen, und Korrektur liest sie auch nicht. Ein schiefes Foto mit niedriger Auflösung liefert schiefe Ergebnisse in schlechter Qualität.
In 3 Schritten OCR auf ein PDF anwenden
Der gesamte Vorgang läuft auf deinem eigenen Rechner. Keine Warteschlange, kein Upload, kein Wartezimmer.
- 1
Gescanntes PDF öffnen
Zieh die Datei auf das Feld oben oder wähle sie von deinem Gerät. Sie wird direkt in den Browser-Tab geladen – einen Upload-Schritt gibt es gar nicht.
- 2
Dokumentsprache wählen
Wähle die Sprache, die auf der Seite gedruckt ist, nicht deine Oberflächensprache. Die Engine lädt dieses Sprachpaket einmal herunter und behält es im Cache.
- 3
OCR starten und herunterladen
Sieh ihr Seite für Seite zu, prüfe die hervorgehobenen Wörter und nimm dann das durchsuchbare PDF oder den reinen Text. Beides entsteht lokal.
Praxistipp — Die Sprachwahl wiegt schwerer, als die meisten erwarten. Ein englischer Durchlauf über eine deutsche Seite zerlegt jeden Umlaut. Wenn das Ergebnis wie Kauderwelsch aussieht, liegt es meist an der Sprache.
Hinweis — Der erste Durchlauf mit einer neuen Sprache lädt ein Paket von unter 3 MB. Danach geht es sofort und funktioniert offline.
Sieh, was die OCR wirklich gelesen hat
Die meisten PDF-OCR-Werkzeuge geben dir eine Datei und wünschen viel Glück. Ob es geklappt hat, erfährst du erst nach dem Download, wenn du das PDF öffnest und selbst suchst.
Das ist ein schlechter Deal, denn die Scanqualität schwankt enorm und PDF OCR scheitert lautlos. Ein Werkzeug, das still und leise 60 % Genauigkeit liefert, sieht genauso aus wie eines mit 99 %.
Die Textebene, sichtbar gemacht
Schalte „Textebene anzeigen“ ein, und jedes erkannte Wort wird direkt auf der Seite umrahmt. Was du siehst, ist genau das, was ins PDF geschrieben wurde.
Einen schlechten Scan vor dem Download erkennen
Wörter, bei denen die Engine unsicher ist, werden rot markiert. Fahre über einen Rahmen, um zu sehen, was sie gelesen hat und wie sicher sie war.
Ein paar verstreute rote Rahmen sind normal. Eine überwiegend rote Seite heißt, dass etwas nicht stimmt – meist die falsche Sprache oder ein Scan, der mit höherer Auflösung wiederholt werden muss.
Was du mit einem durchsuchbaren PDF machen kannst
Sobald die Textebene existiert, verhält sich das Dokument überall wie ein richtiges Dokument.
Im Dokument suchen
Strg+F funktioniert in jedem PDF-Reader auf jedem Gerät. Eine Klausel in einem 60-seitigen gescannten Vertrag zu finden, ist kein manuelles Scrollen mehr.
Kopieren und zitieren ohne Abtippen
Markiere einen Absatz und füge ihn in eine E-Mail oder einen Bericht ein. Kein Abschreiben, keine dabei entstehenden Tippfehler.
Scans barrierefrei machen
Screenreader können nur eine Textebene vorlesen. OCR ist oft die größte Verbesserung der Barrierefreiheit, die du einem Scan-Archiv verpassen kannst.
Sauberen Text an andere Werkzeuge geben
Suchindizes, Notiz-Apps, Übersetzer und Tabellen brauchen Zeichen, keine Pixel. Der Textexport passt direkt hinein.
Dein Scan verlässt diesen Tab nicht
Gescannte Dokumente sind meist die sensibelsten Dateien, die man besitzt: unterschriebene Verträge, Ausweise, Steuerunterlagen, Arztbriefe. Die auf einen fremden Server zu laden, nur damit sie durchsuchbar werden, ist ein seltsamer Tausch.
Dieses Werkzeug lädt die PDF-OCR-Engine als WebAssembly in deinen Browser und führt sie dort aus. Die Sprachpakete kommen von unserem Server, dein Dokument geht aber nirgendwohin. Du kannst die Netzwerkverbindung nach dem Laden der Seite trennen – die Arbeit wird trotzdem fertig.
PDF OCR im Browser gegenüber Upload-basierten OCR-Diensten
Lokale Verarbeitung ist bei privaten Dokumenten die richtige Voreinstellung, aber sie ist nicht ohne Kompromisse. Hier der ehrliche Vergleich.
| Aspekt | Dieses Werkzeug (im Browser) | OCR-Dienste mit Upload |
|---|---|---|
| Wohin deine Datei geht | Verlässt dein Gerät nie | Wird auf einen fremden Server geladen |
| Funktioniert offline | Ja, nach dem ersten Laden | Nein |
| Größenbegrenzung | Begrenzt durch deinen Arbeitsspeicher | Begrenzt durch den Tarif des Anbieters |
| Konto nötig | Nein | Bei größeren Dateien oft ja |
| Tempo bei sehr großen PDFs | Langsamer – nutzt deine CPU | Schneller – nutzt deren Server |
| Genauigkeit bei schwierigen Scans | Gut bei sauberem Druck | Oft besser – kommerzielle Engines |
Die letzten beiden Zeilen sind ernst gemeint. Ein kommerzieller Dienst mit optimierter Engine schlägt eine Open-Source-Engine bei einem zerknitterten Fax von 1998, und eine Serverfarm ist bei einer 500-Seiten-Datei immer schneller als ein Laptop. Wenn dein Dokument nicht sensibel ist und Genauigkeit bei schlechten Scans wichtiger ist als Datenschutz, nimm einen solchen Dienst.
So erreichst du die beste OCR-Genauigkeit
Die Qualität von PDF OCR entscheidet sich größtenteils, bevor du den Knopf drückst. Diese vier Punkte erklären fast den ganzen Unterschied.
- 1
Mit 300 dpi oder mehr scannen
Das ist der wichtigste Einzelfaktor. Bei 150 dpi verschmelzen die Zeichenkanten, bei 72 dpi raten die meisten Engines. 300 dpi ist der Standardwert für Texterkennung.
- 2
Seite zuerst geraderichten und säubern
Schon zwei Grad Schieflage senken die Genauigkeit messbar. Aktiviere das Geraderichten bei schiefen Scans und die Hintergrundbereinigung bei grauen oder fleckigen.
- 3
Eine Sprache pro Durchlauf
Gemischte Sprachpakete verwässern die Genauigkeit. Ist ein Dokument überwiegend englisch mit ein paar französischen Namen, lass es als Englisch laufen.
- 4
Textebene prüfen, dann neu laufen lassen
Sieh dir die hervorgehobenen Wörter vor dem Download an. Ist eine Seite voller roter Rahmen, ändere Sprache oder Scaneinstellungen und starte erneut – es kostet dich nichts.
Komplettes PDF-Werkzeugpaket
Entdecken Sie unsere umfassende Sammlung an PDF-Werkzeugen für all Ihre Dokumentenaufgaben
PNG in PDF
PNG-Bilder zu einer druckfertigen PDF zusammenfassen
JPG in PDF
JPG-Bilder ins PDF-Format umwandeln
PDF zusammenfügen
Mehrere PDF-Dateien zu einer zusammenfügen
PDF komprimieren
PDF-Dateigröße effizient verringern
PDF in PNG
PDF-Seiten in PNG-Bilder umwandeln
PDF in JPG
PDF-Seiten in JPG-Bilder umwandeln
PDF in Text
Textinhalt aus PDF-Dateien extrahieren
PDF teilen
PDF in einzelne Seiten teilen
PDF bearbeiten
PDF-Dokumente bearbeiten und kommentieren
PDF organisieren
PDF-Seiten organisieren und neu anordnen
PDF drehen
PDF-Seiten drehen und dauerhaft speichern
Seitenzahlen
Seitenzahlen mit Live-Vorschau in PDF einfügen
PDF-Wasserzeichen
Text-Wasserzeichen mit Live-Vorschau in PDF einfügen
HEIC in JPG
iPhone-HEIC-Fotos in JPG umwandeln
PDF Seiten löschen
Unerwünschte Seiten entfernen und eine saubere PDF herunterladen
PDF Seiten extrahieren
Ausgewählte Seiten als neue PDF oder einzelne Dateien speichern
PDF unterschreiben
Unterschrift zeichnen, tippen oder hochladen und auf jeder Seite platzieren
PDF Seitengröße ändern
Seitengröße auf A4, Letter oder eigene Maße ändern
PDF zuschneiden
Ränder beschneiden, per Ziehen auswählen oder weiße Ränder automatisch zuschneiden
PDF reduzieren
Formulare schreibgeschützt machen — Text durchsuchbar halten oder auf ein Bild reduzieren
PDF-Metadaten
Autor, Titel, Datumsangaben und weitere Metadaten ansehen, bearbeiten oder entfernen
PDF in Graustufen
In Graustufen oder Schwarzweiß umwandeln, um Farbtinte zu sparen
Bilder aus PDF extrahieren
Eingebettete Fotos aus einer PDF herausziehen und als PNG oder JPG speichern
WebP in PDF
WebP-Bilder in eine PDF umwandeln, mehrere zu einer Datei zusammenführen
PDF schützen
Ihre PDF mit einem Öffnungspasswort versehen – komplett im Browser
PDF entsperren
Ein bekanntes Passwort oder Beschränkungen aus einer PDF entfernen – im Browser
HEIC in PDF
iPhone-HEIC-Fotos in PDF umwandeln
AVIF in PDF
AVIF-Bilder in PDF umwandeln
TIFF in PDF
TIFF-Bilder und Scans in PDF umwandeln
BMP in PDF
BMP-Bitmaps in PDF umwandeln
PDF OCR
Mache ein gescanntes PDF durchsuchbar, komplett im Browser
PDF schwärzen
Entferne sensible Inhalte dauerhaft aus einem PDF, direkt im Browser
Bild komprimieren
Verkleinere JPEG, PNG und WebP im Stapel, komplett im Browser
Bild skalieren
Ändere Bildmaße im Stapel, mit Vorlagen, direkt im Browser
Häufige Fragen
Alles, was vor der Texterkennung eines Scans gefragt wird.
Wie wendet man OCR kostenlos auf ein PDF an?
Datei oben öffnen, Dokumentsprache wählen und auf „OCR starten“ klicken. Der ganze Vorgang läuft in diesem Browser-Tab und kostet nichts. Du bekommst ein durchsuchbares PDF und eine Textdatei – ohne Konto und ohne Seitenlimit.
Ist dieses PDF-OCR-Werkzeug wirklich kostenlos? Wo ist die Grenze?
Es ist kostenlos, ohne Seitenobergrenze und ohne Wasserzeichen. Wir setzen kein Kontingent, weil wir die Kosten nicht tragen – die Arbeit macht dein Gerät. Die praktische Grenze ist der Speicher: Sehr große Scans können auf einem älteren Handy den Speicher sprengen. Dann lieber einen Seitenbereich statt der ganzen Datei verarbeiten.
Werden meine Dateien auf einen Server hochgeladen?
Nein. Dein PDF verlässt den Browser nicht. Die OCR-Engine ist WebAssembly und läuft lokal. Von uns geladen werden nur die Engine und das Sprachpaket. Du kannst das prüfen, indem du nach dem Laden der Seite die Netzwerkverbindung trennst – die OCR läuft weiter.
Wie genau ist die PDF OCR?
Sehr gut bei sauberem Druck, schwächer bei Handschrift und schlechten Scans. Ein 300-dpi-Scan von normalem Drucktext wird typischerweise über neunzig Prozent genau erkannt. Handschrift, verblasstes Faxpapier, dichte Tabellen und Fotos mit niedriger Auflösung verschlechtern das Ergebnis schnell. Beurteile dein eigenes Dokument mit der Textebenen-Ansicht, statt einem Durchschnittswert zu vertrauen.
Kann ich ein gescanntes PDF per OCR in Word umwandeln?
Nicht direkt – dieses Werkzeug erzeugt ein durchsuchbares PDF und reinen Text, kein .docx. In den meisten Fällen ist der Textexport genau das, was du eigentlich brauchst, und du kannst ihn direkt in ein Dokument einfügen. Wenn du nur den Text allein willst, deckt unser PDF-zu-Text-Werkzeug diesen Fall ab.
Welche Sprachen unterstützt die PDF OCR?
Elf, für lateinische, kyrillische und CJK-Schriften. Englisch, vereinfachtes und traditionelles Chinesisch, Spanisch, Portugiesisch, Deutsch, Französisch, Italienisch, Japanisch, Koreanisch und Russisch. Nicht-lateinische Schriften bekommen eine vollständige Textebene, chinesische und russische Scans sind also wirklich durchsuchbar und nicht nur teilweise.
Warum ist der erste Durchlauf langsamer als der zweite?
Beim ersten Mal werden Engine und Sprachpaket geladen. Danach liegen beide im Browser-Cache, spätere Durchläufe starten sofort und funktionieren ohne Netz. Der Wechsel zu einer neuen Sprache lädt dieses Paket einmal nach.
Was mache ich, nachdem ich OCR auf ein PDF angewendet habe?
Meist komprimieren oder den Text herausziehen. Die Textebene fügt nur ein paar Kilobyte pro Seite hinzu, aber der Scan darunter ist oft groß. Wer danach komprimiert, behält die Durchsuchbarkeit und verkleinert die Datei.
Passende Werkzeuge
Was du mit demselben Dokument sonst noch machen könntest.
- PDF zu Text — zieh den Text aus einem PDF, das schon eine Textebene hat.
- PDF komprimieren — verkleinere den Scan nach der OCR, ohne die Textebene zu verlieren.
- PDF zu PNG — exportiere Seiten als Bilder, wenn du sie vor einem neuen Scan aufbereiten willst.
- PDF in Graustufen — nimm einem verrauschten Scan die Farbe – das hilft der Erkennung oft.
- PDF zusammenfügen — fasse mehrere gescannte Seiten zu einem Dokument zusammen, bevor du OCR startest.
- PDF schwärzen — entferne sensible Stellen, sobald der Scan durchsuchbar ist.
Mach deine Scans durchsuchbar
Wende OCR direkt hier im Browser auf ein PDF an. Ohne Upload, ohne Konto, ohne Seitenlimit.
PDF-OCR-Werkzeug öffnen