Läuft in Ihrem Browser

PDF OCR

Mache aus einem gescannten PDF ein durchsuchbares. Die Texterkennung läuft lokal in deinem Browser, die Datei verlässt dein Gerät nicht.

Lokale Verarbeitung0 Uploads~1,2 s im SchnittKein Konto nötig

Nichts wird hochgeladen

Die PDF-OCR-Engine läuft als WebAssembly in deinem Browser. Dein Scan wird nie an einen Server geschickt.

Sieh, was erkannt wurde

Jedes erkannte Wort wird auf der Seite hervorgehoben – so prüfst du das Ergebnis vor dem Download.

11 Sprachen

Lateinische, kyrillische und CJK-Schriften werden unterstützt, darunter Chinesisch, Japanisch, Koreanisch und Russisch.

Kostenlos, ohne Anmeldung

Kein Konto, kein Wasserzeichen, kein Seitenlimit. Die einzige echte Grenze ist der Arbeitsspeicher deines Geräts.

Kurz gesagt: PDF OCR liest den Text von einer gescannten Seite und schreibt ihn als unsichtbare Textebene zurück ins PDF. Die Seite sieht exakt gleich aus, aber du kannst sie endlich durchsuchen, markieren und kopieren. Dieses Werkzeug erledigt das komplett in deinem Browser.

Warum gescannte PDFs deinen Arbeitsablauf blockieren

Ein Kunde schickt einen Vertrag zurück. Du suchst eine Klausel. Du drückst Strg+F, tippst das Wort ein – und das PDF meldet null Treffer, obwohl das Wort direkt vor dir auf dem Bildschirm steht.

Das ist der Moment, in dem die meisten nach PDF OCR suchen. Das Dokument ist nicht kaputt. Es hat schlicht nie Text enthalten.

Ein Scan ist ein Bild, kein Dokument

Wenn ein Scanner oder eine Handykamera eine Seite erfasst, speichert er Pixel. Die Buchstaben, die du siehst, sind Formen, keine Zeichen. Für den PDF-Reader ist die ganze Seite ein einziges flaches Bild.

Was ohne Texterkennung fehlt

Keine Suche. Kein Kopieren und Einfügen. Keine Textmarkierung zum Zitieren. Screenreader lesen nichts vor. Dein Dokumentenmanagement indexiert eine leere Datei. All das setzt voraus, dass die Seite echte Zeichen enthält.

Wo es am meisten weh tut

Unterschriebene Verträge, Papierrechnungen, Belege, Arztbriefe, wissenschaftliche Aufsätze, alte Archive. Genau die Dokumente, die du später am dringendsten durchsuchen willst – und genau die, die als Scan ankommen.

Was ist PDF OCR?

PDF OCR bezeichnet das Auslesen von Text aus dem Bild einer gescannten Seite und das Zurückschreiben dieses Textes ins PDF als echte, unsichtbare Textebene – die Seite sieht unverändert aus, aber du kannst die Wörter jetzt suchen, markieren und kopieren.

OCR steht für optische Zeichenerkennung. Die Engine betrachtet die Formen auf der Seite, gleicht sie mit den Buchstabenformen einer Sprache ab und liefert Zeichen samt der exakten Position jedes Wortes.

So funktioniert die unsichtbare Textebene

Die erkannten Wörter werden im PDF-Textdarstellungsmodus 3 auf die Seite zurückgezeichnet – das bedeutet „zeichne diesen Text, aber zeige ihn nicht an“. Jedes Wort sitzt exakt über seinem Abbild im Scan.

Deshalb wirkt eine sauber per OCR bearbeitete Datei völlig unverändert und wird bei der Suche trotzdem korrekt hervorgehoben. Du markierst die unsichtbare Ebene, nicht das Bild.

Durchsuchbares PDF oder reine Textextraktion

Wann du ein durchsuchbares PDF willst

Wenn das Original erhalten bleiben muss – Unterschriften, Stempel, Briefkopf, Layout. Alles, was vorzeigbar oder rechtlich erkennbar bleiben soll, sollte ein PDF bleiben.

Wann dir der reine Text reicht

Du fügst es in eine E-Mail, eine Tabelle oder eine Notiz ein. Dann lass das PDF weg und nimm den Textexport. Dieses Werkzeug liefert beides in einem Durchgang.

Was OCR nicht reparieren kann

OCR liest, was da ist. Text, den der Scan verwischt hat, kann sie nicht zurückholen, und Korrektur liest sie auch nicht. Ein schiefes Foto mit niedriger Auflösung liefert schiefe Ergebnisse in schlechter Qualität.

In 3 Schritten OCR auf ein PDF anwenden

Der gesamte Vorgang läuft auf deinem eigenen Rechner. Keine Warteschlange, kein Upload, kein Wartezimmer.

  1. 1

    Gescanntes PDF öffnen

    Zieh die Datei auf das Feld oben oder wähle sie von deinem Gerät. Sie wird direkt in den Browser-Tab geladen – einen Upload-Schritt gibt es gar nicht.

  2. 2

    Dokumentsprache wählen

    Wähle die Sprache, die auf der Seite gedruckt ist, nicht deine Oberflächensprache. Die Engine lädt dieses Sprachpaket einmal herunter und behält es im Cache.

  3. 3

    OCR starten und herunterladen

    Sieh ihr Seite für Seite zu, prüfe die hervorgehobenen Wörter und nimm dann das durchsuchbare PDF oder den reinen Text. Beides entsteht lokal.

PraxistippDie Sprachwahl wiegt schwerer, als die meisten erwarten. Ein englischer Durchlauf über eine deutsche Seite zerlegt jeden Umlaut. Wenn das Ergebnis wie Kauderwelsch aussieht, liegt es meist an der Sprache.

HinweisDer erste Durchlauf mit einer neuen Sprache lädt ein Paket von unter 3 MB. Danach geht es sofort und funktioniert offline.

Sieh, was die OCR wirklich gelesen hat

Die meisten PDF-OCR-Werkzeuge geben dir eine Datei und wünschen viel Glück. Ob es geklappt hat, erfährst du erst nach dem Download, wenn du das PDF öffnest und selbst suchst.

Das ist ein schlechter Deal, denn die Scanqualität schwankt enorm und PDF OCR scheitert lautlos. Ein Werkzeug, das still und leise 60 % Genauigkeit liefert, sieht genauso aus wie eines mit 99 %.

Die Textebene, sichtbar gemacht

Schalte „Textebene anzeigen“ ein, und jedes erkannte Wort wird direkt auf der Seite umrahmt. Was du siehst, ist genau das, was ins PDF geschrieben wurde.

Einen schlechten Scan vor dem Download erkennen

Wörter, bei denen die Engine unsicher ist, werden rot markiert. Fahre über einen Rahmen, um zu sehen, was sie gelesen hat und wie sicher sie war.

Ein paar verstreute rote Rahmen sind normal. Eine überwiegend rote Seite heißt, dass etwas nicht stimmt – meist die falsche Sprache oder ein Scan, der mit höherer Auflösung wiederholt werden muss.

Was du mit einem durchsuchbaren PDF machen kannst

Sobald die Textebene existiert, verhält sich das Dokument überall wie ein richtiges Dokument.

Im Dokument suchen

Strg+F funktioniert in jedem PDF-Reader auf jedem Gerät. Eine Klausel in einem 60-seitigen gescannten Vertrag zu finden, ist kein manuelles Scrollen mehr.

Kopieren und zitieren ohne Abtippen

Markiere einen Absatz und füge ihn in eine E-Mail oder einen Bericht ein. Kein Abschreiben, keine dabei entstehenden Tippfehler.

Scans barrierefrei machen

Screenreader können nur eine Textebene vorlesen. OCR ist oft die größte Verbesserung der Barrierefreiheit, die du einem Scan-Archiv verpassen kannst.

Sauberen Text an andere Werkzeuge geben

Suchindizes, Notiz-Apps, Übersetzer und Tabellen brauchen Zeichen, keine Pixel. Der Textexport passt direkt hinein.

Dein Scan verlässt diesen Tab nicht

Gescannte Dokumente sind meist die sensibelsten Dateien, die man besitzt: unterschriebene Verträge, Ausweise, Steuerunterlagen, Arztbriefe. Die auf einen fremden Server zu laden, nur damit sie durchsuchbar werden, ist ein seltsamer Tausch.

Dieses Werkzeug lädt die PDF-OCR-Engine als WebAssembly in deinen Browser und führt sie dort aus. Die Sprachpakete kommen von unserem Server, dein Dokument geht aber nirgendwohin. Du kannst die Netzwerkverbindung nach dem Laden der Seite trennen – die Arbeit wird trotzdem fertig.

PDF OCR im Browser gegenüber Upload-basierten OCR-Diensten

Lokale Verarbeitung ist bei privaten Dokumenten die richtige Voreinstellung, aber sie ist nicht ohne Kompromisse. Hier der ehrliche Vergleich.

AspektDieses Werkzeug (im Browser)OCR-Dienste mit Upload
Wohin deine Datei gehtVerlässt dein Gerät nieWird auf einen fremden Server geladen
Funktioniert offlineJa, nach dem ersten LadenNein
GrößenbegrenzungBegrenzt durch deinen ArbeitsspeicherBegrenzt durch den Tarif des Anbieters
Konto nötigNeinBei größeren Dateien oft ja
Tempo bei sehr großen PDFsLangsamer – nutzt deine CPUSchneller – nutzt deren Server
Genauigkeit bei schwierigen ScansGut bei sauberem DruckOft besser – kommerzielle Engines

Die letzten beiden Zeilen sind ernst gemeint. Ein kommerzieller Dienst mit optimierter Engine schlägt eine Open-Source-Engine bei einem zerknitterten Fax von 1998, und eine Serverfarm ist bei einer 500-Seiten-Datei immer schneller als ein Laptop. Wenn dein Dokument nicht sensibel ist und Genauigkeit bei schlechten Scans wichtiger ist als Datenschutz, nimm einen solchen Dienst.

So erreichst du die beste OCR-Genauigkeit

Die Qualität von PDF OCR entscheidet sich größtenteils, bevor du den Knopf drückst. Diese vier Punkte erklären fast den ganzen Unterschied.

  1. 1

    Mit 300 dpi oder mehr scannen

    Das ist der wichtigste Einzelfaktor. Bei 150 dpi verschmelzen die Zeichenkanten, bei 72 dpi raten die meisten Engines. 300 dpi ist der Standardwert für Texterkennung.

  2. 2

    Seite zuerst geraderichten und säubern

    Schon zwei Grad Schieflage senken die Genauigkeit messbar. Aktiviere das Geraderichten bei schiefen Scans und die Hintergrundbereinigung bei grauen oder fleckigen.

  3. 3

    Eine Sprache pro Durchlauf

    Gemischte Sprachpakete verwässern die Genauigkeit. Ist ein Dokument überwiegend englisch mit ein paar französischen Namen, lass es als Englisch laufen.

  4. 4

    Textebene prüfen, dann neu laufen lassen

    Sieh dir die hervorgehobenen Wörter vor dem Download an. Ist eine Seite voller roter Rahmen, ändere Sprache oder Scaneinstellungen und starte erneut – es kostet dich nichts.

Alle Werkzeuge sind 100 % kostenlos und sicher

Komplettes PDF-Werkzeugpaket

Entdecken Sie unsere umfassende Sammlung an PDF-Werkzeugen für all Ihre Dokumentenaufgaben

Werkzeugübersicht · 34
01

PNG in PDF

PNG-Bilder zu einer druckfertigen PDF zusammenfassen

Avg 1.2sLokal
02

JPG in PDF

JPG-Bilder ins PDF-Format umwandeln

Avg 1.4sLokal
03

PDF zusammenfügen

Mehrere PDF-Dateien zu einer zusammenfügen

Avg 0.8sLokal
04

PDF komprimieren

PDF-Dateigröße effizient verringern

Avg 2.1sLokal
05

PDF in PNG

PDF-Seiten in PNG-Bilder umwandeln

Avg 1.6sLokal
06

PDF in JPG

PDF-Seiten in JPG-Bilder umwandeln

Avg 1.5sLokal
07

PDF in Text

Textinhalt aus PDF-Dateien extrahieren

Avg 0.9sLokal
08

PDF teilen

PDF in einzelne Seiten teilen

Avg 0.6sLokal
09

PDF bearbeiten

PDF-Dokumente bearbeiten und kommentieren

BetaLokal
10

PDF organisieren

PDF-Seiten organisieren und neu anordnen

Avg 0.7sLokal
11

PDF drehen

PDF-Seiten drehen und dauerhaft speichern

Avg 0.5sLokal
12

Seitenzahlen

Seitenzahlen mit Live-Vorschau in PDF einfügen

Avg 0.6sLokal
13

PDF-Wasserzeichen

Text-Wasserzeichen mit Live-Vorschau in PDF einfügen

Avg 0.6sLokal
14

HEIC in JPG

iPhone-HEIC-Fotos in JPG umwandeln

Avg 1.0sLokal
15

PDF Seiten löschen

Unerwünschte Seiten entfernen und eine saubere PDF herunterladen

Avg 0.5sLokal
16

PDF Seiten extrahieren

Ausgewählte Seiten als neue PDF oder einzelne Dateien speichern

Avg 0.5sLokal
17

PDF unterschreiben

Unterschrift zeichnen, tippen oder hochladen und auf jeder Seite platzieren

Avg 1.0sLokal
18

PDF Seitengröße ändern

Seitengröße auf A4, Letter oder eigene Maße ändern

Avg 0.6sLokal
19

PDF zuschneiden

Ränder beschneiden, per Ziehen auswählen oder weiße Ränder automatisch zuschneiden

Avg 0.6sLokal
20

PDF reduzieren

Formulare schreibgeschützt machen — Text durchsuchbar halten oder auf ein Bild reduzieren

Avg 0.7sLokal
21

PDF-Metadaten

Autor, Titel, Datumsangaben und weitere Metadaten ansehen, bearbeiten oder entfernen

Avg 0.4sLokal
22

PDF in Graustufen

In Graustufen oder Schwarzweiß umwandeln, um Farbtinte zu sparen

Avg 1.8sLokal
23

Bilder aus PDF extrahieren

Eingebettete Fotos aus einer PDF herausziehen und als PNG oder JPG speichern

Avg 0.9sLokal
24

WebP in PDF

WebP-Bilder in eine PDF umwandeln, mehrere zu einer Datei zusammenführen

Avg 0.7sLokal
25

PDF schützen

Ihre PDF mit einem Öffnungspasswort versehen – komplett im Browser

Avg 0.3sLokal
26

PDF entsperren

Ein bekanntes Passwort oder Beschränkungen aus einer PDF entfernen – im Browser

Avg 1.5sLokal
27

HEIC in PDF

iPhone-HEIC-Fotos in PDF umwandeln

Avg 0.8sLokal
28

AVIF in PDF

AVIF-Bilder in PDF umwandeln

Avg 0.7sLokal
29

TIFF in PDF

TIFF-Bilder und Scans in PDF umwandeln

Avg 1.0sLokal
30

BMP in PDF

BMP-Bitmaps in PDF umwandeln

Avg 0.7sLokal
31

PDF OCR

Mache ein gescanntes PDF durchsuchbar, komplett im Browser

Avg 2s/pageLokal
32

PDF schwärzen

Entferne sensible Inhalte dauerhaft aus einem PDF, direkt im Browser

Avg 0.3s/pageLokal
33

Bild komprimieren

Verkleinere JPEG, PNG und WebP im Stapel, komplett im Browser

Avg 0.2sLokal
34

Bild skalieren

Ändere Bildmaße im Stapel, mit Vorlagen, direkt im Browser

Avg 0.2sLokal

Häufige Fragen

Alles, was vor der Texterkennung eines Scans gefragt wird.

Wie wendet man OCR kostenlos auf ein PDF an?

Datei oben öffnen, Dokumentsprache wählen und auf „OCR starten“ klicken. Der ganze Vorgang läuft in diesem Browser-Tab und kostet nichts. Du bekommst ein durchsuchbares PDF und eine Textdatei – ohne Konto und ohne Seitenlimit.

Ist dieses PDF-OCR-Werkzeug wirklich kostenlos? Wo ist die Grenze?

Es ist kostenlos, ohne Seitenobergrenze und ohne Wasserzeichen. Wir setzen kein Kontingent, weil wir die Kosten nicht tragen – die Arbeit macht dein Gerät. Die praktische Grenze ist der Speicher: Sehr große Scans können auf einem älteren Handy den Speicher sprengen. Dann lieber einen Seitenbereich statt der ganzen Datei verarbeiten.

Werden meine Dateien auf einen Server hochgeladen?

Nein. Dein PDF verlässt den Browser nicht. Die OCR-Engine ist WebAssembly und läuft lokal. Von uns geladen werden nur die Engine und das Sprachpaket. Du kannst das prüfen, indem du nach dem Laden der Seite die Netzwerkverbindung trennst – die OCR läuft weiter.

Wie genau ist die PDF OCR?

Sehr gut bei sauberem Druck, schwächer bei Handschrift und schlechten Scans. Ein 300-dpi-Scan von normalem Drucktext wird typischerweise über neunzig Prozent genau erkannt. Handschrift, verblasstes Faxpapier, dichte Tabellen und Fotos mit niedriger Auflösung verschlechtern das Ergebnis schnell. Beurteile dein eigenes Dokument mit der Textebenen-Ansicht, statt einem Durchschnittswert zu vertrauen.

Kann ich ein gescanntes PDF per OCR in Word umwandeln?

Nicht direkt – dieses Werkzeug erzeugt ein durchsuchbares PDF und reinen Text, kein .docx. In den meisten Fällen ist der Textexport genau das, was du eigentlich brauchst, und du kannst ihn direkt in ein Dokument einfügen. Wenn du nur den Text allein willst, deckt unser PDF-zu-Text-Werkzeug diesen Fall ab.

Welche Sprachen unterstützt die PDF OCR?

Elf, für lateinische, kyrillische und CJK-Schriften. Englisch, vereinfachtes und traditionelles Chinesisch, Spanisch, Portugiesisch, Deutsch, Französisch, Italienisch, Japanisch, Koreanisch und Russisch. Nicht-lateinische Schriften bekommen eine vollständige Textebene, chinesische und russische Scans sind also wirklich durchsuchbar und nicht nur teilweise.

Warum ist der erste Durchlauf langsamer als der zweite?

Beim ersten Mal werden Engine und Sprachpaket geladen. Danach liegen beide im Browser-Cache, spätere Durchläufe starten sofort und funktionieren ohne Netz. Der Wechsel zu einer neuen Sprache lädt dieses Paket einmal nach.

Was mache ich, nachdem ich OCR auf ein PDF angewendet habe?

Meist komprimieren oder den Text herausziehen. Die Textebene fügt nur ein paar Kilobyte pro Seite hinzu, aber der Scan darunter ist oft groß. Wer danach komprimiert, behält die Durchsuchbarkeit und verkleinert die Datei.

Passende Werkzeuge

Was du mit demselben Dokument sonst noch machen könntest.

  • PDF zu Text zieh den Text aus einem PDF, das schon eine Textebene hat.
  • PDF komprimieren verkleinere den Scan nach der OCR, ohne die Textebene zu verlieren.
  • PDF zu PNG exportiere Seiten als Bilder, wenn du sie vor einem neuen Scan aufbereiten willst.
  • PDF in Graustufen nimm einem verrauschten Scan die Farbe – das hilft der Erkennung oft.
  • PDF zusammenfügen fasse mehrere gescannte Seiten zu einem Dokument zusammen, bevor du OCR startest.
  • PDF schwärzen entferne sensible Stellen, sobald der Scan durchsuchbar ist.

Mach deine Scans durchsuchbar

Wende OCR direkt hier im Browser auf ein PDF an. Ohne Upload, ohne Konto, ohne Seitenlimit.

PDF-OCR-Werkzeug öffnen
PDF OCR kostenlos — Gescanntes PDF durchsuchbar machen