Läuft in Ihrem Browser

Bild in Text

Holen Sie den Text aus einem Foto, Screenshot oder Scan – direkt in Ihrem Browser. Nichts wird hochgeladen.

Lokale Verarbeitung0 Uploads~1,2 s im SchnittKein Konto nötig

Nichts wird hochgeladen

Die OCR-Engine läuft in dieser Seite. Ihr Ausweis, Ihre Rechnung oder Ihr Vertrag verlässt das Gerät nie.

Kleine Bilder werden vergrößert

Zu kleine Screenshots werden auf die Buchstabenhöhe skaliert, die die Engine braucht, statt Ihnen zurückgegeben zu werden.

Mehrere Sprachen gleichzeitig

Liest einen Screenshot mit gemischten Schriften in einem Durchgang, statt eine Sprache zu wählen und die Hälfte zu verlieren.

Bis zu 20 Bilder

Verarbeiten Sie einen ganzen Stapel und laden Sie alle Ergebnisse zusammen herunter. Kein Konto, kein Tageslimit.

Kurz gesagt: Um Text aus Bildern zu extrahieren, ziehen Sie ein Foto oder einen Screenshot hinein, wählen die enthaltene Sprache oder Sprachen und bekommen den Text zurück. Alles passiert in Ihrem Browser, es wird also nichts hochgeladen. Bei einem Scan oder einer schräg aufgenommenen Seite lassen Sie die Bereinigungsoptionen an – sie zählen mehr als die Wahl des Werkzeugs.

Warum dasselbe Foto auf verschiedenen Seiten verschiedene Ergebnisse liefert

Etwas, das die Werbeseiten nicht erwähnen: Die meisten kostenlosen Werkzeuge, die Text aus Bildern extrahieren, lassen dieselbe Open-Source-Engine laufen – Tesseract, kompiliert nach WebAssembly. Wir haben zehn geprüft, mindestens fünf sagen es selbst. Wenn also eine Seite sauberen Text liefert und eine andere Kauderwelsch aus demselben Foto, ist die Engine selten die Variable.

Was sich bei jeder Umwandlung von Bild in Text unterscheidet, ist das, was bei der Engine ankommt. Und der Faktor, der am meisten zählt, wird nirgends beworben: wie viele Pixel hoch die Buchstaben sind. Tesseract will rund 20 Pixel Höhe je Kleinbuchstabe. Ein Screenshot, der durch ein paar Messenger weitergereicht wurde, oder ein zum Hochladen verkleinertes Foto kommt oft mit der Hälfte an – und die Genauigkeit bricht ein.

Was die anderen Werkzeuge Ihnen raten

Neu aufnehmen. Bei den zehn getesteten lautet der übliche Rat bei einem schlechten Ergebnis, mit höherer Auflösung neu zu fotografieren oder neu zu screenshotten. Das ist vernünftig und völlig nutzlos, wenn dieses Bild das einzige ist, das Sie haben.

Diese Seite vergrößert ein zu kleines Bild stattdessen vor dem Lesen und sagt es Ihnen. Im Test kam ein Screenshot mit 400 mal 184 Pixeln – klein genug, dass die meisten Werkzeuge zum Neuanfang raten würden – mit 94% Zuverlässigkeit und jeder Zeile korrekt zurück. Vergrößern erfindet keine Details, die nie aufgenommen wurden, aber es gibt der Engine die Buchstabenhöhe, für die sie gebaut wurde.

Was OCR wirklich tut – und was nicht

Optische Zeichenerkennung betrachtet das Muster heller und dunkler Pixel in einem Bild und ermittelt, welche Zeichen diese Formen am wahrscheinlichsten darstellen. Sie liest oder versteht die Seite nicht – sie ordnet Formen Buchstaben zu, einen nach dem anderen.

Diese Unterscheidung erklärt fast jede Beschwerde über OCR. Sie erklärt, warum ein Wort in einer ungewöhnlichen Schrift falsch herauskommt, warum ein Buchstabe hinter einem Kaffeefleck zu einem anderen wird, und warum die Engine seelenruhig ein selbstbewusst aussehendes Wort ausgibt, das es gar nicht gibt. Es ist Mustervergleich, kein Verstehen.

Es erklärt auch, warum jedes Werkzeug, das Text aus Bildern extrahieren kann, für jedes einzelne ausgegebene Wort einen Zuverlässigkeitswert meldet. Diese Werte sind echte Information, und diese Seite zeigt sie: Fällt der Durchschnitt unter 70%, wird das Ergebnis gekennzeichnet, statt es Ihnen als sicher zu übergeben. Die meisten Werkzeuge verbergen das.

Wofür es tatsächlich benutzt wird

Screenshots und Fehlermeldungen

Text aus einem zugeschickten Screenshot kopieren oder aus einem Fehlerdialog, der sich partout nicht markieren lässt.

Belege und Rechnungen

Beträge und Belegnummern von einem abfotografierten Kassenzettel holen, statt sie in eine Tabelle abzutippen.

Abfotografierte Seiten

Aus dem Bild einer gedruckten Seite, eines Buchs oder eines Formulars Text machen, den Sie durchsuchen, bearbeiten und einfügen können.

Dokumente, die Sie nicht hochladen sollten

Ausweise, Arztbriefe, Verträge. Genau die Bilder, die man am besten vom Server anderer Leute fernhält.

So extrahieren Sie Text aus einem Bild

Sie können Text aus Bildern in drei Schritten extrahieren. Keine Installation, kein Konto, kein Upload-Schritt. Der erste Lauf lädt die OCR-Engine und die gewählten Sprachdaten in den Browser-Cache; danach funktioniert es offline.

  1. 1

    Bilder hinzufügen

    Ziehen Sie ein Foto, einen Screenshot oder einen Scan hinein – JPG, PNG, WebP, BMP und GIF funktionieren alle. Bis zu 20 auf einmal sind möglich, sie werden nacheinander verarbeitet.

  2. 2

    Sprachen und Bereinigung wählen

    Wählen Sie jede im Bild vorkommende Sprache, nicht nur die Hauptsprache. Lassen Sie die Bereinigung bei Scans und Fotos an; bei Screenshots schalten Sie sie aus, die sind ohnehin sauber. Das Geraderücken nur einschalten, wenn die Seite schräg aufgenommen wurde.

  3. 3

    Extrahieren, prüfen, kopieren

    Der Text erscheint je Bild in einem bearbeitbaren Feld, mit Zuverlässigkeitswert. Kopieren Sie ihn, laden Sie ihn als .txt herunter oder holen Sie alles als ZIP. Überfliegen Sie das Ergebnis immer gegen das Original – OCR-Ausgabe wirkt auch dann überzeugt, wenn sie falsch ist.

Engine und Sprachdaten liegen nach dem ersten Lauf im Cache, das zweite Bild wird also sofort gelesen.

Die drei Dinge, die über Erfolg entscheiden

Wenn Sie Text aus Bildern extrahieren, liegt ein schlechtes Ergebnis fast immer an einem davon – und das erste wiegt schwerer als die beiden anderen zusammen.

Die Auflösung, mit großem Abstand

Tesseract will rund 20 Pixel Höhe je Kleinbuchstabe, was bei einer ganzen Textseite etwa tausend Pixel an der kurzen Seite bedeutet. Darunter fällt die Genauigkeit steil ab. Diese Seite vergrößert zu kleine Bilder vor dem Lesen und sagt es Ihnen – im Test lieferte ein Screenshot mit 400 mal 184 noch jede Zeile korrekt. Allerdings: Ein unscharfes Foto zu vergrößern ergibt nur ein größeres unscharfes Foto. Wenn Sie neu aufnehmen können, füllen Sie den Bildausschnitt mit der Seite – das schlägt jede Einstellung auf dieser oder jeder anderen Seite.

Der Kontrast – und warum die Bereinigung weniger bringt als gedacht

Die Engine muss Tinte von Papier trennen, ein grauer Scan oder ein Schatten über der halben Seite machen es ihr also schwer. Die Bereinigung wandelt das Bild mit einem lokal adaptiven Schwellenwert in Schwarzweiß um, berechnet je Bildbereich statt einmal für das ganze Bild – genau das braucht ein Foto mit ungleichmäßiger Beleuchtung. Und ehrlich zur Größenordnung: Modernes Tesseract binarisiert intern ohnehin selbst, bei einem ordentlich ausgeleuchteten Foto ist der Unterschied also klein. In unseren Tests bewegte es die Zuverlässigkeit um ein paar Punkte und fügte gelegentlich ein Störzeichen hinzu. Seine Berechtigung hat es bei wirklich grauen Scans und dunklen Handyfotos, nicht bei Screenshots.

Der Winkel – nur bei abfotografierten Seiten

OCR liest in waagerechten Zeilen. Eine um einige Grad gekippte Seite bedeutet, dass Wörter über die Pixelreihen wandern, die die Engine gerade abtastet. Das Geraderücken erkennt den vorherrschenden Textwinkel und dreht das Bild vorher zurück. Für alles aus der Hand schräg Fotografierte einschalten. Bei Screenshots und Flachbettscans ausgeschaltet lassen – dort gibt es keine Neigung zu korrigieren, und die Erkennung kann nur Fehler einbringen.

Ehrliches Fazit: Beginnen Sie mit der größten, schärfsten Fassung, die Sie haben. Dann Bereinigung bei einem Scan oder dunklen Foto, Geraderücken bei schräger Aufnahme. Keines von beiden rettet ein Bild, das von vornherein zu klein war.

Screenshots mit mehr als einer Sprache – das Einzige, was kein anderes Werkzeug kann

Hier stolpern viele. Jedes getestete Werkzeug verlangt, dass Sie vor dem Extrahieren eine einzige Sprache wählen. Für eine deutschsprachige Seite ist das in Ordnung, aber sehr viele reale Bilder sind nicht so: eine chinesische Rechnung mit englischen Produktnamen, eine japanische Oberfläche mit lateinischen Markennamen, ein russisches Dokument, das eine englische URL zitiert.

Wählen Sie eine Sprache, dann misslingt jeder Versuch, Text aus Bildbereichen in der anderen Schrift zu extrahieren – nicht weil die Engine diese Zeichen nicht sähe, sondern weil sie sie mit dem falschen Modell abgleicht. Sie bekommen die Hälfte Ihres Textes und viel Unsinn dort, wo die andere Hälfte stehen sollte.

Tesseract kann mehrere Sprachmodelle gleichzeitig laden, und diese Seite lässt Sie so viele auswählen, wie Sie brauchen. Von den zehn getesteten Werkzeugen bietet das kein einziges: Alle verlangen ausnahmslos, sich vor dem Extrahieren auf eine Sprache festzulegen. Der Preis, offen gesagt: Jede Sprache erhöht die beim ersten Mal geladene Datenmenge, und mehrere gleichzeitig machen die Erkennung etwas langsamer. Wählen Sie die, die tatsächlich in Ihrem Bild vorkommen, nicht die ganze Liste.

Was das hier nicht leistet

OCR hat echte Grenzen, und sie zu kennen, bevor Sie Text aus Bildern extrahieren, spart mehr Zeit als jede Einstellung.

Handschrift, besonders Schreibschrift

Tesseract ist auf Drucktype trainiert. Saubere Blockschrift kommt manchmal durch; gewöhnliche verbundene Handschrift in der Regel nicht. Das ist eine Grenze der Engine, nicht dieser Seite, und gilt für jedes kostenlose Werkzeug, das darauf aufbaut – also für die meisten, auch wenn kaum eines es sagt.

Formatierung und Layout

Sie bekommen reinen Text. Fett, kursiv, Überschriften, Farbe und Schriftart werden verworfen. Tabellen verlieren ihre Struktur und werden zu Wortreihen, und eine zweispaltige Seite wird womöglich quer statt spaltenweise gelesen.

Ein wirklich schlechtes Foto retten

Bereinigung hilft einem mittelmäßigen Bild. Sie kann keine Details erfinden, die nie aufgenommen wurden – ein unscharfes, dunkles oder sehr kleines Foto von Kleingedrucktem wird dadurch nicht lesbar. Mit höherer Auflösung neu aufnehmen schlägt jede Bearbeitung.

Das Dokument verstehen

Es gibt die Zeichen zurück, die es sieht, in Lesereihenfolge, mehr nicht. Es weiß nicht, welche Zahl die Summe und welche Zeile das Datum ist. Prüfen Sie alles, worauf Sie hin handeln wollen.

Die kostenlosen Werkzeuge im Vergleich

Zehn Werkzeuge, die Text aus Bildern extrahieren, im September 2026 durch Benutzung geprüft. Nur das Verhalten der kostenlosen Stufe und nur das, was sich unterscheidet – kostenlos sind sie alle, und die meisten laufen im Browser.

WerkzeugWo es läuftStapelMehrere Sprachen zugleich
Diese SeiteIhr BrowserBis zu 20Ja – beliebige Kombination
PixConvertIhr BrowserEins nach dem anderenNein – nur eine
UtiloKitIhr BrowserEins nach dem anderenNein – nur eine
OpenConvertIhr BrowserJaNein – nur eine
PixellizeIhr BrowserEins nach dem anderenNein – nur eine
imagetotext.infoNicht angegebenBezahlstufeNein – nur eine
OnlineOCR.netDeren ServerNur angemeldetNein – nur eine

Ehrlich zusammengefasst: Mehrere dieser Bild-in-Text-Werkzeuge sind völlig in Ordnung, und die im Browser laufenden verdienen Anerkennung dafür – das war einmal das Unterscheidungsmerkmal und ist es nicht mehr. Zwei Dinge unterscheiden sich weiterhin: ob Sie einen ganzen Stapel übergeben können, und ob sich ein Bild mit gemischten Schriften in einem Durchgang lesen lässt. Beim Zweiten haben wir kein anderes Werkzeug gefunden, das es erlaubt.

Alle Werkzeuge sind 100 % kostenlos und sicher

Komplettes PDF-Werkzeugpaket

Entdecken Sie unsere umfassende Sammlung an PDF-Werkzeugen für all Ihre Dokumentenaufgaben

Werkzeugübersicht · 47
01

PNG in PDF

PNG-Bilder zu einer druckfertigen PDF zusammenfassen

Avg 1.2sLokal
02

JPG in PDF

JPG-Bilder ins PDF-Format umwandeln

Avg 1.4sLokal
03

PDF zusammenfügen

Mehrere PDF-Dateien zu einer zusammenfügen

Avg 0.8sLokal
04

PDF komprimieren

PDF-Dateigröße effizient verringern

Avg 2.1sLokal
05

PDF in PNG

PDF-Seiten in PNG-Bilder umwandeln

Avg 1.6sLokal
06

PDF in JPG

PDF-Seiten in JPG-Bilder umwandeln

Avg 1.5sLokal
07

PDF in Text

Textinhalt aus PDF-Dateien extrahieren

Avg 0.9sLokal
08

PDF teilen

PDF in einzelne Seiten teilen

Avg 0.6sLokal
09

PDF bearbeiten

PDF-Dokumente bearbeiten und kommentieren

BetaLokal
10

PDF organisieren

PDF-Seiten organisieren und neu anordnen

Avg 0.7sLokal
11

PDF drehen

PDF-Seiten drehen und dauerhaft speichern

Avg 0.5sLokal
12

Seitenzahlen

Seitenzahlen mit Live-Vorschau in PDF einfügen

Avg 0.6sLokal
13

PDF-Wasserzeichen

Text-Wasserzeichen mit Live-Vorschau in PDF einfügen

Avg 0.6sLokal
14

HEIC in JPG

iPhone-HEIC-Fotos in JPG umwandeln

Avg 1.0sLokal
15

PDF Seiten löschen

Unerwünschte Seiten entfernen und eine saubere PDF herunterladen

Avg 0.5sLokal
16

PDF Seiten extrahieren

Ausgewählte Seiten als neue PDF oder einzelne Dateien speichern

Avg 0.5sLokal
17

PDF unterschreiben

Unterschrift zeichnen, tippen oder hochladen und auf jeder Seite platzieren

Avg 1.0sLokal
18

PDF Seitengröße ändern

Seitengröße auf A4, Letter oder eigene Maße ändern

Avg 0.6sLokal
19

PDF zuschneiden

Ränder beschneiden, per Ziehen auswählen oder weiße Ränder automatisch zuschneiden

Avg 0.6sLokal
20

PDF reduzieren

Formulare schreibgeschützt machen — Text durchsuchbar halten oder auf ein Bild reduzieren

Avg 0.7sLokal
21

PDF-Metadaten

Autor, Titel, Datumsangaben und weitere Metadaten ansehen, bearbeiten oder entfernen

Avg 0.4sLokal
22

PDF in Graustufen

In Graustufen oder Schwarzweiß umwandeln, um Farbtinte zu sparen

Avg 1.8sLokal
23

Bilder aus PDF extrahieren

Eingebettete Fotos aus einer PDF herausziehen und als PNG oder JPG speichern

Avg 0.9sLokal
24

WebP in PDF

WebP-Bilder in eine PDF umwandeln, mehrere zu einer Datei zusammenführen

Avg 0.7sLokal
25

PDF schützen

Ihre PDF mit einem Öffnungspasswort versehen – komplett im Browser

Avg 0.3sLokal
26

PDF entsperren

Ein bekanntes Passwort oder Beschränkungen aus einer PDF entfernen – im Browser

Avg 1.5sLokal
27

HEIC in PDF

iPhone-HEIC-Fotos in PDF umwandeln

Avg 0.8sLokal
28

AVIF in PDF

AVIF-Bilder in PDF umwandeln

Avg 0.7sLokal
29

TIFF in PDF

TIFF-Bilder und Scans in PDF umwandeln

Avg 1.0sLokal
30

BMP in PDF

BMP-Bitmaps in PDF umwandeln

Avg 0.7sLokal
31

PDF OCR

Mache ein gescanntes PDF durchsuchbar, komplett im Browser

Avg 2s/pageLokal
32

PDF schwärzen

Entferne sensible Inhalte dauerhaft aus einem PDF, direkt im Browser

Avg 0.3s/pageLokal
33

Bild komprimieren

Verkleinere JPEG, PNG und WebP im Stapel, komplett im Browser

Avg 0.2sLokal
34

Bild skalieren

Ändere Bildmaße im Stapel, mit Vorlagen, direkt im Browser

Avg 0.2sLokal
35

PNG in JPG

PNG-Bilder stapelweise in JPG umwandeln - die Dateigröße sehen Sie vor dem Download

Avg 0.2sLokal
36

JPG in PNG

JPG-Bilder stapelweise in PNG umwandeln, auf Wunsch mit transparentem Hintergrund

Avg 0.3sLokal
37

WebP in JPG

WebP-Dateien stapelweise in JPG umwandeln, mit jedem Einzelbild eines animierten WebP

Avg 0.3sLokal
38

WebP in PNG

WebP in PNG umwandeln, Transparenz bleibt erhalten oder ein einfarbiger Hintergrund verschwindet

Avg 0.3sLokal
39

Bild in WebP

JPG, PNG und mehr stapelweise in WebP umwandeln oder eine exakte Größe in KB treffen

Avg 0.2sLokal
40

SVG in PNG

SVG in jeder Größe rastern oder aus einem Logo einen ganzen Favicon-Satz erzeugen

Avg 0.2sLokal
41

AVIF in JPG

AVIF in JPG umwandeln, damit es überall aufgeht, oder auf eine Größe in KB bringen

Avg 0.3sLokal
42

PDF vergleichen

Sieh genau, was sich zwischen zwei PDF-Versionen geändert hat – ganz ohne Upload

Two files, no uploadLokal
43

SVG in JPG

SVG in beliebiger Größe zu JPG rastern und die Farbe für die Transparenz selbst wählen

Pick size and backgroundLokal
44

GIF in PNG

Ein Standbild nehmen, oder ein animiertes GIF in ein nummeriertes PNG je Einzelbild zerlegen

Every frame at onceLokal
45

GIF in JPG

Bestimme, was die Transparenz ersetzt, ein Einzelbild oder alle - und wir sagen, wann PNG besser passt

You pick the backgroundLokal
46

PDF in TIFF

PDF in ein einziges mehrseitiges TIFF umwandeln

One multi-page fileLokal
47

Bild in Text

Text aus Fotos und Screenshots holen

11 languages, offlineLokal

Fragen zum Extrahieren von Text aus Bildern

Was Leute fragen, bevor sie Text aus Bildern extrahieren und sich auf das Ergebnis verlassen.

Ist es kostenlos, und gibt es Grenzen?

Kostenlos, ohne Konto, ohne Tageslimit und ohne Wasserzeichen. Sie können 20 Bilder auf einmal verarbeiten, jedes bis 25 MB. Diese Grenze gibt es, weil OCR rechenintensiv ist und auf Ihrer eigenen Maschine läuft – nicht wegen einer Bezahlstufe. Starten Sie danach einfach den nächsten Stapel.

Werden meine Bilder irgendwohin hochgeladen?

Nein. Die OCR-Engine läuft in dieser Seite. Ihre Bilder werden von Ihrem eigenen Browser gelesen und nie übertragen. Hier zählt das mehr als bei den meisten Umwandlungen, denn die Bilder, die Leute durch OCR schicken, sind Ausweise, Rechnungen, Arztbriefe und Verträge.

Warum wurden beim ersten Mal mehrere Megabyte geladen?

Das sind die OCR-Engine und die Sprachdaten, und es passiert nur einmal. Weil die Erkennung lokal statt auf einem Server läuft, muss die Engine zu Ihrem Gerät gelangen. Danach liegt sie im Cache, spätere Läufe starten also sofort – und funktionieren offline.

Kann es Handschrift lesen?

Nicht zuverlässig, Schreibschrift meist gar nicht. Die Engine ist auf Drucktype trainiert. Sorgfältige Blockschrift kommt manchmal lesbar durch. Das gilt für jedes kostenlose Werkzeug auf Tesseract-Basis, und das sind die meisten.

Der Text kam falsch heraus. Was soll ich ändern?

Zuerst die Auflösung, dann die Bereinigung, dann den Winkel. Wenn Sie Text aus Bildern extrahieren, schlägt eine größere oder schärfere Vorlage jede Einstellung – und zwar deutlich. Danach die Bereinigung bei grauem Scan oder dunklem Foto einschalten und das Geraderücken, wenn die Seite schräg aufgenommen wurde. Enthält Ihr Bild zwei Schriften, wählen Sie beide Sprachen, statt zu raten, welche überwiegt.

Kommt es mit einem Bild in zwei Sprachen zurecht?

Ja – wählen Sie alle vorkommenden Sprachen, nicht nur die Hauptsprache. Die Engine lädt mehrere Modelle gleichzeitig und liest beide Schriften in einem Durchgang. Die meisten anderen Werkzeuge zwingen Sie zu genau einer – deshalb kommen gemischte Screenshots dort halb leer zurück.

Bleiben Layout, Tabellen oder Fettdruck erhalten?

Nein. Die Ausgabe ist reiner Text. Formatierung, Farbe und Schriftart werden verworfen, Tabellen verlieren ihre Struktur, und mehrspaltige Seiten werden womöglich quer statt von oben nach unten gelesen. Wenn Sie das Layout erhalten wollen, brauchen Sie ein PDF mit Textebene, nicht extrahierten Text.

Und wenn ich ein PDF statt eines Bildes habe?

Nehmen Sie stattdessen das PDF-OCR-Werkzeug – es lässt die Seiten intakt. Es rendert jede Seite, liest sie und schreibt eine unsichtbare Textebene über das Original, sodass das Dokument unverändert aussieht, aber durchsuchbar wird. Das PDF erst in Bilder umzuwandeln und die hier durchzuschicken, würde die Dokumentstruktur verlieren.

Verwandte Werkzeuge

Was sonst noch gut passt, wenn Sie Text aus Bildern extrahieren – alles kostenlos und alles auf Ihrem eigenen Gerät.

  • PDF mit OCR für Dokumente statt Bilder – fügt eine durchsuchbare Textebene hinzu und lässt die Seiten intakt.
  • PDF zu Text wenn im PDF bereits echter Text steckt und nur herausgeholt werden muss, ganz ohne OCR.
  • Bild skalieren einen zu kleinen Screenshot vor dem Lesen vergrößern oder ein zu großes Foto verkleinern.
  • Bild komprimieren wenn das Bild in Ordnung ist, die Datei aber zu groß zum Weiterschicken.
  • PDF in PNG Seiten als Bilder aus einem PDF holen, wenn Sie das Bild brauchen und nicht die Wörter.