Bild in Text
Holen Sie den Text aus einem Foto, Screenshot oder Scan – direkt in Ihrem Browser. Nichts wird hochgeladen.
Nichts wird hochgeladen
Die OCR-Engine läuft in dieser Seite. Ihr Ausweis, Ihre Rechnung oder Ihr Vertrag verlässt das Gerät nie.
Kleine Bilder werden vergrößert
Zu kleine Screenshots werden auf die Buchstabenhöhe skaliert, die die Engine braucht, statt Ihnen zurückgegeben zu werden.
Mehrere Sprachen gleichzeitig
Liest einen Screenshot mit gemischten Schriften in einem Durchgang, statt eine Sprache zu wählen und die Hälfte zu verlieren.
Bis zu 20 Bilder
Verarbeiten Sie einen ganzen Stapel und laden Sie alle Ergebnisse zusammen herunter. Kein Konto, kein Tageslimit.
Kurz gesagt: Um Text aus Bildern zu extrahieren, ziehen Sie ein Foto oder einen Screenshot hinein, wählen die enthaltene Sprache oder Sprachen und bekommen den Text zurück. Alles passiert in Ihrem Browser, es wird also nichts hochgeladen. Bei einem Scan oder einer schräg aufgenommenen Seite lassen Sie die Bereinigungsoptionen an – sie zählen mehr als die Wahl des Werkzeugs.
Warum dasselbe Foto auf verschiedenen Seiten verschiedene Ergebnisse liefert
Etwas, das die Werbeseiten nicht erwähnen: Die meisten kostenlosen Werkzeuge, die Text aus Bildern extrahieren, lassen dieselbe Open-Source-Engine laufen – Tesseract, kompiliert nach WebAssembly. Wir haben zehn geprüft, mindestens fünf sagen es selbst. Wenn also eine Seite sauberen Text liefert und eine andere Kauderwelsch aus demselben Foto, ist die Engine selten die Variable.
Was sich bei jeder Umwandlung von Bild in Text unterscheidet, ist das, was bei der Engine ankommt. Und der Faktor, der am meisten zählt, wird nirgends beworben: wie viele Pixel hoch die Buchstaben sind. Tesseract will rund 20 Pixel Höhe je Kleinbuchstabe. Ein Screenshot, der durch ein paar Messenger weitergereicht wurde, oder ein zum Hochladen verkleinertes Foto kommt oft mit der Hälfte an – und die Genauigkeit bricht ein.
Was die anderen Werkzeuge Ihnen raten
Neu aufnehmen. Bei den zehn getesteten lautet der übliche Rat bei einem schlechten Ergebnis, mit höherer Auflösung neu zu fotografieren oder neu zu screenshotten. Das ist vernünftig und völlig nutzlos, wenn dieses Bild das einzige ist, das Sie haben.
Diese Seite vergrößert ein zu kleines Bild stattdessen vor dem Lesen und sagt es Ihnen. Im Test kam ein Screenshot mit 400 mal 184 Pixeln – klein genug, dass die meisten Werkzeuge zum Neuanfang raten würden – mit 94% Zuverlässigkeit und jeder Zeile korrekt zurück. Vergrößern erfindet keine Details, die nie aufgenommen wurden, aber es gibt der Engine die Buchstabenhöhe, für die sie gebaut wurde.
Was OCR wirklich tut – und was nicht
Optische Zeichenerkennung betrachtet das Muster heller und dunkler Pixel in einem Bild und ermittelt, welche Zeichen diese Formen am wahrscheinlichsten darstellen. Sie liest oder versteht die Seite nicht – sie ordnet Formen Buchstaben zu, einen nach dem anderen.
Diese Unterscheidung erklärt fast jede Beschwerde über OCR. Sie erklärt, warum ein Wort in einer ungewöhnlichen Schrift falsch herauskommt, warum ein Buchstabe hinter einem Kaffeefleck zu einem anderen wird, und warum die Engine seelenruhig ein selbstbewusst aussehendes Wort ausgibt, das es gar nicht gibt. Es ist Mustervergleich, kein Verstehen.
Es erklärt auch, warum jedes Werkzeug, das Text aus Bildern extrahieren kann, für jedes einzelne ausgegebene Wort einen Zuverlässigkeitswert meldet. Diese Werte sind echte Information, und diese Seite zeigt sie: Fällt der Durchschnitt unter 70%, wird das Ergebnis gekennzeichnet, statt es Ihnen als sicher zu übergeben. Die meisten Werkzeuge verbergen das.
Wofür es tatsächlich benutzt wird
Screenshots und Fehlermeldungen
Text aus einem zugeschickten Screenshot kopieren oder aus einem Fehlerdialog, der sich partout nicht markieren lässt.
Belege und Rechnungen
Beträge und Belegnummern von einem abfotografierten Kassenzettel holen, statt sie in eine Tabelle abzutippen.
Abfotografierte Seiten
Aus dem Bild einer gedruckten Seite, eines Buchs oder eines Formulars Text machen, den Sie durchsuchen, bearbeiten und einfügen können.
Dokumente, die Sie nicht hochladen sollten
Ausweise, Arztbriefe, Verträge. Genau die Bilder, die man am besten vom Server anderer Leute fernhält.
So extrahieren Sie Text aus einem Bild
Sie können Text aus Bildern in drei Schritten extrahieren. Keine Installation, kein Konto, kein Upload-Schritt. Der erste Lauf lädt die OCR-Engine und die gewählten Sprachdaten in den Browser-Cache; danach funktioniert es offline.
- 1
Bilder hinzufügen
Ziehen Sie ein Foto, einen Screenshot oder einen Scan hinein – JPG, PNG, WebP, BMP und GIF funktionieren alle. Bis zu 20 auf einmal sind möglich, sie werden nacheinander verarbeitet.
- 2
Sprachen und Bereinigung wählen
Wählen Sie jede im Bild vorkommende Sprache, nicht nur die Hauptsprache. Lassen Sie die Bereinigung bei Scans und Fotos an; bei Screenshots schalten Sie sie aus, die sind ohnehin sauber. Das Geraderücken nur einschalten, wenn die Seite schräg aufgenommen wurde.
- 3
Extrahieren, prüfen, kopieren
Der Text erscheint je Bild in einem bearbeitbaren Feld, mit Zuverlässigkeitswert. Kopieren Sie ihn, laden Sie ihn als .txt herunter oder holen Sie alles als ZIP. Überfliegen Sie das Ergebnis immer gegen das Original – OCR-Ausgabe wirkt auch dann überzeugt, wenn sie falsch ist.
Engine und Sprachdaten liegen nach dem ersten Lauf im Cache, das zweite Bild wird also sofort gelesen.
Die drei Dinge, die über Erfolg entscheiden
Wenn Sie Text aus Bildern extrahieren, liegt ein schlechtes Ergebnis fast immer an einem davon – und das erste wiegt schwerer als die beiden anderen zusammen.
Die Auflösung, mit großem Abstand
Tesseract will rund 20 Pixel Höhe je Kleinbuchstabe, was bei einer ganzen Textseite etwa tausend Pixel an der kurzen Seite bedeutet. Darunter fällt die Genauigkeit steil ab. Diese Seite vergrößert zu kleine Bilder vor dem Lesen und sagt es Ihnen – im Test lieferte ein Screenshot mit 400 mal 184 noch jede Zeile korrekt. Allerdings: Ein unscharfes Foto zu vergrößern ergibt nur ein größeres unscharfes Foto. Wenn Sie neu aufnehmen können, füllen Sie den Bildausschnitt mit der Seite – das schlägt jede Einstellung auf dieser oder jeder anderen Seite.
Der Kontrast – und warum die Bereinigung weniger bringt als gedacht
Die Engine muss Tinte von Papier trennen, ein grauer Scan oder ein Schatten über der halben Seite machen es ihr also schwer. Die Bereinigung wandelt das Bild mit einem lokal adaptiven Schwellenwert in Schwarzweiß um, berechnet je Bildbereich statt einmal für das ganze Bild – genau das braucht ein Foto mit ungleichmäßiger Beleuchtung. Und ehrlich zur Größenordnung: Modernes Tesseract binarisiert intern ohnehin selbst, bei einem ordentlich ausgeleuchteten Foto ist der Unterschied also klein. In unseren Tests bewegte es die Zuverlässigkeit um ein paar Punkte und fügte gelegentlich ein Störzeichen hinzu. Seine Berechtigung hat es bei wirklich grauen Scans und dunklen Handyfotos, nicht bei Screenshots.
Der Winkel – nur bei abfotografierten Seiten
OCR liest in waagerechten Zeilen. Eine um einige Grad gekippte Seite bedeutet, dass Wörter über die Pixelreihen wandern, die die Engine gerade abtastet. Das Geraderücken erkennt den vorherrschenden Textwinkel und dreht das Bild vorher zurück. Für alles aus der Hand schräg Fotografierte einschalten. Bei Screenshots und Flachbettscans ausgeschaltet lassen – dort gibt es keine Neigung zu korrigieren, und die Erkennung kann nur Fehler einbringen.
Ehrliches Fazit: Beginnen Sie mit der größten, schärfsten Fassung, die Sie haben. Dann Bereinigung bei einem Scan oder dunklen Foto, Geraderücken bei schräger Aufnahme. Keines von beiden rettet ein Bild, das von vornherein zu klein war.
Screenshots mit mehr als einer Sprache – das Einzige, was kein anderes Werkzeug kann
Hier stolpern viele. Jedes getestete Werkzeug verlangt, dass Sie vor dem Extrahieren eine einzige Sprache wählen. Für eine deutschsprachige Seite ist das in Ordnung, aber sehr viele reale Bilder sind nicht so: eine chinesische Rechnung mit englischen Produktnamen, eine japanische Oberfläche mit lateinischen Markennamen, ein russisches Dokument, das eine englische URL zitiert.
Wählen Sie eine Sprache, dann misslingt jeder Versuch, Text aus Bildbereichen in der anderen Schrift zu extrahieren – nicht weil die Engine diese Zeichen nicht sähe, sondern weil sie sie mit dem falschen Modell abgleicht. Sie bekommen die Hälfte Ihres Textes und viel Unsinn dort, wo die andere Hälfte stehen sollte.
Tesseract kann mehrere Sprachmodelle gleichzeitig laden, und diese Seite lässt Sie so viele auswählen, wie Sie brauchen. Von den zehn getesteten Werkzeugen bietet das kein einziges: Alle verlangen ausnahmslos, sich vor dem Extrahieren auf eine Sprache festzulegen. Der Preis, offen gesagt: Jede Sprache erhöht die beim ersten Mal geladene Datenmenge, und mehrere gleichzeitig machen die Erkennung etwas langsamer. Wählen Sie die, die tatsächlich in Ihrem Bild vorkommen, nicht die ganze Liste.
Was das hier nicht leistet
OCR hat echte Grenzen, und sie zu kennen, bevor Sie Text aus Bildern extrahieren, spart mehr Zeit als jede Einstellung.
Handschrift, besonders Schreibschrift
Tesseract ist auf Drucktype trainiert. Saubere Blockschrift kommt manchmal durch; gewöhnliche verbundene Handschrift in der Regel nicht. Das ist eine Grenze der Engine, nicht dieser Seite, und gilt für jedes kostenlose Werkzeug, das darauf aufbaut – also für die meisten, auch wenn kaum eines es sagt.
Formatierung und Layout
Sie bekommen reinen Text. Fett, kursiv, Überschriften, Farbe und Schriftart werden verworfen. Tabellen verlieren ihre Struktur und werden zu Wortreihen, und eine zweispaltige Seite wird womöglich quer statt spaltenweise gelesen.
Ein wirklich schlechtes Foto retten
Bereinigung hilft einem mittelmäßigen Bild. Sie kann keine Details erfinden, die nie aufgenommen wurden – ein unscharfes, dunkles oder sehr kleines Foto von Kleingedrucktem wird dadurch nicht lesbar. Mit höherer Auflösung neu aufnehmen schlägt jede Bearbeitung.
Das Dokument verstehen
Es gibt die Zeichen zurück, die es sieht, in Lesereihenfolge, mehr nicht. Es weiß nicht, welche Zahl die Summe und welche Zeile das Datum ist. Prüfen Sie alles, worauf Sie hin handeln wollen.
Die kostenlosen Werkzeuge im Vergleich
Zehn Werkzeuge, die Text aus Bildern extrahieren, im September 2026 durch Benutzung geprüft. Nur das Verhalten der kostenlosen Stufe und nur das, was sich unterscheidet – kostenlos sind sie alle, und die meisten laufen im Browser.
| Werkzeug | Wo es läuft | Stapel | Mehrere Sprachen zugleich |
|---|---|---|---|
| Diese Seite | Ihr Browser | Bis zu 20 | Ja – beliebige Kombination |
| PixConvert | Ihr Browser | Eins nach dem anderen | Nein – nur eine |
| UtiloKit | Ihr Browser | Eins nach dem anderen | Nein – nur eine |
| OpenConvert | Ihr Browser | Ja | Nein – nur eine |
| Pixellize | Ihr Browser | Eins nach dem anderen | Nein – nur eine |
| imagetotext.info | Nicht angegeben | Bezahlstufe | Nein – nur eine |
| OnlineOCR.net | Deren Server | Nur angemeldet | Nein – nur eine |
Ehrlich zusammengefasst: Mehrere dieser Bild-in-Text-Werkzeuge sind völlig in Ordnung, und die im Browser laufenden verdienen Anerkennung dafür – das war einmal das Unterscheidungsmerkmal und ist es nicht mehr. Zwei Dinge unterscheiden sich weiterhin: ob Sie einen ganzen Stapel übergeben können, und ob sich ein Bild mit gemischten Schriften in einem Durchgang lesen lässt. Beim Zweiten haben wir kein anderes Werkzeug gefunden, das es erlaubt.
Komplettes PDF-Werkzeugpaket
Entdecken Sie unsere umfassende Sammlung an PDF-Werkzeugen für all Ihre Dokumentenaufgaben
PNG in PDF
PNG-Bilder zu einer druckfertigen PDF zusammenfassen
JPG in PDF
JPG-Bilder ins PDF-Format umwandeln
PDF zusammenfügen
Mehrere PDF-Dateien zu einer zusammenfügen
PDF komprimieren
PDF-Dateigröße effizient verringern
PDF in PNG
PDF-Seiten in PNG-Bilder umwandeln
PDF in JPG
PDF-Seiten in JPG-Bilder umwandeln
PDF in Text
Textinhalt aus PDF-Dateien extrahieren
PDF teilen
PDF in einzelne Seiten teilen
PDF bearbeiten
PDF-Dokumente bearbeiten und kommentieren
PDF organisieren
PDF-Seiten organisieren und neu anordnen
PDF drehen
PDF-Seiten drehen und dauerhaft speichern
Seitenzahlen
Seitenzahlen mit Live-Vorschau in PDF einfügen
PDF-Wasserzeichen
Text-Wasserzeichen mit Live-Vorschau in PDF einfügen
HEIC in JPG
iPhone-HEIC-Fotos in JPG umwandeln
PDF Seiten löschen
Unerwünschte Seiten entfernen und eine saubere PDF herunterladen
PDF Seiten extrahieren
Ausgewählte Seiten als neue PDF oder einzelne Dateien speichern
PDF unterschreiben
Unterschrift zeichnen, tippen oder hochladen und auf jeder Seite platzieren
PDF Seitengröße ändern
Seitengröße auf A4, Letter oder eigene Maße ändern
PDF zuschneiden
Ränder beschneiden, per Ziehen auswählen oder weiße Ränder automatisch zuschneiden
PDF reduzieren
Formulare schreibgeschützt machen — Text durchsuchbar halten oder auf ein Bild reduzieren
PDF-Metadaten
Autor, Titel, Datumsangaben und weitere Metadaten ansehen, bearbeiten oder entfernen
PDF in Graustufen
In Graustufen oder Schwarzweiß umwandeln, um Farbtinte zu sparen
Bilder aus PDF extrahieren
Eingebettete Fotos aus einer PDF herausziehen und als PNG oder JPG speichern
WebP in PDF
WebP-Bilder in eine PDF umwandeln, mehrere zu einer Datei zusammenführen
PDF schützen
Ihre PDF mit einem Öffnungspasswort versehen – komplett im Browser
PDF entsperren
Ein bekanntes Passwort oder Beschränkungen aus einer PDF entfernen – im Browser
HEIC in PDF
iPhone-HEIC-Fotos in PDF umwandeln
AVIF in PDF
AVIF-Bilder in PDF umwandeln
TIFF in PDF
TIFF-Bilder und Scans in PDF umwandeln
BMP in PDF
BMP-Bitmaps in PDF umwandeln
PDF OCR
Mache ein gescanntes PDF durchsuchbar, komplett im Browser
PDF schwärzen
Entferne sensible Inhalte dauerhaft aus einem PDF, direkt im Browser
Bild komprimieren
Verkleinere JPEG, PNG und WebP im Stapel, komplett im Browser
Bild skalieren
Ändere Bildmaße im Stapel, mit Vorlagen, direkt im Browser
PNG in JPG
PNG-Bilder stapelweise in JPG umwandeln - die Dateigröße sehen Sie vor dem Download
JPG in PNG
JPG-Bilder stapelweise in PNG umwandeln, auf Wunsch mit transparentem Hintergrund
WebP in JPG
WebP-Dateien stapelweise in JPG umwandeln, mit jedem Einzelbild eines animierten WebP
WebP in PNG
WebP in PNG umwandeln, Transparenz bleibt erhalten oder ein einfarbiger Hintergrund verschwindet
Bild in WebP
JPG, PNG und mehr stapelweise in WebP umwandeln oder eine exakte Größe in KB treffen
SVG in PNG
SVG in jeder Größe rastern oder aus einem Logo einen ganzen Favicon-Satz erzeugen
AVIF in JPG
AVIF in JPG umwandeln, damit es überall aufgeht, oder auf eine Größe in KB bringen
PDF vergleichen
Sieh genau, was sich zwischen zwei PDF-Versionen geändert hat – ganz ohne Upload
SVG in JPG
SVG in beliebiger Größe zu JPG rastern und die Farbe für die Transparenz selbst wählen
GIF in PNG
Ein Standbild nehmen, oder ein animiertes GIF in ein nummeriertes PNG je Einzelbild zerlegen
GIF in JPG
Bestimme, was die Transparenz ersetzt, ein Einzelbild oder alle - und wir sagen, wann PNG besser passt
PDF in TIFF
PDF in ein einziges mehrseitiges TIFF umwandeln
Bild in Text
Text aus Fotos und Screenshots holen
Fragen zum Extrahieren von Text aus Bildern
Was Leute fragen, bevor sie Text aus Bildern extrahieren und sich auf das Ergebnis verlassen.
Ist es kostenlos, und gibt es Grenzen?
Kostenlos, ohne Konto, ohne Tageslimit und ohne Wasserzeichen. Sie können 20 Bilder auf einmal verarbeiten, jedes bis 25 MB. Diese Grenze gibt es, weil OCR rechenintensiv ist und auf Ihrer eigenen Maschine läuft – nicht wegen einer Bezahlstufe. Starten Sie danach einfach den nächsten Stapel.
Werden meine Bilder irgendwohin hochgeladen?
Nein. Die OCR-Engine läuft in dieser Seite. Ihre Bilder werden von Ihrem eigenen Browser gelesen und nie übertragen. Hier zählt das mehr als bei den meisten Umwandlungen, denn die Bilder, die Leute durch OCR schicken, sind Ausweise, Rechnungen, Arztbriefe und Verträge.
Warum wurden beim ersten Mal mehrere Megabyte geladen?
Das sind die OCR-Engine und die Sprachdaten, und es passiert nur einmal. Weil die Erkennung lokal statt auf einem Server läuft, muss die Engine zu Ihrem Gerät gelangen. Danach liegt sie im Cache, spätere Läufe starten also sofort – und funktionieren offline.
Kann es Handschrift lesen?
Nicht zuverlässig, Schreibschrift meist gar nicht. Die Engine ist auf Drucktype trainiert. Sorgfältige Blockschrift kommt manchmal lesbar durch. Das gilt für jedes kostenlose Werkzeug auf Tesseract-Basis, und das sind die meisten.
Der Text kam falsch heraus. Was soll ich ändern?
Zuerst die Auflösung, dann die Bereinigung, dann den Winkel. Wenn Sie Text aus Bildern extrahieren, schlägt eine größere oder schärfere Vorlage jede Einstellung – und zwar deutlich. Danach die Bereinigung bei grauem Scan oder dunklem Foto einschalten und das Geraderücken, wenn die Seite schräg aufgenommen wurde. Enthält Ihr Bild zwei Schriften, wählen Sie beide Sprachen, statt zu raten, welche überwiegt.
Kommt es mit einem Bild in zwei Sprachen zurecht?
Ja – wählen Sie alle vorkommenden Sprachen, nicht nur die Hauptsprache. Die Engine lädt mehrere Modelle gleichzeitig und liest beide Schriften in einem Durchgang. Die meisten anderen Werkzeuge zwingen Sie zu genau einer – deshalb kommen gemischte Screenshots dort halb leer zurück.
Bleiben Layout, Tabellen oder Fettdruck erhalten?
Nein. Die Ausgabe ist reiner Text. Formatierung, Farbe und Schriftart werden verworfen, Tabellen verlieren ihre Struktur, und mehrspaltige Seiten werden womöglich quer statt von oben nach unten gelesen. Wenn Sie das Layout erhalten wollen, brauchen Sie ein PDF mit Textebene, nicht extrahierten Text.
Und wenn ich ein PDF statt eines Bildes habe?
Nehmen Sie stattdessen das PDF-OCR-Werkzeug – es lässt die Seiten intakt. Es rendert jede Seite, liest sie und schreibt eine unsichtbare Textebene über das Original, sodass das Dokument unverändert aussieht, aber durchsuchbar wird. Das PDF erst in Bilder umzuwandeln und die hier durchzuschicken, würde die Dokumentstruktur verlieren.
Verwandte Werkzeuge
Was sonst noch gut passt, wenn Sie Text aus Bildern extrahieren – alles kostenlos und alles auf Ihrem eigenen Gerät.
- PDF mit OCR — für Dokumente statt Bilder – fügt eine durchsuchbare Textebene hinzu und lässt die Seiten intakt.
- PDF zu Text — wenn im PDF bereits echter Text steckt und nur herausgeholt werden muss, ganz ohne OCR.
- Bild skalieren — einen zu kleinen Screenshot vor dem Lesen vergrößern oder ein zu großes Foto verkleinern.
- Bild komprimieren — wenn das Bild in Ordnung ist, die Datei aber zu groß zum Weiterschicken.
- PDF in PNG — Seiten als Bilder aus einem PDF holen, wenn Sie das Bild brauchen und nicht die Wörter.