Text aus einem Bild extrahieren
Wandle JPG-, PNG- und WebP-Bilder in wenigen Sekunden in bearbeitbaren Text um.
Text aus einem Bild extrahieren
- 01Wähle ein JPG-, PNG- oder WebP-Bild auf deinem Gerät.
- 02Wähle die Sprache im Bild und drehe die Vorschau bei Bedarf.
- 03Extrahiere und prüfe den Text, kopiere ihn oder lade eine TXT-Datei herunter.
Was diese OCR erkennt
Das Werkzeug erkennt gedruckten Text auf Englisch, Vietnamesisch, Deutsch, Niederländisch, vereinfachtem Chinesisch, Japanisch, Koreanisch und Arabisch. Klare Scans und Screenshots funktionieren meist besser als unscharfe oder verzerrte Fotos.
OCR-Grenzen
Bei mehreren Spalten, Tabellen, Handschrift und stark gebogenem Text kann die Lesereihenfolge ungenau sein.
Fragen zur Bild-OCR
Welche Bildqualität führt zu besseren OCR-Ergebnissen?
Klarer, kontrastreicher gedruckter Text funktioniert am besten. Verwenden Sie eine scharfe Quelle mit genügend Pixeln für kleine Zeichen, gleichmäßiger Beleuchtung, begrenzter Komprimierung und einer möglichst flach und gerade fotografierten Seite. Schneiden Sie nicht zusammenhängende Hintergründe zu und drehen Sie den Text vor dem Extrahieren aufrecht. Sehr niedrige Auflösung, Bewegungsunschärfe, Blendung, Schatten, strukturiertes Papier, gekrümmte Seiten, dekorative Schriftarten und aggressive Bildverbesserung können Zeichenformen verschmelzen oder zerstören. Das Vergrößern einer Quelle mit wirklich niedriger Auflösung verbessert möglicherweise die Sichtbarkeit, kann jedoch keine Details wiederherstellen, die nie erfasst wurden.
Warum ist die Auswahl der richtigen OCR-Sprache wichtig?
Die Wahl der Sprache bestimmt, welches Erkennungsmodell und welche Zeichenmuster erwartet werden. Die Auswahl von Englisch für chinesischen, japanischen, koreanischen, arabischen, vietnamesischen oder deutschen Text kann zu plausiblen, aber falschen Ersetzungen führen, da das erwartete Alphabet, die Akzente, die Richtung und die Wortmuster unterschiedlich sind. Wählen Sie die im Bild sichtbare dominierende Sprache. Wenn in einem Bild mehrere Sprachen gemischt sind, extrahieren Sie den wichtigsten Abschnitt separat mit der passenden Sprache und vergleichen Sie Namen, Zahlen, Daten und Fachbegriffe sorgfältig, da sie durch gewöhnliche Sprachmuster weniger hilfreich sind.
Was kann die erkannte Lesereihenfolge beeinflussen?
OCR identifiziert Textbereiche und ordnet sie dann anhand ihrer Positionen. Mehrspaltige Artikel, Tabellen, Seitenleisten, Formulare, Bildunterschriften, vertikaler Text, geschwungene Beschriftungen, überlappende Stempel und handschriftliche Notizen können die beabsichtigte Reihenfolge mehrdeutig machen. Beschneiden Sie unabhängige Regionen und extrahieren Sie sie separat, wenn es auf die Reihenfolge ankommt. Vergleichen Sie nach der Extraktion das Ergebnis von oben nach unten mit der Quelle, stellen Sie Absatzumbrüche wieder her und überprüfen Sie Überschriften, Tabellenzeilen, Beschriftungen, Fußnoten und Text neben Bildern, anstatt davon auszugehen, dass ein vollständiges Dokumentlayout rekonstruiert wurde.
Kann OCR Tabellen und Dokumentformatierungen beibehalten?
Nein. Dieses Tool gibt bearbeitbaren Text und erkannte Bereiche zurück, keine Word-, Tabellenkalkulations- oder durchsuchbare PDF-Nachbildung des Originaldesigns. Spalten können in einer unerwarteten Reihenfolge gelesen werden, Tabellenzellen können ihre Zeilen- und Spaltenbeziehungen verlieren und Schriftart, Farbe, Abstände, Rahmen, Bilder und Seitenmöbel bleiben nicht als passendes Layout erhalten. Nutzen Sie das Ergebnis, um eine erneute Eingabe zu vermeiden, erstellen Sie dann die erforderliche Struktur in der Zielanwendung neu und vergleichen Sie wichtige Werte mit der Quelle, bevor Sie sich auf sie verlassen.
Warum kann die OCR-Verarbeitungszeit variieren?
Die Zeit hängt von den Bildabmessungen, der Anzahl und Größe der Textbereiche, der Komplexität des Layouts, der ausgewählten Sprache, der Rotation und den für die Vorbereitung der Erkennung erforderlichen Ressourcen ab. Ein großes Foto mit einem kleinen Dokument in der Mitte kann mehr Arbeit erfordern und dennoch einen schlechteren Text erzeugen als ein eng beschnittener Scan. Verwenden Sie das kleinste, klare Bild, das die benötigten Zeichen beibehält, beschneiden Sie irrelevante Bereiche und vermeiden Sie die wiederholte Vergrößerung bereits scharfer Quellen. Lassen Sie die Seite geöffnet, bis ein Ergebnis oder ein nützlicher Fehler angezeigt wird.
Wie soll ich extrahierten OCR-Text überprüfen?
Vergleichen Sie Namen, Daten, Adressen, Summen, Dezimaltrennzeichen, Kontonummern, Bezeichner, Satzzeichen und alle Zeichen, bei denen ein einzelner Fehler die Bedeutung ändert. Häufige Verwechslungen sind Null und O, Eins und Kleinbuchstabe „l“, ähnliche Satzzeichen, Buchstaben mit Akzent und visuell verwandte Zeichen in CJK- oder arabischen Schriften. Überprüfen Sie die Zeilenreihenfolge und den fehlenden Text rund um Bilder oder Tabellen. Führen Sie bei juristischem, finanziellem, medizinischem, akademischem oder archivarischem Material eine zweite Überprüfung des Originalbilds durch, bevor Sie das Ergebnis in einen anderen Datensatz kopieren.