MV Tools

OCR-Anleitung

Gescannte Dokumente für eine genauere OCR vorbereiten

Eine praktische Vorab-Checkliste für gescannte Bilder und PDFs mit überprüfbaren Ergebnissen statt Genauigkeitsversprechen.

MV Tools RedaktionAktualisiert 8 Min. Lesezeit

Erweitertes Bild-OCR öffnen

Legen Sie zuerst die benötigte Ausgabe fest

Für ein Bild, aus dem Sie Text, Zeilenkonfidenz und JSON benötigen, verwenden Sie Erweitertes Bild-OCR. PDF-OCR eignet sich für durchsuchbare PDFs, Scanned PDF to Word für einen bearbeitbaren DOCX-Entwurf. Kein Werkzeug ersetzt die menschliche Prüfung, besonders bei Namen, Beträgen, IDs, Rechtstexten und Tabellen.

Diese Anleitung nutzt Erweitertes Bild-OCR, weil TXT, strukturiertes JSON, Zeilenanzahl und durchschnittliche Konfidenz ausgegeben werden. So sehen Sie, was erkannt wurde und wo Sie mit der Kontrolle beginnen.

Selbst erstellter deutscher Scan. Absätze, Zahlen, Statuswörter und Tabellenlinien eignen sich zum gezielten Prüfen.
Selbst erstellter deutscher Scan. Absätze, Zahlen, Statuswörter und Tabellenlinien eignen sich zum gezielten Prüfen.

Machen Sie den Scan leichter lesbar

Beginnen Sie mit der schärfsten verfügbaren Quelle. Halten Sie die Seite gerade, vermeiden Sie Schatten und Reflexionen, schneiden Sie große leere Ränder ab und bewahren Sie genug Auflösung für kleine Schrift. Ein klarer Scan von vorn ist meist besser als ein größeres, aber unscharfes Foto.

Das Beispiel enthält absichtlich Text, Zahlen, Statuswörter und Tabellenlinien, damit Sie jeden Bereich nach der Erkennung vergleichen können. Laden Sie keine Ausweise, Verträge oder privaten Fotos nur zum Testen hoch.

  • Verwenden Sie möglichst den Originalscan statt eines Screenshots von einem Screenshot.
  • Bei Handyfotos: Seite glätten, gleichmäßig beleuchten und Perspektive vermeiden.
  • Bei gemischten Sprachen die passendste Sprache wählen und die andere manuell prüfen.
  • Vor einer ganzen Sammlung zuerst eine repräsentative schwierige Seite testen.

Bild hochladen, Sprache und Vorverarbeitung wählen

Öffnen Sie oben Erweitertes Bild-OCR. Die Screenshots stammen aus der echten Desktop-Oberfläche; auf kleinen Bildschirmen stehen die Felder untereinander, die Reihenfolge bleibt gleich.

  1. Ein Bild auswählen.

    Wählen Sie mvtools-ocr-scan.png im Bildeingabefeld. Die Auswahl startet die Erkennung noch nicht.

  2. Die passendste OCR-Sprache wählen.

    Dieses Beispiel verwendet Deutsch. Die Sprache verändert Modell und Zeicheninterpretation; Abschnitte in anderen Sprachen besonders prüfen.

  3. Vorverarbeitung bei schwierigen Aufnahmen aktivieren.

    Im Beispiel ist sie aktiviert. Sie kann bei geringem Kontrast, ungleichmäßigem Licht oder Fotos helfen, fehlende Details aber nicht wiederherstellen.

Abbildung 1 · Dateinamen prüfen, passende Sprache wählen und Vorverarbeitung bewusst aktivieren oder deaktivieren.
Abbildung 1 · Dateinamen prüfen, passende Sprache wählen und Vorverarbeitung bewusst aktivieren oder deaktivieren.

OCR starten und das Ergebnis lesen

Klicken Sie auf PaddleOCR ausführen und warten Sie, bis der Vorgang abgeschlossen ist. Während der Verarbeitung nicht mehrfach senden. Danach Status, Sprache, Zeilenanzahl und Konfidenz lesen, bevor TXT oder JSON geladen wird.

  1. Abschluss der Aufgabe bestätigen.

    COMPLETED bedeutet, dass Ergebnisdateien erzeugt wurden; nicht, dass jedes Zeichen stimmt.

  2. Konfidenz als Hinweis verwenden.

    Dieses Beispiel erreicht 99,4 %. Prüfen Sie zuerst kontrastarme Kleinschrift, Zahlen, Symbole und Tabellenränder.

  3. Beide Ergebnisformate laden.

    TXT eignet sich zum Lesen und Bearbeiten. JSON enthält Konfidenz, Boxen und strukturierte Details für eine genauere Kontrolle.

Abbildung 2 · Ein echter deutscher Durchlauf erkannte 18 Zeilen aus einem 104-KB-Bild mit 99,4 % durchschnittlicher Konfidenz.
Abbildung 2 · Ein echter deutscher Durchlauf erkannte 18 Zeilen aus einem 104-KB-Bild mit 99,4 % durchschnittlicher Konfidenz.

Quelle, Text und Struktur miteinander vergleichen

Lesen Sie die TXT-Datei vollständig und öffnen Sie danach JSON, um confidence, box und polygon jeder Zeile zu prüfen. Vergleichen Sie Quelle und Ausgabe nebeneinander, zuerst an den für Ihre Aufgabe wichtigsten Stellen.

Die Seite zeigt eine Vorschau dieses Ergebnisses. Sie ersetzt nicht die Kontrolle der vollständigen Dateien; laden Sie Scan, TXT und JSON aus dem Beispiel herunter.

Abbildung 3 · Die TXT-Vorschau hilft beim ersten Lesen; Zahlen, Symbole und Tabellen müssen dennoch mit dem Original verglichen werden.
Abbildung 3 · Die TXT-Vorschau hilft beim ersten Lesen; Zahlen, Symbole und Tabellen müssen dennoch mit dem Original verglichen werden.
  • Text: fehlende, doppelte oder ersetzte Zeichen und ungewöhnliche Leerzeichen suchen.
  • Zahlen und Symbole: IDs, Daten, Dezimalpunkte, Bindestriche und Einheiten einzeln prüfen.
  • Struktur: Tabellenzeilen und -spalten, Absatzreihenfolge, Stempel, Unterschriften und Handschrift prüfen.
  • Zweck: sicherstellen, dass die Ausgabe zum Bearbeiten, Suchen oder Archivieren passt; Originalscan aufbewahren.
Selbst erstellter deutscher Scan. Absätze, Zahlen, Statuswörter und Tabellenlinien eignen sich zum gezielten Prüfen.
Selbst erstellter deutscher Scan. Absätze, Zahlen, Statuswörter und Tabellenlinien eignen sich zum gezielten Prüfen.
Abbildung 3 · Die TXT-Vorschau hilft beim ersten Lesen; Zahlen, Symbole und Tabellen müssen dennoch mit dem Original verglichen werden.
Abbildung 3 · Die TXT-Vorschau hilft beim ersten Lesen; Zahlen, Symbole und Tabellen müssen dennoch mit dem Original verglichen werden.

Grenzen, Datenschutz und das nächste Werkzeug

Erweitertes Bild-OCR akzeptiert ein JPG-, PNG-, TIFF-, BMP- oder WebP-Bild bis 25 MB; die Standardzeitüberschreitung beträgt fünf Minuten. PDF-OCR verarbeitet PDFs bis 100 MB und 100 Seiten, Scanned PDF to Word bis 100 MB und 50 Seiten. Verschlüsselte oder beschädigte PDFs können fehlschlagen.

Die Aufgaben laden Dateien auf den Server. Sie werden normalerweise 30 Minuten aufbewahrt und anschließend gelöscht. Ergebnisse zeitnah laden, Aufgabenlinks nicht als dauerhaften Speicher verwenden und nur zur Verarbeitung berechtigte Dateien hochladen.

SituationNächster Schritt
Kleine Schrift, Zahlen oder Tabellen sind falschQuelle, Ausrichtung und Licht verbessern und mit einer repräsentativen Seite erneut testen.
PDF enthält bereits auswählbaren TextOCR meist überspringen und die vorhandene Textebene verwenden, um neue Fehler zu vermeiden.
Durchsuchbares PDF benötigtPDF-OCR verwenden und prüfen, ob die Textebene zu den richtigen Seiten passt.
Bearbeitbaren Entwurf benötigtScanned PDF to Word verwenden und die DOCX-Datei absatzweise als Entwurf prüfen.

Häufige Fragen

Bedeutet eine hohe Konfidenz, dass der Text sicher korrekt ist?

Nein. Sie hilft bei der Prüfpriorität, garantiert aber weder Bedeutung, Namen, Zahlen noch Layout.

Braucht ein elektronisches PDF mit auswählbarem Text OCR?

Meist nicht. OCR ist für Scans und Bildseiten gedacht; ein erneuter Lauf kann Fehler hinzufügen.

Warum kann die Reihenfolge einer Tabelle falsch sein?

OCR liest visuelle Bereiche statt der ursprünglichen Struktur. Spalten prüfen und bei echten Tabellen ein Tabellenwerkzeug verwenden.