PDF-OCR

Extrahieren Sie Text aus einem gescannten PDF mittels optischer Zeichenerkennung.

PDF-Datei hierher ziehen oder klicken, um eine auszuwählen

Unterstützt PDF-Dateien

Anwendungsbeispiele

Text aus einem gescannten Papierdokument holen

Nachdem Sie ein Papierdokument als PDF gescannt oder fotografiert haben, erkennen Sie den darin enthaltenen Text, um ihn kopieren und bearbeiten zu können.

Ein PDF ohne Textebene lesen

OCR kann Inhalte aus reinen Bild-PDFs extrahieren, die ein normales PDF-zu-Text-Tool nicht verarbeiten kann, da kein eingebetteter Text vorhanden ist.

Ein Dokument in einer bestimmten Sprache erkennen

Wählen Sie die passende Sprache, etwa Englisch, Koreanisch oder Japanisch, um die Erkennungsgenauigkeit für dieses Dokument zu verbessern.

Häufig gestellte Fragen

Wird mein hochgeladenes PDF an einen Server gesendet?

Nein. Das Umwandeln des PDFs in Bilder und die Texterkennung erfolgen vollständig in Ihrem Browser, und das hochgeladene PDF oder sein Inhalt werden niemals an einen Server gesendet. Die einzige Ausnahme: Die Erkennungsmodell-Datei für Ihre gewählte Sprache wird bei der ersten Nutzung einmalig von einem öffentlichen CDN heruntergeladen — das ist nur eine generische Programmdatei, unabhängig vom Inhalt Ihres Dokuments.

Kann ich es bei einem normalen PDF mit vorhandenem Text verwenden?

Sie können, aber wenn das PDF bereits eine Textebene hat, ist unser PDF-zu-Text-Tool schneller und genauer. OCR ist für reine Bild-PDFs gedacht, wie gescannte Dokumente.

Wie genau ist die Erkennung?

Das hängt von Scanqualität, Schriftart und Schärfe ab. Hochauflösende, scharfe Dokumente werden genauer erkannt, während Handschrift oder unscharfe Scans weniger genau erkannt werden können.

Wie lange dauert ein langes PDF?

Seiten werden nacheinander erkannt, daher steigt die Zeit mit der Seitenzahl. Sie können die Verarbeitung jederzeit abbrechen, wenn es zu lange dauert.