Deine Dateien bleiben auf deinem Gerät

Dateien werden in deinem Browser verarbeitet und nicht auf unsere Server hochgeladen. Die Website kann Verarbeitungs-Engines herunterladen und Nutzungs- oder Feedback-Ereignisse ohne Dateiinhalte senden.

So gehen wir mit deinen Daten um →

OCR für PDF: durchsuchbares PDF erstellen

OCR für PDF: Füge einem gescannten Bericht mit bis zu 10 Seiten und 10 MiB auswählbaren Text hinzu, in Deutsch, Englisch, Spanisch oder Russisch. Deine Dateien bleiben in deinem Browser.

Erkennungsdateien ≈ 26 MB bei der ersten Nutzung, zuzüglich Sprachdaten.

PDF · bis 10 MiB, 10 Seiten. Text bis 1 MiB; durchsuchbares PDF bis 30 MiB.

Erkannter Text

Beispiel ausprobieren

Beispiel herunterladen

Lass die Sprache Deutsch eingestellt. Lade das PDF herunter und suche nach RECHNUNG, 148,50, Müller, LIEFERUNG und 2048. Beide Seiten sollten wie das Beispiel aussehen, mit Text, den du auswählen und kopieren kannst; Umlaute und ß bleiben erhalten.

Was du erwarten kannst

Jede Seite wird der Reihe nach als Bild erkannt. Englisch, Russisch und gemischte Erkennung stehen zur Verfügung. OCR kann Buchstaben, Zahlen, Spalten und Tabellen falsch lesen: Prüfe das Ergebnis. Dabei entsteht aus gerenderten Seitenbildern und einer unsichtbaren Textebene ein neues PDF. Sichtbare Seitengröße und Drehung bleiben erhalten; Formulare, Links, Lesezeichen, Anhänge und digitale Signaturen bleiben nicht erhalten. Vorhandener Text wird neu erkannt; die Bildqualität ist durch die Renderauflösung begrenzt.

Seiten werden mit bis zu 4 Megapixeln gerendert. Das Laden und jeder Verarbeitungsschritt dürfen bis zu 90 Sekunden dauern; der gesamte Auftrag stoppt nach 10 Minuten. Leere Seiten werden im Text markiert. Es wird kein Download angeboten, wenn die Verarbeitung fehlschlägt oder kein Text erkannt wird.

Geschütztes PDF?Entsperre es zuerst mit seinem Passwort.

Beim ersten Durchlauf werden möglicherweise Konverterdateien heruntergeladen, das kann einen Moment dauern. Schlägt es fehl, prüfe deine Verbindung oder versuche es mit einer kleineren Datei. „Abbrechen“ stoppt die laufende Verarbeitung; du kannst eine andere Datei wählen und es erneut versuchen.

Engine-Lizenzen und Quellcode

Eine praktische Anleitung

Suche und zitiere Text aus dem Scan.

  1. Wähle den gescannten Bericht aus, höchstens 10 Seiten und 10 MiB.
  2. Wähle Deutsch, Englisch, Spanisch oder Russisch für die Erkennung.
  3. Suche im Ergebnis nach einer Überschrift, um die Textebene zu bestätigen.

Probiere dieses Beispiel aus

Erkenne eine gescannte Besprechungszusammenfassung mit 4 Seiten auf Englisch; die Suche nach einer Entscheidungsüberschrift auf Seite 3 sollte sie im entstandenen PDF finden.

Bevor du anfängst: Die Erkennung deckt nur Deutsch, Englisch, Spanisch und Russisch ab, mit höchstens 10 Seiten und 10 MiB; Scans mit niedriger Auflösung können Erkennungsfehler erzeugen.