PDF-OCR
Diese OCR-Sitzung ist nicht mehr verfügbar
Gescannte PDF auswählen
Nur PDF · 20 MB · 40 Seiten
oder legen Sie hier eine PDF ab
Dieses Tool eignet sich für PDFs, die aus gescannten Seitenbildern statt aus auswählbarem Text bestehen. Es rendert die Seiten im Browser, führt dort eine optische Zeichenerkennung (OCR) durch und zeigt den erkannten Klartext zum Prüfen, Kopieren oder Speichern als .txt-Datei an. Das Quell-PDF bleibt auf Ihrem Gerät. Das Tool erstellt kein durchsuchbares PDF und erhält das Seitenlayout nicht; außerdem kann der erkannte Text Fehler enthalten.
So extrahieren Sie Text aus einem gescannten PDF
-
1
Dokumentsprache wählen
Wählen Sie die Hauptsprache des gedruckten Textes. Dadurch wird festgelegt, welches OCR-Modell der Browser verwendet.
-
2
PDF öffnen
Wählen Sie ein PDF mit höchstens 20 MB und 40 Seiten. Die Quelldatei bleibt im Browser und wird nicht an unseren Server gesendet.
-
3
Erkennung abwarten
Der Browser rendert jede Seite und liest sie mit dem gewählten OCR-Modell. Die Modelldateien müssen eventuell vor Beginn heruntergeladen werden.
-
4
Ergebnis prüfen
Vergleichen Sie Namen, Zahlen und wichtige Passagen mit den Originalseiten. OCR ist ein Hilfsmittel und keine verlässliche Abschrift für kritische Zwecke.
-
5
Text kopieren oder herunterladen
Kopieren und der lokale TXT-Download lassen das Ergebnis im Browser. Nur die optionale Download-Seite lädt die abgeleitete Textdatei für einen geschützten Link hoch.
Was dieses Tool ausgibt
Die Ausgabe ist Klartext. Vor dem erkannten Text jeder Seite steht eine Seitenmarkierung. Das Tool:
- fügt dem PDF keine unsichtbare Textebene hinzu
- rekonstruiert weder Spalten, Tabellen, Formulare noch die ursprüngliche Typografie
- erhält das visuelle Seitenlayout nicht
- übersetzt das Dokument nicht
- prüft nicht, ob der erkannte Text korrekt ist
Wenn die gescannten Seiten erhalten bleiben und im Hintergrund durchsuchbarer Text hinzukommen soll, verwenden Sie eine spezielle Anwendung für durchsuchbare PDFs oder ein OCR-Programm für den Desktop.
Welche Dokumente am besten funktionieren
OCR ist für gedruckten Text gedacht. Ein gerader, scharfer Scan mit gut lesbarem Kontrast lässt sich leichter erkennen als ein unscharfes Foto, ein verblasstes Fax oder eine beschädigte Seite. Schmuckschriften, Handschrift, mathematische Notation, eng gesetzte Spalten und komplexe Tabellen können zu fehlerhaftem oder ungeordnetem Text führen.
Das Tool akzeptiert PDFs mit bis zu 20 MB und 40 Seiten. Die Erkennung erfolgt seitenweise und kann besonders bei großen oder hochauflösenden Seiten viel Arbeitsspeicher beanspruchen. Reicht der Speicher des Browsers nicht aus, teilen Sie das PDF in kleinere Dateien auf und verarbeiten Sie diese einzeln.
Unterstützte OCR-Sprachen
Zur Auswahl stehen Englisch, Spanisch, Französisch, Deutsch, Italienisch, Portugiesisch, Niederländisch, Russisch, Japanisch, vereinfachtes Chinesisch, Koreanisch und Arabisch.
Wählen Sie die Hauptsprache des Dokuments, bevor Sie die Datei öffnen. Bei Seiten mit mehreren Sprachen oder Schriftsystemen können getrennte Durchläufe nötig sein. Ähnlich aussehende Zeichen können trotzdem verwechselt werden.
Erkannten Text prüfen
Vergleichen Sie das Ergebnis immer mit dem Original-PDF, bevor Sie sich darauf verlassen. Achten Sie besonders auf:
- Namen, Anschriften und Identifikationsnummern
- Daten, Beträge, Dezimaltrennzeichen und Minuszeichen
- rechtliche, medizinische, finanzielle oder sicherheitsrelevante Anweisungen
- Seitenumbrüche und Lesereihenfolge bei mehrspaltigen Dokumenten
Behandeln Sie die OCR-Ausgabe nicht als verbindliche Kopie eines wichtigen Dokuments.
Dateiverarbeitung und Downloads
Das Quell-PDF wird lokal im Browser gelesen. Es wird weder in die Funnel-URL aufgenommen noch an unseren Server gesendet. Ihr Browser kann die Bibliotheken zum Rendern von PDFs und für OCR sowie das gewählte Sprachmodell vom konfigurierten Bibliotheksanbieter herunterladen.
Beim Kopieren bleibt der erkannte Text im Browser und wird in die Zwischenablage geschrieben. TXT lokal herunterladen erstellt und speichert die .txt-Datei, ohne sie hochzuladen. Nur wenn Sie Download-Seite erstellen wählen, wird die abgeleitete TXT-Datei für einen geschützten Link hochgeladen und kann dort bis zu 7 Tage gespeichert werden. Der lokale Download bleibt verfügbar, falls dieser optionale Upload fehlschlägt.
Häufig gestellte Fragen
Nein. Das Quell-PDF bleibt im Browser, während die Seiten gerendert und erkannt werden. Der Browser kann die benötigten Bibliotheken zum Rendern und für OCR sowie das gewählte Sprachmodell herunterladen. Auch der lokale TXT-Download lädt keinen Text hoch; nur die optionale Download-Seite lädt die abgeleitete TXT-Datei hoch.
Nein. Das Ergebnis ist nach Seiten gruppierter Klartext. Das Tool verändert das Original-PDF nicht, fügt keine unsichtbare Textebene hinzu und erhält das Layout nicht.
Sie sollten es mit den Originalseiten vergleichen. OCR kann Zeichen verwechseln, Text auslassen und die Lesereihenfolge verändern. Prüfen Sie jedes Detail, bevor Sie die Ausgabe für rechtliche, medizinische, finanzielle, sicherheitsrelevante oder andere kritische Arbeiten verwenden.
Es ist für gedruckten Text ausgelegt. Handschrift, Gleichungen und Schmuckschriften können unzuverlässig erkannt werden. Zeichen innerhalb einer Tabelle werden möglicherweise erkannt, die Zeilen- und Spaltenstruktur bleibt im Klartext jedoch nicht erhalten.
Englisch, Spanisch, Französisch, Deutsch, Italienisch, Portugiesisch, Niederländisch, Russisch, Japanisch, vereinfachtes Chinesisch, Koreanisch und Arabisch. Wählen Sie die Hauptsprache vor dem Öffnen des PDFs.
Das PDF darf höchstens 20 MB groß sein und 40 Seiten enthalten. Große oder detailreiche Seiten können dennoch den verfügbaren Browserspeicher übersteigen. In diesem Fall hilft es, das Dokument in kleinere Dateien aufzuteilen.
TXT lokal herunterladen erstellt die .txt-Datei und speichert sie ohne Upload direkt auf Ihrem Gerät. Nur wenn Sie eine Download-Seite erstellen, wird diese abgeleitete TXT-Datei für einen geschützten Link hochgeladen und kann dort bis zu 7 Tage gespeichert werden.
Verwandte Tools
PDFs zusammenführen
Führen Sie mehrere PDFs zu einem Dokument zusammen, ordnen Sie Dateien und Seiten per Drag-and-drop und laden Sie das Ergebnis sofort herunter.
PDF-zu-PNG-Konverter
Rendern Sie PDF-Seiten als PNG-Dateien mit scharfem Text, Transparenzunterstützung und frei gewählter DPI. Ideal für Dokumentation und Vorschaubilder.
JPG in PDF umwandeln
Fassen Sie JPG-Bilder zu einer PDF-Datei zusammen und steuern Sie Seitenformat, Ausrichtung und Ränder für Verträge, Belege und Portfolios.
PDF in Excel umwandeln
Erkenne regelmäßige Tabellen in textbasierten PDFs und lade lokale XLSX-, CSV- oder TSV-Dateien herunter. Prüfe jede Tabelle. Limit: 20 MiB und 150 Seiten.
Leere Seiten zu PDF hinzufügen
Füge 1 bis 50 leere Seiten in ein bestehendes PDF ein. Wähle A4, Letter, Legal, A3 oder A5, Hoch- oder Querformat und die Position am Anfang, Ende oder vor oder nach einer Seitennummer.
Seiten aus PDF entfernen
Löschen Sie ausgewählte Seiten oder Seitenbereiche aus einer PDF. Geben Sie Nummern wie 2, 5-7 ein, lassen Sie mindestens eine Seite übrig und laden Sie eine gekürzte PDF herunter.