PDF vergleichen

Deine PDFs werden nur in diesem Browser gelesen. Im mehrstufigen Ablauf verfallen sie nach 30 Minuten und werden bei geöffneter Seite oder beim nächsten Öffnen des Tools entfernt. Sie gelangen weder in die Seitenadresse noch an unseren Server.

Vergleiche den extrahierbaren Text zweier PDF-Versionen, ohne ein Dokument hochzuladen. Das Tool liest jede Seite mit PDF.js, vereinheitlicht Leerraum und markiert Text, der nur in der früheren oder überarbeiteten Datei vorkommt.

So vergleichst du zwei PDFs

  1. 1

    Frühere Datei wählen

    Wähle PDF A mit höchstens 25 MB und 200 Seiten.

  2. 2

    Überarbeitung wählen

    Wähle PDF B. Im mehrstufigen Ablauf bleiben beide Dateien höchstens 30 Minuten im privaten Browserspeicher.

  3. 3

    Geänderte Seiten prüfen

    Der Browser extrahiert den Text nach Seiten und markiert entfernte Passagen rot sowie hinzugefügte Passagen blau.

Was der Vergleich erkennt

Das Ergebnis vergleicht den Text, den PDF.js aus denselben Seitennummern extrahieren kann. Das hilft bei Verträgen, Berichten, Korrekturabzügen und Entwürfen, deren Wortlaut geändert wurde. Leerraum wird vor dem Vergleich vereinheitlicht, damit bloße Zeilenumbrüche weniger Störungen erzeugen.

Was nicht verglichen wird

Dies ist kein visueller oder semantischer Vergleich. Schriftarten, Layout, Bilder, Anmerkungen, Formularwerte, Metadaten und die Gültigkeit digitaler Signaturen werden nicht geprüft. Eine gescannte PDF kann ohne vorhandene OCR-Textebene keinen extrahierbaren Text enthalten. Wurde etwa ein Deckblatt eingefügt, werden die folgenden Seiten mit abweichenden Seitennummern verglichen.

Datenschutz und Grenzen

Dateien und extrahierter Text bleiben in deinem Browser und werden nicht an unseren Server gesendet. Im mehrstufigen Ablauf speichert der Browser beide Dateien höchstens 30 Minuten lokal. Mit „Alles löschen“ entfernst du sie früher. Pro Datei gelten 25 MB, 200 Seiten und 2.000.000 extrahierte Zeichen als Obergrenze.

Häufig gestellte Fragen

Nur wenn der Scan bereits eine OCR-Textebene enthält. Dieses Tool führt selbst keine OCR durch.

Nein. Es bedeutet nur, dass der extrahierbare Text nach Vereinheitlichung des Leerraums übereinstimmt. Visuelle Elemente und die PDF-Struktur können abweichen.

Nein. PDF.js liest sie lokal. Der mehrstufige Ablauf nutzt bis zu 30 Minuten privaten Browserspeicher, keinen Serverspeicher.

PDF speichert positionierte Zeichenanweisungen statt Absätze. Spalten, Tabellen und Formulare können deshalb in unerwarteter Reihenfolge extrahiert werden.

Verwandte Tools