PDF in Excel umwandeln

PDF zu Excel

PDF, extrahierte Tabellen und Downloads bleiben in diesem Browser.

Private Browsersitzung wird wiederhergestellt...

PDF auswählen

Textbasierte PDF, höchstens 20 MiB und 150 Seiten. Scans benötigen zuerst OCR.

Tabellen in der PDF werden erkannt...

Es wurde keine regelmäßige Texttabelle gefunden. Scans benötigen OCR, und unregelmäßige Layouts müssen eventuell manuell bereinigt werden.

Wandle regelmäßige Tabellen aus einer textbasierten PDF-Datei in Tabellenkalkulationsdateien um, ohne das Dokument hochzuladen. Der Konverter erkennt rechteckige Tabellen anhand der Positionen des auswählbaren PDF-Texts, hält wahrscheinliche Tabellen getrennt und lässt dich diese vor dem Export prüfen und auswählen. Lade eine XLSX-Arbeitsmappe mit einem Tabellenblatt pro ausgewählter Tabelle herunter oder speichere jede Tabelle als CSV beziehungsweise TSV. Scans benötigen zuerst OCR, und unregelmäßige Layouts müssen eventuell manuell nachbearbeitet werden.

So wandelst du eine PDF-Tabelle in Excel um

  1. 1

    Textbasierte PDF auswählen

    Wähle eine echte PDF-Datei mit höchstens 20 MiB und 150 Seiten. Der Text muss auswählbar sein; ein reiner Bildscan benötigt zuerst OCR.

  2. 2

    Erkannte Tabellen prüfen

    Die lokale Erkennung sucht nach mindestens zwei Zeilen mit stabilen Spaltenpositionen. Wähle nur Tabellen aus, deren Vorschau mit der Quelldatei übereinstimmt.

  3. 3

    CSV-Optionen festlegen

    Wähle für CSV oder TSV Komma, Semikolon oder Tabulator, entscheide dich für oder gegen eine UTF-8-BOM und lasse den Formelschutz eingeschaltet, sofern du der Quelle nicht vertraust.

  4. 4

    Lokal herunterladen

    Lade eine XLSX-Arbeitsmappe mit den ausgewählten Tabellen herunter oder speichere jede ausgewählte Tabelle als eigene CSV- oder TSV-Datei.

Was die Erkennung wiederherstellen kann und was nicht

PDF-Seiten speichern positionierten Text, keine Tabellenzellen. Dieser Konverter fasst nahe beieinanderliegenden Text zu Zeilen zusammen, sucht nach wiederkehrenden Spaltenankern, füllt fehlende Zellen auf und verwirft Blöcke, die keiner regelmäßigen Tabelle ähneln. Beim Lesen der Positionen berücksichtigt er außerdem die Seitendrehung und den sichtbaren Seitenbereich.

PDF-Inhalt Wahrscheinliches Ergebnis Das solltest du prüfen
Einfache Tabelle mit zwei oder mehr ausgerichteten Spalten Wird meist als rechteckige Tabelle erkannt Vergleiche Überschriften, Zeilenfolge und leere Zellen mit der PDF-Datei
Mehrere getrennte Tabellen auf einer oder mehreren Seiten Bleiben als einzelne auswählbare Tabellen erhalten Wähle nur die Tabellen aus, die du in der Arbeitsmappe brauchst
Regelmäßige Tabelle mit Schreibrichtung von rechts nach links Bleibt in der visuellen Reihenfolge von rechts nach links erhalten Prüfe Zahlen und Zellen mit gemischten Schriften in der Vorschau
Absätze, Überschriften sowie Kopf- und Fußzeilen Werden meist ausgeschlossen, weil sie keine Tabelle bilden Vergewissere dich, dass kein anderer Textblock aufgenommen wurde
Verbundene Zellen, verschachtelte Tabellen oder mehrzeilige Datensätze Können geteilt, verschoben oder verworfen werden Bereinige das Tabellenblatt manuell oder nutze ein spezialisiertes Extraktionsprogramm
Reiner Bildscan, Handschrift oder fotografierter Beleg Kein auswählbarer Tabellentext zur Erkennung vorhanden Führe zuerst OCR aus und versuche es mit der durchsuchbaren PDF-Datei erneut

Die Erkennung arbeitet absichtlich zurückhaltend. Es ist besser, keine Tabelle zu melden, als fremden Seitentext in eine überzeugend wirkende, aber falsche Tabelle umzuwandeln. Vergleiche wichtige Werte immer mit der Quell-PDF, bevor du damit rechnest, sie importierst oder einen Abgleich vornimmst.

Exportformate

XLSX erstellt ein Tabellenblatt pro ausgewählter Tabelle, mit höchstens 200 Tabellenblättern in einem Download. Jeder extrahierte Wert wird als Textzelle geschrieben. Der Konverter erkennt Zahlen, Datumswerte, Formeln, Währungen oder Buchhaltungsformate nicht automatisch und bildet weder Rahmen und Schriftarten noch verbundene Zellen oder das ursprüngliche Seitendesign nach.

CSV und TSV laden jede ausgewählte Tabelle separat herunter. Als Trennzeichen stehen Komma, Semikolon und Tabulator zur Verfügung. Felder mit einem Trennzeichen, Anführungszeichen oder Zeilenumbruch werden in doppelte Anführungszeichen gesetzt. Datensätze nutzen entsprechend den üblichen Regeln in RFC 4180 CRLF-Zeilenenden. Eine UTF-8-BOM ist standardmäßig aktiviert, um die Kompatibilität mit Tabellenkalkulationen zu verbessern. Welches Trennzeichen richtig ist, hängt dennoch vom Importprogramm und dessen Regionseinstellungen ab.

Schutz vor Tabellenformeln

Eine PDF-Datei kann Text enthalten, der mit =, +, - oder @ beginnt. Manche Tabellenkalkulationen interpretieren diesen Text beim Öffnen einer CSV-Datei als Formel. Der Formelschutz ist standardmäßig aktiviert und stellt formelähnlichen CSV-Zellen ein Zeichen voran, damit sie eher als Text erhalten bleiben. Das gilt auch für Zellen mit führenden Leerzeichen oder vollbreiten Varianten dieser Zeichen.

Diese Maßnahme verringert das Risiko, ist aber keine allgemeingültige Sicherheitsgarantie. Der OWASP-Leitfaden zur CSV Injection weist darauf hin, dass Tabellenprogramme unterschiedlich reagieren und dass sich die Maskierung nach erneutem Speichern und Öffnen verändern kann. Lasse den Schutz bei nicht vertrauenswürdigen PDFs eingeschaltet, prüfe die exportierten Zellen und aktiviere keine Makros oder ignoriere Sicherheitswarnungen. Die XLSX-Ausgabe schreibt extrahierte Werte ausdrücklich als Textzellen und nicht als Formeln.

Grenzen und privater Browserspeicher

  • Jeweils eine PDF-Datei mit höchstens 20 MiB und 150 Seiten.
  • PDFs mit übermäßig vielen Textfragmenten, einer zu großen Textmenge oder zu vielen Tabellendaten werden abgelehnt, bevor sie den Browser überlasten können.
  • Die Vorschau zeigt die ersten 100 Zeilen jeder erkannten Tabelle; der Export enthält alle erkannten Zeilen innerhalb der Sicherheitsgrenzen.
  • Eine Arbeitsmappe kann höchstens 200 ausgewählte Tabellenblätter enthalten.
  • Kennwortgeschützte und verschlüsselte PDFs werden nicht unterstützt. Entsperre eine zulässige Kopie, bevor du den Konverter verwendest.
  • Während des Ablaufs mit drei Schritten werden Quell-PDF, erkannte Tabellen und Einstellungen 30 Minuten lang privat in diesem Browser gespeichert. Es bleiben höchstens drei Aufträge und 80 MiB lokale Auftragsdaten erhalten.
  • In der Funnel-URL erscheint nur eine zufällige Auftragskennung. PDF, extrahierte Werte und Downloads werden weder über unsere Server übertragen noch auf den Ergebnisserver hochgeladen.
  • Neu starten entfernt den aktuellen lokalen Auftrag. Abgelaufene oder ungültige Datensätze werden gelöscht, wenn das Werkzeug den Browserspeicher das nächste Mal prüft.

Die PDF-Datei wird über PDF.js direkt aus ihren lokalen Bytes geladen. Das Werkzeug lädt seine Programmbibliotheken als normale Webressourcen herunter, sendet die ausgewählte PDF-Datei dabei jedoch nicht mit.

Barrierefreie Prüfung

Die Dateiauswahl lässt sich mit der Tastatur bedienen, Fortschritt und Fehler werden für Hilfstechnologien angesagt, und erkannte Tabellen verwenden Beschriftungen und Spaltenköpfe. Auf kleinen Bildschirmen kann die Vorschau horizontal gescrollt werden. Bei Tabellen mit Schreibrichtung von rechts nach links bleibt die erkannte Richtung erhalten. Diese Funktionen unterstützen die Prüfung, ersetzen bei wichtigen Daten aber nicht den Vergleich mit der Quelle.

Häufig gestellte Fragen

Die Erkennung benötigt auswählbaren Text in mindestens zwei Zeilen mit stabilen Spaltenpositionen. Ein Scan, ein einzeiliges Layout, ein aus Zeichenobjekten aufgebautes Formular oder eine unregelmäßige Tabelle erfüllt diese Bedingung möglicherweise nicht. Führe bei reinen Bildseiten zuerst OCR aus oder nutze für komplexe Layouts ein spezialisiertes Tabellenwerkzeug.

Nein. Er liest den Text, der bereits in der PDF-Datei eingebettet ist. Wenn sich der Tabellentext in einem PDF-Programm nicht auswählen oder kopieren lässt, erstelle zuerst per OCR eine durchsuchbare PDF-Datei und versuche es mit dieser Kopie erneut.

Wähle XLSX, wenn alle ausgewählten Tabellen in einer Arbeitsmappe mit einem Blatt pro Tabelle liegen sollen. CSV ist eine breit unterstützte Textdatei für Importe. Tabulatorgetrenntes TSV eignet sich, wenn die Daten viele Kommas oder Semikolons enthalten oder das Zielprogramm ausdrücklich Tabulatoren verlangt.

Der Konverter bewahrt die extrahierten Zeichen, anstatt ihre Bedeutung zu erraten. Ein Wert wie 1,234.56 oder 01/02/2026 kann je nach Region etwas anderes bedeuten. Wandle die Spalte nach Prüfung der Dezimal- und Datumskonventionen gezielt in deiner Tabellenkalkulation um.

Ist er aktiviert, stellt er CSV-Zellen, die wie Formeln beginnen, ein Zeichen voran. Dazu zählen =, +, -, @ und ihre vollbreiten Varianten nach möglichem führendem Leerraum. Dies verringert eine unbeabsichtigte Formelausführung, kann aber nicht in jedem Tabellenprogramm oder nach jedem erneuten Speichern sicheres Verhalten garantieren. Lasse den Schutz bei nicht vertrauenswürdigen Daten eingeschaltet und prüfe das Ergebnis.

Nein. Quell-PDF, erkannte Tabellen sowie XLSX-, CSV- und TSV-Dateien bleiben in deinem Browser. Ein Funnel-Auftrag wird 30 Minuten lang im Browserspeicher abgelegt, und nur seine zufällige Kennung steht in der URL. Neu starten entfernt den aktuellen lokalen Auftrag.

Ja. Das Werkzeug kann getrennte regelmäßige Tabellen in einer PDF-Datei erkennen. Wähle die benötigten Tabellen aus und lade eine XLSX-Arbeitsmappe mit bis zu 200 Tabellenblättern herunter, oder speichere jede ausgewählte Tabelle einzeln als CSV oder TSV.

Nicht immer. Die Seitendrehung wird berücksichtigt, doch vertikale Beschriftungen, verschachtelte Tabellen, verbundene Zellen, mehrzeilige Datensätze und dekorative Layouts können weiterhin verrutschen oder verworfen werden. Nutze die Vorschau, gleiche Summen mit der PDF-Datei ab und bereinige das Tabellenblatt, bevor du dich darauf verlässt.

Verwandte Tools