Bilder aus PDF extrahieren

PDF hochladen

Laden Sie eine PDF hoch und stellen Sie jedes eingebettete Bild in seiner ursprünglichen Auflösung wieder her. Der Extraktor durchläuft den PDF-Objektbaum, findet /XObject /Image-Einträge und exportiert jedes von ihnen als PNG, kein Screenshot, kein Qualitätsverlust durch das Rasterisieren der gesamten Seite. Funktioniert mit Scans, bildlastigen Berichten, Produktkatalogen und Broschüren.

So extrahieren Sie Bilder aus einer PDF

  1. 1

    Laden Sie die PDF hoch

    Legen Sie eine einzelne Datei ab; verschlüsselte PDFs müssen zuerst entsperrt werden.

  2. 2

    Scannen Sie den Objektbaum

    Der Extraktor zählt jedes Bild-XObject über alle Seiten hinweg auf.

  3. 3

    Vorschau der Ergebnisse

    Sie sehen jedes Bild als Miniaturansicht mit seiner Seitenzahl und seinen Abmessungen.

  4. 4

    Einzeln oder als ZIP herunterladen

    Holen Sie sich ein einzelnes Asset oder exportieren Sie alles in einem Archiv, benannt `image-p1-1.png`.

Wie Bilder in einer PDF gespeichert sind

Eine PDF speichert Bilder als separate Ressourcen (/XObject-Streams), die aus dem Seiteninhalt referenziert werden. Der Extraktor liest jeden Stream in seiner nativen Kodierung und rekonstruiert die Datei, die der Autor eingebettet hat.

Formate, die Sie sehen werden

PDF-Filter Was Sie erhalten Typische Quelle
/DCTDecode PNG (aus einem JPEG) Fotos, Produktaufnahmen, Scans
/FlateDecode + RGB PNG Logos, Diagramme, UI-Screenshots
/JPXDecode PNG (aus JPEG 2000) Hochauflösende Archivscans
/CCITTFaxDecode PNG (aus einem Scan) Schwarz-weiß gescannte Texte
/JBIG2Decode PNG (konvertiert) Komprimierte gescannte Dokumente

Der Extraktor liefert immer PNG: Er kodiert die Rohpixel in Ihrem Browser neu, daher kommen JPEG-, JPEG-2000- und CCITT-Quellen ebenfalls als PNG an.

Was nicht wiederhergestellt wird

  • Vektorillustrationen. Logos, die mit PDF-Pfadoperatoren gezeichnet wurden, sind keine Bilder, sie leben im Inhaltsstrom, nicht als XObjects. Verwenden Sie ein PDF-zu-SVG-Tool dafür.
  • Hintergrundfarben und -verläufe. Diese sind Zeichnungen auf Seitenebene, keine eingebetteten Assets.
  • Text, der als Umrisse gerendert wird. Sieht aus wie “Grafiken”, ist aber kein Bildobjekt.

Tipps beim Arbeiten mit dem Export

  • Überprüfen Sie die Abmessungen. Eine 300x300 Miniaturansicht auf der Seite kann tatsächlich ein 3000x3000 Original sein, das zur Renderzeit verkleinert wurde. Sie erhalten die Quellpixel, nicht die Anzeigegröße.
  • Respektieren Sie die Lizenz. Die Möglichkeit, ein Bild zu extrahieren, gewährt keine Rechte zur Wiederverwendung. Stockbilder in einer PDF bleiben Stockbilder, wenn sie herausgezogen werden.
  • Gescannte Dokumente. Wenn jede Seite ein riesiges Bild mit eingebettetem Text erzeugt, ist die PDF ein Scan. Führen Sie OCR auf den exportierten PNGs aus, um den Text wiederherzustellen.

Häufig gestellte Fragen

PDF-Seiten können eine Transformationsmatrix anwenden, wie ein Bild gezeichnet wird (umdrehen, drehen, schräg). Der Extraktor gibt das gespeicherte Bitmap zurück, rohe Pixel. Wenn ein Herausgeber das Bild auf dem Kopf gespeichert hat und es zur Renderzeit umgedreht hat, wird der Export auf dem Kopf aussehen. Drehen Sie es in einem beliebigen Bildbearbeitungsprogramm zurück.

Nur nachdem Sie sie entsperrt haben. Führen Sie die Datei zuerst durch ein PDF-Entsperr-Tool, indem Sie das Besitzerpasswort angeben, und extrahieren Sie dann.

Ja. Die Bilder werden in Seitenreihenfolge hinzugefügt, und jeder Dateiname trägt seine Seitenzahl, zum Beispiel image-p1-2.png, sodass Sie erkennen, von welcher Seite jedes Bild stammt.

Nein. Die PDF-Quelldatei wird vollständig in Ihrem Browser geöffnet und gelesen und niemals an den Server gesendet. Nur das erzeugte ZIP mit den extrahierten Bildern wird hochgeladen, um das sitzungsgeschützte Ergebnis zu erstellen; es wird bis zu 7 Tage aufbewahrt und danach gelöscht.

Verwandte Tools

Tool in anderen Sprachen verfügbar