Detektor für doppelte Dateinamen

Ein Ordnerexport zeigt report.pdf, report (1).pdf und report (2).pdf, und du möchtest bestätigen, was dupliziert wurde, bevor du aufräumst. Füge eine Dateinamensliste ein, ein Name pro Zeile, und dieses Werkzeug zählt, wie oft jeder Name vorkommt. Pfade werden ignoriert: verglichen wird nur der Dateiname am Ende jeder Zeile, und du entscheidest, ob die Groß-/Kleinschreibung zählt.

So findest du doppelte Dateinamen

  1. 1

    Liste einfügen

    Ein Dateiname pro Zeile. Enthält die Zeile einen vollständigen Pfad, wird nur der Dateiname am Ende verglichen.

  2. 2

    Übereinstimmungsoption wählen

    Lass "Groß-/Kleinschreibung ignorieren" aktiv, damit `IMG_1234.jpg` und `img_1234.JPG` als ein Name zählen, oder deaktiviere es für exakte Übereinstimmung.

  3. 3

    Duplikate erkennen

    Klicke auf den Button. Jeder Name, der mehr als einmal vorkommt, wird mit seiner Anzahl gruppiert.

  4. 4

    Ergebnis verwenden

    Die Ausgabe ist eine kurze CSV-Liste: Name, Anzahl. Kopiere sie in dein Bereinigungsskript oder deine Tabelle.

So funktioniert die Übereinstimmung

Einstellung Verhalten Beispiel
Groß-/Kleinschreibung ignorieren (Standard) Die Groß-/Kleinschreibung spielt keine Rolle IMG_1234.jpg = img_1234.JPG
Exakt Die Namen müssen identisch sein IMG_1234.jpg passt nur zu IMG_1234.jpg
Vollständige Pfade Nur der Dateiname am Ende wird verglichen /photos/IMG_1234.jpg = IMG_1234.jpg

Die Ausgabe listet jeden wiederholten Namen einmal mit seiner Anzahl. Namen, die nur einmal vorkommen, werden nicht aufgelistet.

Muster, die dieses Werkzeug erkennt

  • Browser-Download-Kopien. doc.pdf, doc (1).pdf und doc (2).pdf entstehen, wenn du dieselbe Datei wiederholt speicherst.
  • macOS-“Kopie”-Markierungen. file.jpg und file copy.jpg, file copy 2.jpg.
  • Windows-Duplikat-Suffixe. name - Copy.docx, name - Copy (2).docx.
  • Importe aus Kamerafoldern. Derselbe Name IMG_1234 landet in mehreren Jahresordnern, wenn der Kamera-Zähler zurückgesetzt wird.

Was das Werkzeug nicht tut

  • Kein Inhaltsvergleich. Zwei verschiedene Dateien mit dem Namen invoice.pdf gelten hier als Duplikate. Das Werkzeug vergleicht nur Namen, also prüfe den Inhalt, bevor du löschst.
  • Keine ähnlichen Namen. report.pdf und reprot.pdf sind verschiedene Namen und werden nicht gruppiert.
  • Keine besondere Behandlung von Endungen. photo.jpg und photo.png sind verschiedene Namen.
  • Kein Löschen. Das Werkzeug listet nur Namen und Anzahl; die Entscheidung liegt bei dir.

Nachdem du Duplikate gefunden hast

  1. Lösche nicht automatisch. Prüfe die Gruppen, besonders wenn die Namen häufig sind (report.pdf, image.jpg).
  2. Prüfe den Inhalt, bevor du löschst: vergleiche Dateigrößen oder einen Inhalts-Hash (SHA-256), um zu bestätigen, dass die Dateien tatsächlich gleich sind.
  3. Sichere zuerst, wenn die Dateien aus einem Archiv stammen, das du nicht ersetzen kannst.

Häufig gestellte Fragen

Nur Namen. Für eine inhaltsbasierte Duplikaterkennung brauchst du ein Hash-Werkzeug, das die tatsächlichen Dateibytes liest. Dieser Detektor arbeitet mit einfachen Dateinamenslisten, wie sie aus Verzeichnisexporten stammen.

Ja. Enthält eine Zeile einen Pfad, wird nur der Dateiname am Ende verglichen; die Ordnerteile werden ignoriert.

Weil “Groß-/Kleinschreibung ignorieren” standardmäßig aktiv ist. Schalte es ab, dann behandelt das Werkzeug die beiden Namen als verschieden.

Ja. Die Liste wird an unseren Server gesendet, damit die Erkennung laufen kann, und das Ergebnis wird auf der Seite angezeigt. Die Liste wird danach nicht gespeichert.

Verwandte Tools

Tool in anderen Sprachen verfügbar