Diakritika Entferner

Slugs in URLs, Dateinamen für FTP-Server, Legacy-Datenbanken mit Latin-1-Codierung: alle verhalten sich schlecht, wenn du ihnen einen Namen wie “José Peña” oder “Zoë” gibst. Dieses Tool entfernt Akzente, Tilden, Umlaute und Cedillen aus Text per standardisierter Unicode-Transliteration und -Normalisierung und hinterlässt dir sauberes ASCII, das jede Pipeline übersteht.

Wie man Diakritika entfernt

  1. 1

    Füge deinen Text ein

    Tippe oder füge jeden Text mit akzentuierten Zeichen ein: ein Wort, eine Liste von Namen, einen ganzen Artikel.

  2. 2

    Führe die Umwandlung aus

    Klicke auf "Diakritika entfernen". Jeder akzentuierte Buchstabe wird zu einfachem ASCII: é wird zu e, ñ zu n, ß zu ss.

  3. 3

    Überprüfe die bereinigte Ausgabe

    Sieh dir das Ergebnisfeld an: Jedes Zeichen, das sich geändert hat, ist jetzt einfaches ASCII, während Leerzeichen, Satzzeichen und Zeilenumbrüche unberührt bleiben.

  4. 4

    Kopiere das Ergebnis

    Kopiere den bereinigten Text mit einem Klick in die Zwischenablage und füge ihn ein, wo immer du ihn brauchst.

So funktioniert das Entfernen

Das Tool nutzt zuerst die ICU-Transliteration (die Regel “Any-Latin; Latin-ASCII”): Es wandelt den Text in lateinische Zeichen um und entfernt dann alle verbliebenen Akzente, sodass é zu e, ß zu ss und æ zu ae wird. Ist die Transliterations-Engine nicht verfügbar, greift das Tool auf Unicode NFD (Normalisierungsform Zerlegung) zurück: é wird in den Basisbuchstaben e (U+0065) und den kombinierenden Akut (U+0301) zerlegt, jeder Codepunkt im Bereich der kombinierenden Zeichen (U+0300 bis U+036F) wird entfernt und der Text anschließend wieder zusammengesetzt. Beide Wege funktionieren für jede Sprache, die das lateinische Alphabet mit zusätzlichen Zeichen verwendet.

Zeichenzuordnungs-Spickzettel

Eingabe Ausgabe
á é í ó ú a e i o u
à è ì ò ù a e i o u
â ê î ô û a e i o u
ä ë ï ö ü a e i o u
ñ n
ç c
ß ss
æ Æ ae AE
œ Œ oe OE
ø Ø o O
ł Ł l L

Der Fallback-Pfad (ohne Transliteration) lässt ß, æ, œ, ø und ł unverändert, weil er nur kombinierende Zeichen entfernt.

Häufige Anwendungsfälle

  • URL-Slugs. “El niño” wird nach dem Entfernen und Kleinschreiben zu “el-nino”.
  • Dateinamen. Cloud-Speicherdienste und einige Legacy-FTP-Server beschädigen nicht-ASCII-Dateinamen; zuerst entfernen, dann hochladen.
  • CSV-Importe in Legacy-Systeme. Jede Datenbank mit Latin-1 (Windows-1252) Codierung wird mehrbyte UTF-8-Zeichen falsch behandeln; das Entfernen vermeidet die Korruption.
  • Durchsuchbare Felder. Das Speichern einer diakritikfreien Version neben dem Original ermöglicht es Benutzern, “naive” zu finden, wenn die Zeile “naïve” sagt.

Achtung: Es ist eine Einbahnstraße

Das Entfernen von “naïve” ergibt “naive”; du kannst das Umlaut nicht automatisch zurückbekommen, da die Sprache verloren geht. Halte das Original neben der bereinigten Version, wenn beide benötigt werden.

Häufig gestellte Fragen

Das sind keine Diakritika, sondern eigenständige Buchstaben ohne einfaches kombinierendes Zeichen. Das Tool wandelt sie dennoch um: ß wird zu ss, æ zu ae, œ zu oe, ø zu o und ł zu l. Der Fallback-Pfad, der nur bei fehlender Transliterations-Engine verwendet wird, lässt sie unberührt.

Der Standardpfad transliteriert auch diese Schriften: Kyrillisch, Griechisch, Arabisch und CJK werden zu lateinischen Zeichen (Привет wird zu Privet, Ελλάδα zu Ellada, 你好 zu ni hao), danach werden verbliebene Zeichen entfernt. Der Fallback-Pfad entfernt nur kombinierende Zeichen und lässt nicht-lateinische Schriften unberührt.

Ja. Großbuchstaben mit Akzenten werden zu Großbuchstaben ASCII, Kleinbuchstaben bleiben Kleinbuchstaben. Leerzeichen, Interpunktion und Zeilenumbrüche bleiben unberührt.

Dein Text wird nur zum Ausführen der Umwandlung an unseren Server gesendet; er wird danach nicht gespeichert und nicht in den Seitenlink aufgenommen. Es werden lediglich anonyme Nutzungsstatistiken erfasst.

Verwandte Tools

Tool in anderen Sprachen verfügbar