UTF-8-Konvertierung: Aufgaben und Grenzen
Der klassische Kodierungsfehler: Eine als UTF-8 gespeicherte Datei wurde versehentlich als Latin-1 oder Windows-1252 geöffnet. Statt ü erscheint dann ü. Dieses Werkzeug liest die Zeichen als CP1252-Bytes zurück und dekodiert sie als UTF-8.
So gehen Sie vor
- Den fehlerhaften Text einfügen
- Richtung Reparieren wählen
- Auf Umrechnen klicken
- Das lesbare Ergebnis kopieren
Typische Anwendungen: Eine heruntergeladene Datei mit kryptischen Umlauten retten, E-Mail- oder Logtexte mit Zeichen wie ä korrigieren, Verstehen, wie der Fehler in der Gegenrichtung entsteht.
Die wichtigsten Möglichkeiten
- Fehlsichtigen Text nach UTF-8 reparieren
- CP1252-Sonderzeichen wie € korrekt behandelt
- Umgekehrt die fehlsichtige Form erzeugen
- Reine Byte-Rechnung im Browser
Einschränkungen
Das Werkzeug setzt voraus, dass der Text durch das falsche Dekodieren von UTF-8-Bytes entstanden ist. Echte Bilder, PDFs oder binäre Daten lassen sich so nicht reparieren. Unzuordenbare Zeichen werden durch ein Fragezeichen ersetzt.
Ergänzende Hinweise
Warum sieht mein Text aus wie ü?
Das passiert, wenn UTF-8-Bytes als Latin-1 gelesen werden. Die Bytes für ü werden dabei als zwei separate Zeichen dargestellt – dieses Werkzeug führt sie wieder zusammen.
Was ist der Unterschied zwischen UTF-8 und Latin-1?
Latin-1 umfasst 256 Zeichen mit einem Byte. UTF-8 nutzt mehrere Bytes für Umlaute und Sonderzeichen. Das ist die Quelle des Fehlers.
Kann ich eine ganze Datei hochladen?
Dieses Werkzeug arbeitet mit Text im Feld. Kopieren Sie den betroffenen Inhalt hinein, das spart einen Upload sensibler Daten.
Was macht die Richtung Erzeugen?
Sie rechnet einen sauberen Text in die fehlsichtige Form um. Das ist nützlich, um den Effekt zu verstehen oder einen Bug nachzustellen.
Diese Werkzeuge passen zur UTF-8-Konvertierung: