StartseiteWerkzeugeKategorien🎵 Audio🖼️ Bilder📄 Dokumente🔁 Dokument-Konvertierung📊 Diagramme🤖 KI-Textwerkzeuge💼 Büro💻 Entwicklung🧰 Alltag📝 Text🔢 Zahlen🔐 Verschlüsselung📐 EinheitenPreise
🔒Datenschutz zuerst · Die gesamte Verarbeitung läuft in Ihrem Browser. Ihre Dateien und Texte werden nicht an uns übertragen.

UTF-8 kodieren verwenden

🔒Datenschutz zuerst · Dieses Werkzeug arbeitet in Ihrem Browser. Die verwendeten Dateien und Texte laufen nicht über unsere Server.

UTF-8 kodieren: Aufgaben und Grenzen

Um zu sehen, wie viele Bytes ein Zeichen belegt, wird der Text hier Byte für Byte ausgegeben.

So gehen Sie vor

  1. Den Text einfügen, dessen Byteform interessiert
  2. Kodieren lassen; im Ergebnisbereich erscheint die fortlaufende Bytefolge
  3. Die Abschnitte je Zeichen zählen: drei Abschnitte sprechen für UTF-8, zwei meist für eine andere Kodierung
  4. Zum Zurückübersetzen das Werkzeug zum Dekodieren nutzen

Typische Anwendungen: Nach Kodierungsfehlern suchen und feststellen, wie viele Bytes ein Abschnitt belegt, Eine Zeichenkette byteweise aufbauen, wenn es genau darauf ankommt, Das in einer Schnittstellenbeschreibung angegebene Beispiel gegenprüfen.

Eingabe und Ausgabe

Grüße hinein → %47%72%C3%BC%C3%9F%65 (Großbuchstaben mit Prozentzeichen, jedes Zeichen einzeln).

Die wichtigsten Möglichkeiten

  • Ausgegeben werden die Bytes nach UTF-8 in der Form %XX
  • Auch Buchstaben und Ziffern erscheinen als Byte, damit sich alles vergleichen lässt
  • Ganze Texte und mehrzeilige Inhalte werden verarbeitet
  • Umgewandelt wird lokal, der Inhalt wird nicht übertragen

Einschränkungen

Ausgegeben wird die prozentuale Schreibweise der UTF-8-Bytes, was dem Ergebnis der URL-Kodierung stark ähnelt. Der Unterschied: Hier werden alle Bytes umgewandelt, auch eine Ziffer erscheint als Byte. Das ist zum byteweisen Vergleichen praktisch, zum Einsetzen in eine Adresse aber meist nicht die richtige Wahl – dafür gibt es das Werkzeug zur URL-Kodierung.

Ergänzende Hinweise

Worin liegt der Unterschied zur URL-Kodierung?

Die Form ist ähnlich, die Regel nicht: Die URL-Kodierung lässt Buchstaben, Ziffern und einige Zeichen unverändert, hier wird jedes Byte als %XX ausgegeben.

Warum belegt ein chinesisches Zeichen drei Byte?

UTF-8 kodiert gängige chinesische Zeichen mit drei Byte; deshalb wird ein Zeichen zu %E4%BD%A0.

Lassen sich Emoji kodieren?

Ja, ein Emoji belegt meist vier Byte und ergibt vier %XX-Abschnitte.

Braucht das Kodieren eine Netzverbindung?

Nein, umgewandelt wird rein lokal.

Diese Werkzeuge passen inhaltlich zu UTF-8 kodieren: