Textwerkzeuge

Unicode-Inspektor

Analysieren Sie beliebigen Text Zeichen für Zeichen mit Codepunkten, Hexadezimalwerten, UTF-8-Bytes und Kategorien.

Tool ausführen

Mit dem Unicode-Inspektor analysieren Sie Zeichenketten detailliert auf Zeichenebene. Sie fügen Ihren Text direkt in das Eingabefeld ein, um für jedes einzelne Zeichen den zugehörigen Unicode-Codepunkt, die hexadezimale Schreibweise und die exakten UTF-8-Bytes zu ermitteln. Die Ansicht ordnet jedem Zeichen zudem eine übergreifende Kategorie auf Basis definierter Codepunktbereiche zu und zeigt die genaue Zeichenposition an. Das Werkzeug erfasst sowohl Standard-ASCII-Zeichen als auch Umlaute, Satzzeichen, ostasiatische Schriftzeichen und Emojis. Neben der Aufschlüsselung der einzelnen Zeichen erhalten Sie eine Übersicht über die Gesamtzahl der verarbeiteten Zeichen sowie die Summe aller anfallenden UTF-8-Bytes. Bleibt das Textfeld leer, gibt die Analyse null Zeichen und null Bytes aus. Dank der tabellarischen Aufteilung sehen Sie sofort, wie viele Bytes ein Symbol im UTF-8-Format belegt und welcher Codepunkt ihm zugewiesen ist. Das Online-Werkzeug eignet sich für Entwickler und Redakteure, die fehlerhafte Zeichenkodierungen untersuchen oder Sonderzeichen identifizieren möchten.

Anleitung

  1. Geben Sie Ihren Text in das Eingabefeld ein oder fügen Sie eine vorhandene Zeichenfolge aus der Zwischenablage ein.
  2. Starten Sie die Analyse, um die detaillierte Aufschlüsselung aller Zeichen zu erzeugen.
  3. Lesen Sie in der Tabelle für jedes Zeichen die Position, das Zeichen selbst, den Codepunkt, die UTF-8-Bytes und die Kategorie ab.
  4. Überprüfen Sie am Ende der Übersicht die Gesamtzahl der analysierten Zeichen sowie die UTF-8-Gesamtbytezahl.

Beispiele

  • Eingabe von 'Café': Das Werkzeug listet 4 Zeichen auf (C, a, f, é). Das Zeichen 'é' erhält den Codepunkt U+00E9 und belegt 2 UTF-8-Bytes (C3 A9), was insgesamt 5 UTF-8-Bytes ergibt.
  • Eingabe von '€': Das Euro-Zeichen wird an Position 0 mit dem Codepunkt U+20AC, der zugehörigen Kategorie für Währungssymbole sowie 3 UTF-8-Bytes (E2 82 AC) aufgeführt.

FAQ

Was passiert bei einer leeren Eingabe?

Wird kein Text eingegeben, meldet das Werkzeug null verarbeitete Zeichen und null UTF-8-Bytes.

Wie werden die Kategorien der Zeichen bestimmt?

Die Kategorien werden anhand vordefinierter numerischer Codepunktbereiche zugeordnet und dienen als allgemeine Orientierung.

Wie unterscheidet sich die Zeichenanzahl von der Byte-Anzahl?

ASCII-Zeichen belegen im UTF-8-Format jeweils ein Byte, während Umlaute, Sonderzeichen oder Emojis zwei bis vier Bytes pro Zeichen benötigen. Die Byte-Summe kann daher höher sein als die reine Zeichenanzahl.

Tool einbetten

Fügen Sie dieses funktionsfähige SmartPlusLab-Tool mit dem folgenden Code in Ihre Website ein.