Unicode-Zeichensuche

Zeichen Codepunkt Dezimal Block UTF-8 UTF-16 HTML-Entity

Codepunkt → Zeichen

Zeichen Codepunkt Dezimal Block UTF-8 UTF-16 HTML-Entity

Was sind Unicode-Codepunkte?

Jedes Zeichen, das ein Computer anzeigen kann – Buchstaben, Ziffern, Satzzeichen, CJK-Zeichen, Emoji – erhält im Unicode-Standard eine eindeutige Nummer, den sogenannten Codepunkt, üblicherweise geschrieben als „U+“ gefolgt von Hexadezimalziffern (z. B. U+0041 für „A“). Dieses Tool zerlegt jeden eingegebenen Text in seine einzelnen Zeichen und zeigt für jedes den Codepunkt, den Dezimalwert, den Unicode-Block sowie die Byte-Darstellung in den beiden gängigsten Kodierungen an – zusätzlich kannst du ein Zeichen anhand seines Codes nachschlagen.

So funktioniert die Suche

Bei Texteingabe durchläuft das Tool jedes Zeichen, liest dessen Codepunkt mit den eingebauten, Unicode-fähigen String-Methoden von JavaScript aus und schlägt in einer Referenztabelle nach, zu welchem benannten Unicode-Block dieser Codepunkt gehört (z. B. „Basic Latin“ oder „CJK Unified Ideographs“). Außerdem berechnet es die rohen Bytes für UTF-8- und UTF-16-Kodierung sowie die entsprechende HTML-Zeichenreferenz. Die umgekehrte Suche akzeptiert einen Codepunkt in mehreren Formaten (U+XXXX, 0x-Hex, einfache Dezimalzahl oder ein einzelnes Zeichen) und liefert dieselben Details.

Häufig gestellte Fragen

Was ist der Unterschied zwischen UTF-8- und UTF-16-Bytes?
Beide kodieren denselben Unicode-Codepunkt als Bytes, gruppieren und füllen diese Bytes aber unterschiedlich. UTF-8 verwendet 1 bis 4 Byte pro Zeichen und ist die im Web vorherrschende Kodierung, während UTF-16 (intern von JavaScript-Strings verwendet) 2 oder 4 Byte pro Zeichen nutzt.
Warum werden manche Zeichen als „Space“, „Tab“ oder „Control“ statt als das Zeichen selbst angezeigt?
Leerzeichen und Steuerzeichen (wie Leerzeichen, Tabulator, Zeilenumbruch oder andere nicht druckbare Zeichen unter Codepunkt 32) haben kein sichtbares Glyphenbild. Daher zeigt das Tool statt einer leeren Zelle oder eines unsichtbaren Zeichens eine lesbare Bezeichnung an.
Gibt es eine Grenze, wie viel Text ich auf einmal analysieren kann?
Die Tabelle zeigt bis zu 1000 Zeichen pro Aufschlüsselung an, damit die Seite reaktionsfähig bleibt. Enthält dein Text mehr, weist ein Hinweis darauf hin, dass die Anzeige gekürzt wurde – die Gesamtzahl und Byte-Größe in der Zusammenfassung beziehen sich jedoch weiterhin auf den vollständigen Text.