| Zeichen | Codepunkt | Dezimal | Block | UTF-8 | UTF-16 | HTML-Entity |
|---|
| Zeichen | Codepunkt | Dezimal | Block | UTF-8 | UTF-16 | HTML-Entity |
|---|
Jedes Zeichen, das ein Computer anzeigen kann – Buchstaben, Ziffern, Satzzeichen, CJK-Zeichen, Emoji – erhält im Unicode-Standard eine eindeutige Nummer, den sogenannten Codepunkt, üblicherweise geschrieben als „U+“ gefolgt von Hexadezimalziffern (z. B. U+0041 für „A“). Dieses Tool zerlegt jeden eingegebenen Text in seine einzelnen Zeichen und zeigt für jedes den Codepunkt, den Dezimalwert, den Unicode-Block sowie die Byte-Darstellung in den beiden gängigsten Kodierungen an – zusätzlich kannst du ein Zeichen anhand seines Codes nachschlagen.
Bei Texteingabe durchläuft das Tool jedes Zeichen, liest dessen Codepunkt mit den eingebauten, Unicode-fähigen String-Methoden von JavaScript aus und schlägt in einer Referenztabelle nach, zu welchem benannten Unicode-Block dieser Codepunkt gehört (z. B. „Basic Latin“ oder „CJK Unified Ideographs“). Außerdem berechnet es die rohen Bytes für UTF-8- und UTF-16-Kodierung sowie die entsprechende HTML-Zeichenreferenz. Die umgekehrte Suche akzeptiert einen Codepunkt in mehreren Formaten (U+XXXX, 0x-Hex, einfache Dezimalzahl oder ein einzelnes Zeichen) und liefert dieselben Details.