| Carácter | Punto de código | Decimal | Bloque | UTF-8 | UTF-16 | Entidad HTML |
|---|
| Carácter | Punto de código | Decimal | Bloque | UTF-8 | UTF-16 | Entidad HTML |
|---|
Cada carácter que un ordenador puede mostrar —letras, dígitos, puntuación, caracteres CJK, emojis— recibe un número único llamado punto de código en el estándar Unicode, que normalmente se escribe como "U+" seguido de dígitos hexadecimales (como U+0041 para "A"). Esta herramienta descompone cualquier texto que escribas en sus caracteres individuales y muestra el punto de código, el valor decimal, el bloque Unicode y la representación en bytes de cada uno en las dos codificaciones más comunes, además de permitirte buscar un carácter a partir de su código.
Para el texto de entrada, la herramienta recorre cada carácter, lee su punto de código usando los métodos de cadena de JavaScript compatibles con Unicode, y busca a qué bloque Unicode con nombre pertenece ese punto de código (como "Basic Latin" o "CJK Unified Ideographs") en una tabla de referencia. También calcula los bytes en bruto para las codificaciones UTF-8 y UTF-16, y la entidad de carácter numérica HTML equivalente. La búsqueda inversa acepta un punto de código en varios formatos (U+XXXX, hexadecimal 0x, decimal simple o un solo carácter) y muestra los mismos detalles.