Búsqueda de caracteres Unicode

Carácter Punto de código Decimal Bloque UTF-8 UTF-16 Entidad HTML

Punto de código → Carácter

Carácter Punto de código Decimal Bloque UTF-8 UTF-16 Entidad HTML

Qué son los puntos de código Unicode

Cada carácter que un ordenador puede mostrar —letras, dígitos, puntuación, caracteres CJK, emojis— recibe un número único llamado punto de código en el estándar Unicode, que normalmente se escribe como "U+" seguido de dígitos hexadecimales (como U+0041 para "A"). Esta herramienta descompone cualquier texto que escribas en sus caracteres individuales y muestra el punto de código, el valor decimal, el bloque Unicode y la representación en bytes de cada uno en las dos codificaciones más comunes, además de permitirte buscar un carácter a partir de su código.

Cómo funciona la búsqueda

Para el texto de entrada, la herramienta recorre cada carácter, lee su punto de código usando los métodos de cadena de JavaScript compatibles con Unicode, y busca a qué bloque Unicode con nombre pertenece ese punto de código (como "Basic Latin" o "CJK Unified Ideographs") en una tabla de referencia. También calcula los bytes en bruto para las codificaciones UTF-8 y UTF-16, y la entidad de carácter numérica HTML equivalente. La búsqueda inversa acepta un punto de código en varios formatos (U+XXXX, hexadecimal 0x, decimal simple o un solo carácter) y muestra los mismos detalles.

Preguntas frecuentes

¿Cuál es la diferencia entre los bytes de UTF-8 y UTF-16?
Ambos son formas de codificar el mismo punto de código Unicode como bytes, pero agrupan y rellenan esos bytes de forma distinta — UTF-8 usa de 1 a 4 bytes por carácter y es la codificación dominante en la web, mientras que UTF-16 (usado internamente por las cadenas de JavaScript) usa 2 o 4 bytes por carácter.
¿Por qué algunos caracteres se muestran como "Space", "Tab" o "Control" en lugar del carácter en sí?
Los espacios en blanco y caracteres de control (como espacio, tabulación, salto de línea u otros caracteres no imprimibles por debajo del punto de código 32) no tienen un glifo visible, así que la herramienta muestra una etiqueta legible en vez de dejar la celda vacía o mostrar un carácter invisible.
¿Hay un límite de texto que se puede analizar a la vez?
La tabla muestra hasta 1000 caracteres por análisis para mantener la página fluida; si tu texto tiene más, un aviso indica que la visualización se truncó, aunque el recuento del resumen y el tamaño en bytes siguen reflejando el texto completo.