| 문자 | 코드포인트 | 10진수 | 블록 | UTF-8 | UTF-16 | HTML 엔티티 |
|---|
| 문자 | 코드포인트 | 10진수 | 블록 | UTF-8 | UTF-16 | HTML 엔티티 |
|---|
컴퓨터가 표시할 수 있는 모든 문자(글자, 숫자, 문장부호, 한중일 문자, 이모지)는 유니코드 표준에서 코드포인트라는 고유 번호를 부여받으며, 보통 'U+' 뒤에 16진수를 붙여 표기합니다(예: 'A'는 U+0041). 이 도구는 입력한 텍스트를 글자별로 분해해 각 글자의 코드포인트·10진수 값·유니코드 블록·가장 흔한 두 인코딩 방식의 바이트 표현을 보여주고, 코드값으로 문자를 역조회하는 기능도 제공합니다.
텍스트를 입력하면 이 도구는 글자 하나하나를 순회하며 자바스크립트의 유니코드 인식 문자열 메서드로 코드포인트를 읽고, 참조 표에서 그 코드포인트가 속한 유니코드 블록 이름(예: 'Basic Latin', 'CJK Unified Ideographs')을 찾습니다. 또한 UTF-8·UTF-16 인코딩의 원시 바이트와 동등한 HTML 숫자 문자 엔티티도 계산합니다. 역조회는 U+XXXX, 0x 16진수, 일반 10진수, 문자 1개 등 여러 형식으로 입력한 코드값을 받아 같은 정보를 보여줍니다.