텍스트의 모든 문자를 검사하는 방법
문자열을 입력하면 각 문자의 위치, 코드 포인트, UTF-8 바이트 표현과 범주 라벨을 확인하면서 전체 문자 수와 바이트 합계를 읽을 수 있습니다. 입력을 생략하면 빈 텍스트가 처리되어 두 집계가 각각 0으로 보고됩니다.
문자 단위 정보를 살펴볼 때
텍스트 안의 문자를 순서대로 살펴보면서 코드 포인트와 UTF-8 바이트 정보를 확인하고 싶을 때 이 도구를 사용할 수 있습니다. 짧은 문자열의 구성 요소를 점검하거나, 여러 언어가 섞인 텍스트에서 문자별 정보를 비교할 때 유용합니다. 결과에는 전체 집계와 문자별 항목이 함께 제시되므로 문자열의 길이와 인코딩에 따른 바이트 크기를 나누어 읽을 수 있습니다. 일반 ASCII 텍스트뿐 아니라 이모지와 CJK 텍스트를 넣어 보는 사례도 확인되어 있습니다. 입력란을 비워 둔 상태도 처리 대상이지만, 검사할 내용이 있다면 확인하려는 문자열을 직접 입력하는 편이 결과를 해석하기 쉽습니다. 이 도구는 텍스트의 각 항목을 순서에 따라 보여 주므로 특정 위치의 값과 전체 합계를 함께 대조할 수 있습니다. 따라서 문자 수만 세는 데 그치지 않고, 각각의 코드 포인트 표현과 UTF-8 바이트 표현을 살펴보려는 상황에 맞습니다.
입력부터 문자별 결과까지
-
검사하려는 문자열을 텍스트 입력 영역에 넣습니다. 한글, 영문, 숫자, 기호, 이모지처럼 확인하려는 내용을 그대로 입력하고, 여러 문자를 비교하려면 해당 문자열을 한 번에 넣습니다.
-
입력 없이도 처리할 수 있다는 점을 먼저 확인합니다. 빈 상태의 결과가 필요한 경우에는 값을 추가하지 않고 다음 단계로 진행하면 됩니다. 실제 텍스트의 정보를 보려는 경우에는 입력한 문자열이 빠짐없이 들어갔는지 살펴본 뒤 실행 컨트롤을 선택합니다.
-
전체 결과에서 보고된 문자 수를 확인합니다. 이 수치는 처리된 문자의 개수를 나타내며, 입력한 문자열의 구성과 순서를 점검할 때 기준으로 사용할 수 있습니다.
-
UTF-8 바이트 합계를 별도로 읽습니다. 이 값은 처리된 각 문자를 UTF-8로 표현했을 때 필요한 바이트 길이를 더한 결과이므로, 문자 수와 함께 보되 같은 종류의 수치로 취급하지 않습니다.
-
문자별 항목을 펼쳐 위치, 문자 값, 숫자 코드 포인트, 대문자 16진수 코드 포인트 표기, UTF-8 바이트의 16진수 표기, 범주 라벨을 차례로 확인합니다. 같은 문자열에서 항목 사이의 위치와 값을 비교하면 특정 문자가 어느 순서에 있는지 파악할 수 있습니다.
집계와 라벨을 해석하는 기준
문자 수는 처리된 항목의 개수를 뜻하고, UTF-8 바이트 합계는 각 항목의 인코딩된 바이트 길이를 합친 값입니다. 두 집계가 서로 다른 숫자로 나타나더라도 입력이 잘못되었다고 단정하지 말고, 문자별 바이트 표기를 함께 확인하세요. 문자별 위치는 문자열 안의 처리 순서를 읽는 기준이며, 문자 값은 실제로 처리된 항목을 대조하는 데 사용됩니다.
코드 포인트의 숫자 표기와 대문자 16진수 표기는 같은 문자를 다른 방식으로 살펴보게 해 줍니다. UTF-8 바이트의 16진수 표기는 해당 문자가 인코딩된 결과를 확인하는 항목입니다. 여러 문자를 넣었다면 각 항목의 값을 비교하면서 전체 바이트 합계가 어떻게 구성되는지 살펴볼 수 있습니다.
범주 라벨은 숫자 코드 포인트의 넓은 범위를 기준으로 선택되는 참고용 표시입니다. 이를 유니코드 표준의 블록이나 스크립트, 언어, 문자 속성을 확정하는 분류로 읽으면 안 됩니다. 또한 결과는 반복 처리된 문자 단위의 정보이므로 사람이 하나의 글자로 인식하는 묶음이나 화면에 보이는 렌더링 결과를 직접 분석한 값으로 보기는 어렵습니다. 빈 입력은 처리에 성공하고 문자 수와 UTF-8 바이트 수가 각각 0으로 보고되므로, 값이 없다는 결과와 처리 실패를 구분해야 합니다.
사용 예시
이모지 하나가 어떤 문자 정보와 UTF-8 바이트 집계로 처리되는지 확인하려고 합니다.
짧은 이모지 하나를 텍스트 입력 영역에 넣고 실행한 다음, 문자별 항목의 코드 포인트와 바이트 표기를 전체 집계와 대조합니다.
문자 하나로 된 이모지를 입력하면 문자별 항목에 위치, 문자 값, 숫자 코드 포인트, 대문자 16진수 코드 포인트, UTF-8 바이트의 16진수 표기와 범주 라벨이 나타나며, 전체 문자 수와 UTF-8 바이트 합계가 별도로 보고됩니다.
제한 사항
- 범주 라벨은 넓은 숫자 코드 포인트 범위를 이용한 참고 표시이며, 유니코드 표준의 블록·스크립트·언어·문자 속성을 확정하지 않습니다. 결과는 반복 처리된 문자 단위 정보이므로 사람이 인식하는 글자 묶음이나 화면 렌더링을 나타내지 않습니다.
자주 발생하는 오류
- 입력란을 비운 채 실행한 뒤 0이라는 집계를 오류로 생각할 수 있습니다. 빈 입력도 성공 결과를 만들기 때문에, 실제 문자열을 검사하려면 확인할 텍스트를 입력하고 다시 처리하세요.
자주 묻는 질문
텍스트를 입력하지 않아도 되나요?
입력은 선택 사항입니다. 아무 값도 넣지 않고 실행하면 처리는 성공하며 문자 수와 UTF-8 바이트 수가 각각 0으로 보고됩니다. 검사할 문자열이 있다면 입력한 뒤 다시 실행하세요.
각 문자에서 무엇을 확인할 수 있나요?
문자별 항목에서 위치와 문자 값, 숫자 코드 포인트, 대문자 16진수 코드 포인트 표기, UTF-8 바이트의 16진수 표기와 범주 라벨을 확인할 수 있습니다. 이 항목들은 해당 문자열의 처리 순서에 맞춰 제시됩니다.
문자 수와 UTF-8 바이트 수가 다른 이유는 무엇인가요?
문자 수는 처리된 문자의 개수이고, 바이트 합계는 각 문자를 UTF-8로 표현할 때의 바이트 길이를 더한 값입니다. 표현 단위가 다르므로 두 집계가 같은 숫자일 필요는 없습니다.