텍스트 단어 수와 가독성 분석 방법
하나의 입력란에 텍스트를 넣고 실행하면 분량, 단어 빈도, 문자 유형, 조건부 가독성, 단어 길이와 시간 추정치를 차례로 확인할 수 있습니다. 입력란이 비어 있어도 처리되지만 이 경우 통계와 시간 값은 0 중심으로 표시됩니다.
텍스트 구조와 분량을 살펴보는 용도
텍스트 통계 대시보드는 입력한 텍스트의 분량과 구성 요소를 한눈에 살펴보는 데 사용하는 도구입니다. 단어 수뿐 아니라 원문 기준 문자 수, 공백을 뺀 문자 수, 문장·문단·줄 수를 함께 확인할 수 있습니다. 반복해서 등장하는 단어와 고유 단어 수를 비교하면 표현의 편중을 점검하기 좋고, 글자·숫자·공백·문장 부호의 분포도 별도로 파악할 수 있습니다. 입력란은 선택 사항이므로 분석할 문장이 아직 없어도 실행할 수 있습니다. 다만 글의 길이와 가독성을 비교하려면 같은 기준으로 준비한 텍스트를 넣는 편이 결과를 읽기 쉽습니다. 보고서 초안, 안내문, 학습 자료처럼 한 덩어리의 글을 빠르게 살펴볼 때 단어 분량과 반복 표현을 먼저 확인하고, 이어서 가독성 및 시간 추정치를 검토하는 순서가 자연스럽습니다.
입력부터 세부 결과 확인까지
- 분석하려는 글을 하나의 입력란에 붙여 넣거나 직접 입력합니다. 입력란을 비워 둔 상태도 처리 대상이므로, 결과 화면의 기본 동작을 확인하려는 경우에는 내용을 넣지 않고 실행해도 됩니다. 2. 분석을 실행한 뒤 길이 요약을 먼저 살핍니다. 내용이 있는 입력에서는 공백으로 구분한 단어 수, 원문에 있는 문자의 수, 공백을 제거한 뒤의 문자 수, 문장 수, 문단 수, 줄 수가 각각 계산됩니다. 공백과 줄바꿈을 포함한 원문 기준 값과 공백 제거 값은 서로 다른 항목이므로 한 숫자로 합쳐 읽지 않습니다. 3. 단어 빈도 결과에서 소문자 알파벳과 숫자 기준으로 정규화된 항목을 확인합니다. 빈도가 높은 정규화 단어는 최대 15개까지 표시되며, 고유 정규화 단어 수는 반복을 제외한 어휘 규모를 살피는 데 참고가 됩니다. 4. 문자 유형별 결과를 열어 글자, 숫자, 공백, 문장 부호, 대문자, 소문자의 개수를 비교합니다. 같은 원문이라도 기호나 줄바꿈을 포함하면 범주별 합계가 달라질 수 있으므로 입력한 표기를 기준으로 읽습니다. 5. 단어가 6개보다 많은 글에서는 모음 묶음 휴리스틱으로 음절을 추정한 뒤 반올림한 가독성 점수와 점수 구간에 따른 6단계 가독성 등급을 확인합니다. 6. 내용이 있는 글에서는 서로 다른 가장 긴 알파벳 단어 형태를 최대 5개까지 보고, 평균 단어 길이와 문장당 평균 단어 수도 살핍니다. 마지막으로 분당 200단어 기준 읽기 시간과 분당 130단어 기준 말하기 시간이라는 두 추정치를 분량과 함께 비교합니다.
숫자와 조건부 지표를 해석하는 기준
길이 요약은 서로 다른 측정 기준을 나누어 보여 줍니다. 단어 수는 공백으로 분리한 단위를 세고, 문자 수는 원문에 있는 문자를 세므로 문장 부호와 줄바꿈의 영향이 두 항목에 같은 방식으로 반영된다고 보기는 어렵습니다. 빈도 표는 원래 대소문자 표기를 그대로 나열하는 목록이 아니라 정규화된 단어의 반복을 보여 주므로, 원문에서의 철자와 결과 항목을 대응시켜 읽어야 합니다. 고유 단어 수가 낮으면 반복된 정규화 항목이 상대적으로 많다는 뜻으로 볼 수 있지만, 그것만으로 글의 품질을 판단하지는 않습니다. 가독성 결과는 6개 초과 단어 조건에서 음절을 모음 묶음으로 추정해 계산하므로 실제 독자의 이해도나 읽는 능력을 직접 측정하는 값은 아닙니다. 점수는 0에서 100 사이로 조정되고, 그 구간에 맞는 등급이 붙습니다. 읽기와 말하기 시간도 분량과 기준 속도로 산출한 추정치이며 낭독 상황의 시간을 대신하지 않습니다. 빈 입력이나 공백만 입력하면 실행은 성공하지만 통계값은 0, 가독성은 이용 불가, 단어 목록은 비어 있는 상태가 되며 시간 추정치는 0으로 표시됩니다. 내용이 있는 입력의 시간과 단어 길이 결과는 입력 분량에 따라 읽고, 같은 길이인 가장 긴 단어들의 표시 순서는 일정하다고 전제하지 않는 편이 좋습니다.
사용 예시
영어로 작성한 짧은 문단의 반복 단어와 문장 구조를 함께 점검하려는 작성자가 하나의 텍스트를 입력하고 결과 항목을 비교합니다.
입력란에 “Cats chase small mice. Cats sleep often.”을 입력한 다음 분석을 실행합니다. 이 문장은 공백으로 구분한 단어가 6개를 넘으므로 가독성 점수와 6단계 등급을 포함하는 결과 형태를 확인할 수 있습니다. 반복된 Cats는 정규화 빈도 항목에서 함께 살펴보고, 문장 부호와 공백은 문자 유형별 개수에서 따로 확인합니다.
단어 수, 원문 문자 수와 공백 제거 문자 수, 문장·문단·줄 수, 정규화 단어 빈도와 고유 단어 수, 문자 유형별 개수, 가독성 점수와 등급, 단어 길이 요약, 읽기·말하기 시간 추정치가 포함된 결과 형태입니다.
제한 사항
- 가독성 점수와 등급은 단어가 6개보다 많은 입력에서만 추정되며, 같은 길이의 가장 긴 알파벳 단어가 여러 개이면 표시 순서는 일정하지 않을 수 있습니다.
자주 발생하는 오류
- 줄바꿈이나 여러 공백을 단어 구분자로 오해하면 원문 문자 수와 단어 수를 같은 값처럼 비교하게 됩니다. 결과를 읽을 때에는 공백으로 나눈 단어 기준과 원문 기준 문자 기준을 먼저 분리하고, 입력한 줄바꿈과 공백을 다시 확인하세요.
자주 묻는 질문
텍스트를 입력하지 않아도 분석할 수 있나요?
입력란을 비워 둔 상태도 성공적으로 처리됩니다. 이 조건에서는 통계값이 0이 되고 가독성은 이용할 수 없으며 단어 목록은 비어 있고 읽기 및 말하기 시간 추정치는 0으로 표시됩니다.
짧은 텍스트에도 가독성 점수가 나오나요?
단어가 6개보다 많은 입력에서 가독성 점수와 6단계 등급이 추정됩니다. 단어가 5개 이하인 글에는 가독성 점수가 생성된다고 보지 말고, 분량과 문자 범주 같은 다른 결과를 확인하세요.
단어 길이와 읽기 시간도 확인할 수 있나요?
내용이 있는 입력이면 평균 단어 길이와 문장당 평균 단어 수, 최대 5개의 가장 긴 알파벳 단어 형태를 볼 수 있습니다. 같은 화면에서 분당 200단어 읽기와 분당 130단어 말하기를 기준으로 한 시간 추정치도 확인합니다.