텍스트 도구

단어 빈도 분석기

영문 텍스트에서 각 단어의 출현 빈도와 점유 비율을 분석하고 상위 순위를 확인하는 온라인 도구입니다.

도구 실행

단어 빈도 분석기는 입력된 영문 텍스트에서 각 단어가 나타난 횟수와 비중을 계산하여 정렬해 주는 도구입니다. 텍스트를 입력하면 영문 알파벳 소문자 기준으로 단어를 추출하고, 가장 많이 등장한 순서대로 빈도수와 백분율, 상대적 비율 막대를 함께 표시합니다. 불용어 제외 옵션을 켜면 관사나 전치사처럼 자주 쓰이지만 의미 비중이 낮은 단어를 분석 대상에서 뺄 수 있습니다. 상위 단어 표시 개수는 최소 5개부터 최대 100개까지 지정 가능하며, 기본값은 20개입니다. 영문 기사나 에세이에서 특정 어휘의 반복 사용 여부를 확인하거나 키워드 분포를 점검할 때 유용하게 활용할 수 있습니다.

사용 방법

  1. 분석할 영문 텍스트를 입력란에 직접 입력하거나 붙여넣습니다.
  2. 일반적인 기능어(관사, 전치사 등)를 집계에서 빼려면 불용어 제외 옵션을 선택합니다.
  3. 결과 화면에 나열할 상위 단어의 개수(5~100 사이 정수)를 지정합니다.
  4. 실행 후 결과 패널에서 정렬된 단어별 출현 빈도와 비율 통계를 확인합니다.

예시

  • 간단한 문장 'Data science is the study of data'를 입력하고 불용어 제외를 활성화하면, 기능어가 빠지고 'data'(2회)와 'science', 'study'(각 1회)가 순위대로 표시됩니다.
  • 긴 에세이 본문을 넣고 상위 표시 개수를 10으로 설정하면, 가장 자주 등장한 상위 10개 핵심 어휘와 각각의 점유율 백분율을 즉시 파악할 수 있습니다.

자주 묻는 질문

한글이나 다른 언어의 단어도 분석할 수 있습니까?

이 도구의 단어 추출 방식은 영문 알파벳(a-z)과 아포스트로피를 기준으로 설계되어 있어, 영문 단어 분석에 적합합니다. 한글이나 특수기호, 숫자는 단어로 인식되지 않습니다.

대소문자는 서로 다르게 구분되어 계산됩니까?

아닙니다. 입력된 모든 텍스트는 영문 소문자로 변환된 후 분석되므로 'Data'와 'data'는 동일한 단어로 합산되어 집계됩니다.

불용어(Stop Words)에는 어떤 단어들이 포함됩니까?

the, is, at, which, on 등 문맥상 빈번하게 쓰이지만 개별 의미 비중이 낮은 주요 영어 관사, 대명사, 전치사, be동사 등이 기본 불용어 목록에 포함되어 있습니다.

상위 표시 개수에는 어떤 값을 입력할 수 있습니까?

최소 5부터 최대 100까지의 숫자를 입력할 수 있습니다. 값을 비워두면 기본값인 20이 적용됩니다.

이 도구 삽입하기

아래 코드를 사용해 작동하는 SmartPlusLab 도구를 웹사이트에 추가하세요.