MODOO HUB ← 모두의 툴
Text · Instrument

텍스트 통계

글자수·단어수·문장수·독서 시간·가독성 지수·문자 빈도 분석

📖 Flesch 가독성 지수, 왜 한국어에는 안 통하나 가이드 보기

텍스트 통계 분석기

이 도구는 Rudolf Flesch가 1948년에 고안한 Flesch Reading Ease 공식(206.835 - 1.015×평균 문장 길이 - 84.6×평균 음절 수)을 그대로 구현해 영어 텍스트의 가독성을 0~100점으로 환산합니다. 음절 수는 정확한 사전 기반 계산이 아니라 단어 안의 모음 덩어리(a, e, i, o, u, y) 개수를 세는 근사 방식을 쓰기 때문에 완벽하진 않지만 대략적인 난이도 추정에는 충분합니다. 이 공식은 영어의 음절-단어 길이 상관관계를 전제로 설계된 것이라 한국어나 중국어처럼 음절 구조가 다른 언어에는 적용할 수 없어, 이 도구도 Flesch 점수만큼은 영어에 한정해 표시합니다. 반면 글자 수·단어 수·문장 수 같은 기본 통계는 언어에 상관없이 정상적으로 집계됩니다. 블로그 글의 난이도를 검토하거나, 이메일·보고서를 보내기 전 문장 길이와 분량을 점검하는 데 활용됩니다.

자주 묻는 질문

글자 수는 공백 포함인가요?

이 도구는 공백을 포함한 전체 글자 수와 공백만 제거한 글자 수를 동시에 계산해 두 항목으로 나란히 보여주므로, 원고지 매수 계산처럼 공백 포함 기준이 필요할 때와 순수 텍스트 분량만 알고 싶을 때 모두 바로 확인할 수 있습니다.

Flesch 가독성 지수란?

1948년에 개발된 Flesch Reading Ease 공식으로, 문장이 길고 음절 수가 많은 단어를 많이 쓸수록 점수가 낮아지도록 설계되어 있습니다. 90점 이상은 매우 쉬움, 30점 미만은 매우 어려움 등급으로 분류됩니다.

독서 시간은 어떻게 계산하나요?

단어 수를 성인 평균 묵독 속도인 분당 200단어로 나눠 분 단위로 반올림합니다. 실제 속도는 글의 난이도나 개인차에 따라 달라질 수 있으므로 참고용 수치입니다.

단어 수는 어떻게 세나요?

텍스트를 공백(스페이스, 탭, 줄바꿈 등) 기준으로 나눈 뒤 빈 토큰을 제거한 개수를 셉니다. 형태소 분석 없이 순수하게 공백으로만 구분하므로, 한글처럼 조사가 붙은 어절 단위로 계산됩니다.

문장 수는 어떻게 계산하나요?

마침표(.), 느낌표(!), 물음표(?) 뒤에 공백이나 텍스트의 끝이 오는 패턴을 정규식으로 찾아 그 개수를 문장 수로 셉니다. 'Dr. Kim'처럼 마침표가 문장 끝이 아닌 경우도 하나의 문장으로 잘못 셀 수 있습니다.

한국어도 가독성 지수가 나오나요?

Flesch 공식은 영어 단어의 모음 개수로 음절을 추정하는 방식이라 한글 음절 구조와 맞지 않아, 이 도구는 한국어 텍스트에 대해서는 Flesch 점수 영역 자체를 표시하지 않습니다. 다만 글자 수·단어 수·문장 수·독서 시간 같은 기본 통계는 한국어에도 동일하게 적용됩니다.

문자 빈도 분석이란?

공백과 탭, 줄바꿈을 제외한 모든 문자를 하나씩 세어 등장 횟수가 많은 순서로 상위 20개를 막대그래프로 보여줍니다. 특정 글자나 기호가 유난히 많이 쓰였는지, 혹은 문체의 특징을 파악하는 데 참고할 수 있습니다.

고유 단어 수란?

모든 단어를 소문자로 변환한 뒤 중복을 제거한 개수입니다. 총 단어 수 대비 고유 단어 수 비율이 낮을수록 같은 단어를 반복해서 사용했다는 의미입니다.