MODOO HUB ← 모두의 툴
Text · Instrument

키워드 추출기

텍스트에서 핵심 키워드를 빈도 순으로 자동 추출

키워드 추출기

이 도구는 텍스트를 정규식으로 단어 단위로 쪼갠 뒤, 미리 정의된 약 90개의 영어 불용어 목록(the, a, is, of 등 문법적으로만 기능하고 의미를 담지 않는 단어)에 해당하는 것을 걸러내고, 남은 단어의 등장 횟수를 세어 빈도가 높은 순서대로 정렬하는 방식으로 키워드를 뽑아냅니다. 단순 빈도 계산이라 TF-IDF처럼 문서 전체에서 상대적으로 중요한 단어를 가려내는 정교한 알고리즘은 아니지만, 짧은 글이나 블로그 포스트 한 편에서 어떤 단어가 반복적으로 강조되는지 빠르게 파악하는 데는 충분합니다. 최소 글자 수 필터로 짧은 관사·전치사를 추가로 걸러낼 수 있고, 대소문자 무시 옵션을 켜면 'Apple'과 'apple'을 같은 단어로 합산합니다. 블로그 글의 반복 키워드를 점검해 SEO 밀도를 확인하거나, 긴 문서·회의록에서 자주 언급된 주제어를 빠르게 훑어볼 때 활용됩니다.

자주 묻는 질문

키워드 추출은 어떻게 작동하나요?

정규식으로 문자·숫자·아포스트로피·하이픈만 남기고 나머지 기호를 공백으로 바꿔 단어를 분리한 뒤, 불용어를 제거하고, 각 단어의 등장 횟수를 누적한 다음 빈도 내림차순으로 정렬해 상위 N개만 잘라내는 순서로 처리합니다.

불용어란 무엇인가요?

the, a, is, of처럼 문법적 기능만 하고 그 자체로는 주제를 나타내지 않는, 거의 모든 영어 문장에 등장하는 고빈도 단어입니다. 이 도구는 이런 단어들이 항상 빈도 상위권을 차지해 진짜 핵심어를 가리는 것을 막기 위해 약 90개의 기본 목록으로 걸러냅니다.

한국어 키워드 추출도 가능한가요?

공백 기준으로 단어를 나누기 때문에 한국어 텍스트도 일단 처리는 되지만, 한국어는 '텍스트를', '텍스트가'처럼 조사가 단어에 그대로 붙어있어 형태소 분석 없이는 같은 단어가 다른 형태로 흩어져 집계됩니다. 정확한 한국어 키워드 빈도 분석에는 형태소 분석기가 필요합니다.

최소 글자 수란?

이 값보다 글자 수가 적은 단어는 애초에 집계에서 제외됩니다. 영어 불용어 목록에 없는 짧은 대명사나 약어(예: it, ok)까지 걸러내고 싶을 때 최소 길이를 3~4자 이상으로 올리면 효과적입니다.

칩을 클릭하면?

클릭한 키워드 텍스트가 클립보드에 복사되고, 옆의 등장 횟수 숫자가 잠깐 '복사됨!' 문구로 바뀌었다가 원래 숫자로 돌아옵니다.

SEO에 어떻게 활용하나요?

작성한 블로그 글이나 랜딩페이지 본문을 붙여넣으면, 실제로 어떤 단어가 몇 번이나 반복됐는지 숫자로 확인할 수 있어 특정 키워드가 과도하게 반복되지는 않았는지, 반대로 타깃 키워드가 충분히 등장하는지 점검하는 용도로 쓸 수 있습니다.

상위 몇 개까지 추출 가능한가요?

'상위 N개' 입력란에 1부터 100 사이의 값을 지정할 수 있으며, 실제 텍스트에 등장하는 서로 다른 단어 수가 이보다 적으면 그만큼만 표시됩니다.

불용어를 커스텀할 수 있나요?

현재는 코드에 하드코딩된 영어 기본 불용어 집합(약 90개) 하나만 사용하며, 사용자가 직접 단어를 추가하거나 빼는 기능, 다른 언어의 불용어 세트는 아직 지원하지 않습니다.