본문으로 건너뛰기
yutils
예시

입력

자기소개서 본문 1,200자 붙여넣기

출력

글자수(공백 포함) 1,200 · (공백 제외) 1,043 · 단어 312 · 문장 24 · 문단 5 · 바이트(UTF-8) 3,180

참고

지원서 양식이 '공백 포함 1,500자 이내' 처럼 조건을 걸 때가 많아 두 기준을 함께 보여 줍니다. 예전 게시판 방식(한글 2바이트)으로 세는 바이트 수도 따로 표시합니다.

사용법 / 자주 묻는 질문

이런 경우 사용하세요

  • 자기소개서 · 지원서의 '공백 포함/제외 N자 이내' 조건 맞추기
  • 리포트 · 과제의 분량 확인
  • 블로그 글의 예상 읽기 시간 가늠
  • SNS · 메타 설명처럼 글자 수 제한이 있는 문구 다듬기
  • DB 컬럼 길이에 맞는지 UTF-8 바이트 수로 확인

자주 묻는 질문

Q.공백 포함과 제외 중 어느 쪽이 기준인가요?
A.양식마다 다릅니다. 한국 기업 · 대학 지원서는 '공백 포함' 을 쓰는 경우가 많고, 일부는 '공백 제외' 를 명시합니다. 이 도구는 둘 다 동시에 보여 주니 요강의 문구를 그대로 확인하세요.
Q.한국어 단어 수는 어떻게 세나요?
A.공백을 기준으로 끊어 셉니다. 즉 한국어에서는 언어학적 '단어' 가 아니라 띄어쓰기 단위(어절)가 셉니다 — '학교에 간다' 는 2 로 계산됩니다. 영어처럼 띄어쓰기가 곧 단어인 언어와 수치를 직접 비교하기는 어렵습니다.
Q.바이트 수가 두 가지로 나오는 이유는?
A.UTF-8 에서 한글 한 글자는 3바이트지만, 예전 게시판 · 레거시 시스템은 한글을 2바이트로 세는 EUC-KR 계열 기준을 쓰는 곳이 있습니다. 어느 쪽 기준인지 모를 때를 대비해 둘 다 보여 줍니다.
Q.예상 읽기 시간은 어떤 기준인가요?
A.분당 200 단어로 계산한 보수적인 값입니다. 영어 묵독 속도 연구의 평균은 분당 약 238 단어인데, 기술 문서나 낯선 주제는 더 느리게 읽히므로 여유를 둔 수치를 씁니다.
재미있는 사실
  • '단어' 를 세는 일은 언어마다 난이도가 다릅니다. 한국어 · 중국어 · 일본어는 단어 사이에 공백이 없어 경계가 자명하지 않고, 유니코드는 이 문제를 별도 표준(UAX #29 Text Segmentation)으로 다룹니다. 브라우저의 Intl.Segmenter 가 바로 그 구현입니다.

    Unicode — UAX #29 Text Segmentation
  • '읽기 속도 분당 몇 단어' 라는 흔한 수치는 생각보다 최근에 정리됐습니다. 2019년 190편 연구를 모은 메타분석은 영어 묵독 평균을 분당 238 단어(소리 내어 읽으면 183 단어)로 보고했고, 흔히 인용되던 300 wpm 같은 값보다 낮았습니다.

    Journal of Memory and Language — Brysbaert (2019)
  • 어떤 언어의 글이든 단어 빈도는 순위에 거의 반비례합니다 — 가장 흔한 단어가 두 번째 단어의 약 2배, 세 번째의 약 3배로 나타납니다. 1930년대 George Zipf 가 정리한 이 경험 법칙은 오늘날 토크나이저 어휘 사전 설계의 전제이기도 합니다.

    Wikipedia — Zipf's law