예시
입력
자기소개서 본문 1,200자 붙여넣기
출력
글자수(공백 포함) 1,200 · (공백 제외) 1,043 · 단어 312 · 문장 24 · 문단 5 · 바이트(UTF-8) 3,180
참고
지원서 양식이 '공백 포함 1,500자 이내' 처럼 조건을 걸 때가 많아 두 기준을 함께 보여 줍니다. 예전 게시판 방식(한글 2바이트)으로 세는 바이트 수도 따로 표시합니다.
사용법 / 자주 묻는 질문
이런 경우 사용하세요
- 자기소개서 · 지원서의 '공백 포함/제외 N자 이내' 조건 맞추기
- 리포트 · 과제의 분량 확인
- 블로그 글의 예상 읽기 시간 가늠
- SNS · 메타 설명처럼 글자 수 제한이 있는 문구 다듬기
- DB 컬럼 길이에 맞는지 UTF-8 바이트 수로 확인
자주 묻는 질문
- Q.공백 포함과 제외 중 어느 쪽이 기준인가요?
- A.양식마다 다릅니다. 한국 기업 · 대학 지원서는 '공백 포함' 을 쓰는 경우가 많고, 일부는 '공백 제외' 를 명시합니다. 이 도구는 둘 다 동시에 보여 주니 요강의 문구를 그대로 확인하세요.
- Q.한국어 단어 수는 어떻게 세나요?
- A.공백을 기준으로 끊어 셉니다. 즉 한국어에서는 언어학적 '단어' 가 아니라 띄어쓰기 단위(어절)가 셉니다 — '학교에 간다' 는 2 로 계산됩니다. 영어처럼 띄어쓰기가 곧 단어인 언어와 수치를 직접 비교하기는 어렵습니다.
- Q.바이트 수가 두 가지로 나오는 이유는?
- A.UTF-8 에서 한글 한 글자는 3바이트지만, 예전 게시판 · 레거시 시스템은 한글을 2바이트로 세는 EUC-KR 계열 기준을 쓰는 곳이 있습니다. 어느 쪽 기준인지 모를 때를 대비해 둘 다 보여 줍니다.
- Q.예상 읽기 시간은 어떤 기준인가요?
- A.분당 200 단어로 계산한 보수적인 값입니다. 영어 묵독 속도 연구의 평균은 분당 약 238 단어인데, 기술 문서나 낯선 주제는 더 느리게 읽히므로 여유를 둔 수치를 씁니다.
재미있는 사실
'단어' 를 세는 일은 언어마다 난이도가 다릅니다. 한국어 · 중국어 · 일본어는 단어 사이에 공백이 없어 경계가 자명하지 않고, 유니코드는 이 문제를 별도 표준(UAX #29 Text Segmentation)으로 다룹니다. 브라우저의 Intl.Segmenter 가 바로 그 구현입니다.
Unicode — UAX #29 Text Segmentation'읽기 속도 분당 몇 단어' 라는 흔한 수치는 생각보다 최근에 정리됐습니다. 2019년 190편 연구를 모은 메타분석은 영어 묵독 평균을 분당 238 단어(소리 내어 읽으면 183 단어)로 보고했고, 흔히 인용되던 300 wpm 같은 값보다 낮았습니다.
Journal of Memory and Language — Brysbaert (2019)어떤 언어의 글이든 단어 빈도는 순위에 거의 반비례합니다 — 가장 흔한 단어가 두 번째 단어의 약 2배, 세 번째의 약 3배로 나타납니다. 1930년대 George Zipf 가 정리한 이 경험 법칙은 오늘날 토크나이저 어휘 사전 설계의 전제이기도 합니다.
Wikipedia — Zipf's law
관련 도구
- JSON 포매터 / 검증기
JSON 문자열을 포맷팅·검증·압축합니다. 들여쓰기 조정과 키 정렬 옵션이 있으며, 브라우저에서 즉시 실행됩니다.
- 문자열 케이스 변환
문자열을 camelCase·PascalCase·snake_case·kebab-case·CONSTANT_CASE·Title Case 6개 형태로 동시에 변환해 보여줍니다.
- 정규식 테스터
JavaScript 정규식을 실시간으로 테스트합니다. g/i/m/s/u/y 플래그와 캡처 그룹을 지원합니다.
- Markdown 프리뷰
Markdown을 HTML로 렌더링하여 좌·우로 비교 표시합니다. CommonMark + GFM(테이블·코드 펜스·태스크 리스트) 지원.
- HTML → Markdown
HTML을 Markdown으로 변환합니다. 헤딩·리스트·링크·코드·표·인용 지원. 브라우저 DOMParser 사용 — 정확하고 0 dependency.
- YAML ↔ JSON 변환
YAML과 JSON을 양방향 변환합니다. YAML 측의 주석·멀티라인 문자열을 허용합니다.
- 텍스트 비교
두 텍스트를 줄·단어·문자 단위로 비교하고 추가/삭제를 강조합니다.
- JSON 비교
두 JSON을 정렬·정규화 후 비교, 변경점을 강조합니다. 잘못된 JSON 에러 안내 포함.
- CSV ↔ JSON
CSV와 JSON을 상호 변환합니다. 쿼팅·구분자·헤더 행을 지원합니다.
- SQL 포매터
SQL 쿼리를 들여쓰기·키워드 케이스에 맞게 포매팅합니다. PostgreSQL/MySQL/SQLite/Standard 지원.
- XML 포매터
XML을 보기 좋게 포매팅하거나 압축합니다. SOAP·sitemap·설정 파일에 적합.
- XML ↔ JSON
XML과 JSON을 상호 변환합니다. 속성과 요소 표기를 모두 지원합니다.
- 스마트 붙여넣기
어떤 텍스트든 붙여넣으면 적합한 도구를 추천합니다 — JSON·JWT·Base64·URL·UUID·Cron 등 15종 자동 감지.
- 로렘 입숨 생성기
더미 텍스트를 단어·문장·문단 단위로 생성합니다. 정통 Lorem Ipsum 또는 랜덤.
- JSON Path 추출기
JSONPath 표현식($.store.book[*].author 등)으로 JSON에서 값을 추출합니다.
- JSON Schema 검증기
JSON 데이터를 JSON Schema(Draft 2020-12)로 검증합니다. Ajv + format 검증 지원.
- JSON Schema 생성기
샘플 JSON에서 JSON Schema(Draft 2020-12)를 자동 생성합니다. 타입·필수 필드·중첩 구조 추론.
- HTML 포매터
HTML을 보기 좋게 들여쓰기·압축합니다. pre/textarea 공백 보존.
- CSS 포매터
CSS를 들여쓰기·압축합니다. 셀렉터·속성 스타일 옵션.
- JavaScript 포매터
JavaScript를 들여쓰기·압축합니다. 들여쓰기 2/4/탭 옵션.
- TOML ↔ JSON
TOML과 JSON을 상호 변환합니다. Cargo.toml, pyproject.toml 등 설정 파일에 자주 사용.
- INI ↔ JSON
INI 설정 파일을 JSON으로 변환합니다. [section]·주석(;/#)·key=value 지원.
- JSON → TypeScript
JSON 샘플로 TypeScript interface를 생성합니다. 중첩 객체는 별도 interface로 분리.
- JS Object → JSON
JavaScript 객체 리터럴(따옴표 없는 키, 작은따옴표, trailing comma, 주석)을 표준 JSON 으로 변환합니다. 관대한 파서, 엄격한 출력.
- Slug 생성기
텍스트를 URL-safe slug으로 변환합니다. 구분자/대소문자/악센트 제거 옵션.
- ASCII 트리
들여쓰기 또는 경로 목록을 box-drawing 트리(├── │ └──)로 변환합니다.
- Diff 패치
두 텍스트로부터 unified diff(-u) 패치를 생성합니다. `git apply` / `patch -p0` 호환.
- Mock 데이터 생성기
이름·이메일·커스텀 필드·UUID·날짜 등 가짜 JSON 레코드와 SQL INSERT seed 데이터를 생성합니다. 외부 의존 없음.
- MongoDB Extended JSON
MongoDB Extended JSON(EJSON)을 Canonical ↔ Relaxed 양방향 변환하거나, BSON wrapper를 제거해 일반 JSON으로 만듭니다. 16종 wrapper 인식 ($oid/$date/$numberLong/$numberDecimal/$binary/…).
- Kubernetes YAML 시각화
Kubernetes 매니페스트를 붙여넣으면 리소스 그래프를 그립니다. Deployment·Service·Ingress·ConfigMap·Secret·PVC 의 연결을 한눈에. 모든 처리는 브라우저에서.
- Docker Compose 시각화
docker-compose.yml 을 붙여넣으면 서비스·네트워크·볼륨·depends_on 을 인터랙티브 그래프로 그립니다. 100% 브라우저 처리.
- PDF 텍스트 추출
PDF 파일에서 텍스트를 추출합니다. 페이지별 또는 전체 합쳐서. 마크다운 호환 출력, 브라우저에서만 처리.
- PPTX 텍스트 추출
PPTX 파일에서 슬라이드 텍스트를 추출합니다. 플레인 / 마크다운 / 슬라이드별 3 모드. 덱을 마크다운으로 옮길 때 유용 — 모두 브라우저에서.
- 정규식 다이어그램
정규식을 railroad 다이어그램으로 시각화. 분기·그룹·반복을 한눈에 — 브라우저에서.
- 토큰 계산기 (LLM)
LLM 토큰 수와 비용을 계산합니다. GPT는 정확(tiktoken), Claude/Gemini는 추정. 컨텍스트 한도 게이지. 브라우저에서 바로.