Text Utility
글자수 계산기
자기소개서, 블로그 글, 과제, 상품 설명, 메타 설명처럼 분량 기준이 중요한 문장을 빠르게 점검하세요. 글자수, 공백 제외 글자수, 단어수, 줄 수, 문장 수, 바이트 수를 브라우저에서 바로 계산합니다.
텍스트 분석
문장을 붙여 넣으면 글자수와 읽기 시간, 반복 키워드 힌트까지 한 화면에서 확인할 수 있습니다.
글자수는 UTF-16 코드 단위 기준으로, 😀는 2자로 셉니다. 바이트는 UTF-8 기준이며 줄바꿈은 입력창의 LF 1개로 계산합니다. 실제 제출 화면의 제한도 함께 확인하세요.
글자수·단어수·바이트 수를 구분해서 보는 법
제출처마다 공백 포함 여부, 단어 구분, 바이트 제한이 달라 같은 문장도 결과 기준이 달라질 수 있습니다. 이 페이지는 각 지표가 무엇을 세는지와 결과를 해석할 때 주의할 점을 함께 설명합니다.
이런 분께 유용합니다
- 자기소개서나 과제의 글자수 제한을 맞추려는 사용자
- 메타 설명·상품 설명·SNS 문구의 길이를 점검하는 작성자
- UTF-8 기준 데이터 크기와 문단·문장 수를 함께 보려는 사용자
대표 활용 상황
- 공백 포함 1,000자와 공백 제외 1,000자 기준을 비교할 때
- 한글과 이모지가 포함된 문구의 UTF-8 바이트 수를 확인할 때
- 긴 원고의 문단 수, 예상 읽기 시간과 반복 단어를 초벌 점검할 때
처음부터 결과 확인까지
- 1
제출 안내에서 공백 포함 여부와 글자 또는 바이트 기준을 먼저 확인합니다.
- 2
원문을 입력창에 붙여 넣고 전체 글자수와 공백 제외 수치를 구분해 봅니다.
- 3
문서가 단어 기준이면 단어수, 시스템 입력 제한이면 바이트 수를 확인합니다.
- 4
줄바꿈과 빈 문단이 제출 시스템에서 어떻게 처리되는지도 함께 점검합니다.
- 5
반복 키워드와 예상 읽기 시간은 초벌 점검용입니다. 필요한 경우 입력 복사로 원문을 복사하고, 초기화 뒤 새 원고를 입력합니다.
- 6
최종 제출 직전에는 실제 제출 화면의 카운터와 한 번 더 비교합니다.
공백 포함과 제외 비교
- 입력
- 오늘 날씨가 좋다
- 결과
- 공백 포함 9자 / 공백 제외 7자 / 3단어 / UTF-8 23바이트
따옴표와 마지막 줄바꿈 없이 입력한 결과입니다. 한글 7자는 21바이트, 띄어쓰기 2개는 2바이트입니다. 탭과 줄바꿈도 전체 글자수에는 포함되고 공백 제외 값에서는 빠집니다.
한글 UTF-8 바이트 확인
- 입력
- 한글 ABC 😀
- 결과
- 공백 포함 9자 / 공백 제외 7자 / 2단어 / UTF-8 15바이트
한글 2자 6바이트, 영문 3자 3바이트, 공백 2개 2바이트, 이모지 4바이트를 합친 결과입니다. 😀는 화면상 하나지만 JavaScript 길이에서는 2로 계산되며 단어수에는 포함되지 않습니다.
빈 줄과 마지막 줄바꿈
- 입력
- 첫 줄 둘째 줄
- 결과
- 공백 포함 10자 / 공백 제외 5자 / 4단어 / 4줄 / 2문단 / UTF-8 20바이트
첫 줄 뒤 Enter 2번, 둘째 줄 뒤 Enter 1번을 넣습니다. 한글 5자 15바이트, 공백 2개와 줄바꿈 3개 5바이트입니다. 마지막 줄바꿈 뒤의 빈 줄도 줄 수에는 포함하지만 빈 문단은 세지 않습니다. 화면 폭에 따른 자동 줄바꿈은 줄 수에 포함하지 않습니다.
결합 부호와 단어 안 작은따옴표
- 입력
- école école don’t
- 결과
- 공백 포함 18자 / 공백 제외 16자 / 3단어 / UTF-8 22바이트 / 최빈 단어 école 2회 (66.7%)
첫 단어는 e와 결합 악센트(U+0301), 두 번째는 단일 문자 é(U+00E9)로 시작합니다. 단어수는 둘 다 1이며 don’t도 1입니다. 빈도 비교에는 NFC 정규화와 소문자 변환을 적용하지만 글자수·바이트·복사 원문은 바꾸지 않습니다. 예시를 복사해 입력하면 차이를 확인할 수 있습니다.
계산·처리 기준
전체 글자수는 입력창 값의 UTF-16 코드 단위 수(String.length)입니다. 공백 제외는 JavaScript의 공백 문자 분류(\s)에 해당하는 띄어쓰기·탭·줄바꿈·줄바꿈 없는 공백 등을 제거한 값이며, 폭 없는 공백(U+200B)은 남습니다. 단어는 유니코드 문자·숫자와 뒤따르는 결합 부호를 묶고, 안쪽의 작은따옴표(' 또는 ’)와 하이픈(-)으로 연결합니다. 줄 수는 LF 개수에 1을 더하되 입력이 없으면 0입니다. 입력창은 CRLF·CR을 LF로 정리하므로 원본 파일 크기와 다를 수 있습니다. 빈 줄로 구분한 비어 있지 않은 덩어리를 문단으로, 마침표·물음표·느낌표·줄바꿈으로 나눈 덩어리를 근사 문장으로 셉니다. 바이트는 TextEncoder의 UTF-8 길이로, BOM과 파일 메타데이터는 제외합니다.
알아둘 한계
- JavaScript 문자열 길이는 일부 이모지와 결합 문자를 화면상 한 글자보다 크게 셀 수 있습니다.
- 한국어 단어수는 형태소 분석이 아니라 문자·숫자 묶음 기준이므로 전문 교정 통계와 다를 수 있습니다.
- 문장 수는 문장부호 기반의 근사치이며 약어, 소수점, 말줄임표를 완벽히 구분하지 않습니다.
- 읽기 시간은 이 페이지의 단어수 ÷ 분당 450단어를 올림한 참고값입니다. 측정된 개인 독서 속도나 연구 표준이 아니며, 단어가 없으면 0분입니다. 영어 UI는 220, 일본어·중국어 UI는 500을 사용하므로 화면 언어에 따라 달라집니다. 띄어쓰기 없는 글에는 적합하지 않습니다.
- 키워드는 NFC 정규화·소문자 변환 후 2코드 단위 이상인 후보에서 고릅니다. the·and 등 코드에 지정된 일부 영어 기능어를 제외하고, 동률이면 먼저 나온 단어를 표시합니다. 비율의 분모는 제외 전 전체 단어수입니다. 이는 SEO 점수나 검색 순위 평가가 아닙니다.
- 제출 사이트가 EUC-KR 등 다른 인코딩이나 자체 공백 규칙을 쓰면 바이트·글자수가 다를 수 있습니다.
입력한 문장은 현재 브라우저 메모리에서만 분석합니다. 이 도구는 텍스트 내용이나 계산 결과를 win-j 서버로 전송하거나 저장하지 않습니다.
참고 자료
함께 쓰면 좋은 도구
자주 묻는 질문
지원서나 SNS에 붙여 넣으면 글자수가 다른 이유는 무엇인가요?
이 도구는 UTF-16 코드 단위로 글자수를 계산하고 바이트는 UTF-8로 계산합니다. 제출처는 화면에 보이는 문자 단위로 세거나 줄바꿈·공백을 다르게 처리할 수 있습니다. 특히 이모지, 결합 문자, 여러 글자로 구성된 이모지는 차이가 커질 수 있으므로 제출처의 최종 카운터를 기준으로 확인하세요.
이모지는 왜 한 글자보다 크게 계산될 수 있나요?
일부 이모지는 여러 유니코드 코드 단위와 결합 문자로 구성됩니다. 현재 전체 글자수는 JavaScript 문자열 길이를 사용하므로 사람이 보는 글자 묶음과 차이가 날 수 있습니다.
바이트 수는 어떤 인코딩 기준인가요?
브라우저의 TextEncoder가 사용하는 UTF-8 기준입니다. 제출 시스템이 다른 인코딩을 사용하면 그 시스템의 안내값을 우선하세요.
입력한 자기소개서가 서버에 저장되나요?
아닙니다. 분석은 브라우저 안에서 실행되며 입력 텍스트를 서버에 보내거나 저장하지 않습니다.
복사 버튼이 동작하지 않으면 어떻게 하나요?
입력 복사는 통계가 아닌 입력창 원문을 복사합니다. 브라우저가 자동 복사를 차단하면 실패 안내가 표시됩니다. 입력창의 텍스트를 선택해 기기의 복사 메뉴 또는 Ctrl+C로 복사하세요. 입력창에서 정리된 LF 줄바꿈은 운영체제 클립보드에서 다르게 표현될 수 있습니다.