글자 수·바이트 수 세기
글을 붙여 넣으면 글자 수와 인코딩별 바이트 수를 바로 보여 줍니다.
입력값은 브라우저 밖으로 나가지 않음WHATWG EncodingUAX #29기준일 2026.10.03
입력
결과
| 글자 수 | 0눈에 보이는 글자 단위: 이모지 결합은 1자 | |
|---|---|---|
| 공백 제외 글자 수 | 0 | |
| 코드 포인트 수 | 0 | |
| UTF-16 길이 | 0JavaScript·Java의 length와 같음 | |
| UTF-8 바이트 | 0 | |
| EUC-KR (CP949) 바이트 | 0 | |
| Shift_JIS (CP932) 바이트 | 0 | |
| 줄 수 | 0 | |
| 단어 수 | 0 | |
| 원고지 (200자) 매수 | 0줄바꿈을 뺀 글자 수 ÷ 200, 올림 |
글자 수·바이트 수 세기 사용 방법
- 1입력 칸에 글을 붙여 넣거나 「예시 넣기」를 누릅니다. 텍스트 파일은 「파일 열기」로 열 수 있습니다.
- 2결과 표에서 글자 수와 UTF-8·EUC-KR·Shift_JIS 바이트 수를 확인합니다. 제한 글자 수를 넣으면 남은 글자 수나 초과한 글자 수가 표 위에 나옵니다.
- 3표의 줄마다 있는 복사 버튼으로 필요한 값을 복사합니다.
글자 수·바이트 수 세기 옵션
- 줄바꿈 바이트
- 줄바꿈 하나를 LF(1바이트, 기본)로 셀지 CRLF(2바이트)로 셀지 고릅니다. 바이트 수 세 줄에만 쓰입니다. Windows에서 저장하는 파일이나 고정 길이 전문처럼 줄바꿈이 CRLF인 곳에 넣을 글이면 CRLF를 고르세요.
- 제한 글자 수
- 숫자를 넣으면 글자 수 기준으로 남은 수 또는 초과한 수를 보여 줍니다. 0이면 제한이 없습니다. 예: X(트위터) 280, 자기소개서 1,000.
글자 수를 세는 기준
같은 글도 세는 단위에 따라 길이가 달라집니다. 이 도구의 「글자 수」는 유니코드 UAX #29의 자소 클러스터, 곧 화면에 한 글자로 보이는 단위입니다. 👍🏻는 코드 포인트 2개, UTF-16 코드 단위 4개지만 1자로 셉니다. JavaScript나 Java의 length는 UTF-16 코드 단위 수라서 「UTF-16 길이」 줄과 같습니다.
공백 제외 글자 수는 띄어쓰기·탭·줄바꿈과 전각 공백(U+3000)을 뺀 값입니다. 줄 수는 줄바꿈 수에 1을 더한 값이고, 빈 입력은 0줄입니다.
EUC-KR·Shift_JIS 바이트 수
EUC-KR은 CP949(MS949), Shift_JIS는 CP932(Windows-31J) 기준입니다. 시스템마다 다를 수 있습니다. 브라우저가 쓰는 WHATWG Encoding 표준이 이 두 이름을 그렇게 정의하고, Windows와 Java의 MS949·Windows-31J도 같은 표를 씁니다.
좁은 뜻의 EUC-KR(KS X 1001)에는 한글이 2,350자뿐이라 똠 같은 글자가 없습니다. CP949는 나머지 8,822자를 확장 영역에 넣어 현대 한글 11,172자를 모두 2바이트로 적습니다. 받는 쪽 시스템이 확장 영역을 지원하지 않으면 같은 글자가 깨질 수 있으니, 고정 길이 전문이나 오래된 DB에 넣을 글은 그쪽 기준을 함께 확인하세요.
Shift_JIS에서 반각 가타카나(カ)는 1바이트, 전각 가나와 한자는 2바이트입니다. ①이나 髙처럼 JIS X 0208에 없는 글자는 CP932 확장 영역에 있습니다.
글자 수·바이트 수 세기 예시
한글과 영문 — 글자 수 12
Shift_JIS에는 한글이 없어 5자를 표현할 수 없습니다.
입력
안녕하세요 ZEKILO
출력
UTF-16 12 · UTF-8 22 · EUC-KR 17 · Shift_JIS —
히라가나와 영문 — 글자 수 12
EUC-KR의 바탕인 KS X 1001에는 가나가 들어 있습니다.
입력
こんにちは ZEKILO
출력
UTF-16 12 · UTF-8 22 · EUC-KR 17 · Shift_JIS 17
이모지 결합과 한글 — 글자 수 2, 코드 포인트 3
엄지 이모지와 피부색 수식 문자는 화면에서 한 글자입니다.
입력
👍🏻가
출력
UTF-16 5 · UTF-8 11 · EUC-KR — · Shift_JIS —
KS X 1001에 없는 한글 — 글자 수 4
「똠」은 KS X 1001에는 없지만 CP949 확장 영역에 있어 2바이트로 셉니다.
입력
똠방각하
출력
UTF-16 4 · UTF-8 12 · EUC-KR 8 · Shift_JIS —
JIS X 0208에 없는 글자 — 글자 수 2
두 글자 모두 CP932 확장 영역에 있습니다. EUC-KR에는 「髙」가 없습니다.
입력
①髙
출력
UTF-16 2 · UTF-8 6 · EUC-KR — · Shift_JIS 4
예시는 이 도구를 검증하는 기준 사례의 값입니다.
글자 수·바이트 수 세기 자주 묻는 질문
입력값이 서버로 전송되나요?
아니요. 입력과 결과는 이 브라우저 안에서만 처리되며 저장하지도 않습니다. 새로 고침하면 사라집니다.
EUC-KR 바이트 수는 어떤 기준으로 세나요?
EUC-KR은 CP949(MS949), Shift_JIS는 CP932(Windows-31J) 기준입니다. 시스템마다 다를 수 있습니다. 한글과 한자는 2바이트, 영문자·숫자는 1바이트로 세고, 그 인코딩에 없는 글자가 있으면 바이트 수 대신 「—」와 표현할 수 없는 문자 수를 보여 줍니다.
이모지나 조합형 한글은 몇 글자로 세나요?
글자 수는 화면에 보이는 글자 단위(자소 클러스터)로 셉니다. 피부색이 붙은 이모지, 국기, 가족 이모지, 첫가끝 자모로 적은 한글은 모두 1자입니다. 코드 포인트 수와 UTF-16 길이는 따로 보여 주므로 프로그램의 length 값과 비교할 수 있습니다.
한글 한 글자는 몇 바이트인가요?
UTF-8에서는 3바이트, EUC-KR(CP949)에서는 2바이트입니다. 그래서 「안녕하세요 ZEKILO」는 UTF-8로 22바이트, EUC-KR로 17바이트입니다. DB 컬럼이나 문자 메시지처럼 바이트로 제한하는 곳에서는 어느 인코딩인지 먼저 확인하세요.
자기소개서 글자 수 제한은 어떻게 확인하나요?
제한 글자 수에 1000처럼 숫자를 넣으면 남은 글자 수가 나오고, 넘으면 초과한 글자 수가 강조됩니다. 공백을 빼고 세는 양식이면 「공백 제외 글자 수」 줄을 보세요. 원고지 매수는 줄바꿈을 뺀 글자 수를 200으로 나눠 올림한 값입니다.
「—」로 나오는 줄은 무엇인가요?
그 인코딩으로 표현할 수 없는 문자가 들어 있다는 뜻입니다. 예를 들어 Shift_JIS에는 한글이 없고, EUC-KR과 Shift_JIS 모두 이모지가 없습니다. 몇 개인지는 줄 아래와 안내에 나옵니다.
관련 도구
처리 방식·표준
- 처리 위치: 이 브라우저 (내 기기). 전송하거나 저장하지 않습니다.
- 표준: WHATWG Encoding · UAX #29
- 엔진: ZEKILO Dev 글자 수·바이트 수 계산 (자체 구현) · EUC-KR·Shift_JIS 인코딩 표 (WHATWG Encoding index 기반) (BSD 3-Clause (WHATWG))
- 글자 수는 브라우저의 Intl.Segmenter로 나눕니다. 지원하지 않는 브라우저에서는 코드 포인트로 세고 그 사실을 알려 줍니다.
- 표현할 수 없는 문자 수는 코드 포인트 기준입니다.
- 단어 수는 공백으로 나눈 조각 수라서 띄어쓰기 없는 문장은 1로 셉니다.
- 기준일 2026.10.03
- 변경 이력: 2026.10.03 처음 공개