글자 수와 바이트 계산

글자 수와 바이트를
입력 즉시 계산합니다.

자기소개서, SNS 문구, 원고, SMS 길이를 확인할 때 공백 포함·제외 기준과 UTF-8 바이트를 함께 봅니다.

한글, 영문, 숫자, 줄바꿈, 이모지를 모두 포함해 계산합니다.

0자 · 0바이트 · 0줄
공백 포함 글자 수0
공백 제외 글자 수0
UTF-8 바이트0
단어 수0
줄 수0

UTF-8 바이트는 한글처럼 여러 바이트를 쓰는 문자를 포함할 때 글자 수와 다를 수 있습니다.

실무에서 쓰는 경우

자기소개서 제한 확인제출 사이트의 공백 포함·제외 기준과 현재 원고를 비교합니다.

API payload 점검데이터베이스나 API의 UTF-8 바이트 제한을 넘는지 원문을 전송하지 않고 확인합니다.

SNS·원고 검수이모지와 줄바꿈이 섞인 문장의 grapheme, 단어, 줄 수를 나란히 확인합니다.

검산 가능한 예시

한글·이모지·줄바꿈

A 한글 😀↵B는 공백 포함 8자, 공백 제외 5자, UTF-8 15바이트, 4단어, 2줄입니다.

가족 이모지

👨‍👩‍👧‍👦Intl.Segmenter를 지원하는 브라우저에서 하나의 grapheme으로 셉니다.

한글과 UTF-8

안녕하세요는 화면에서 5글자지만 UTF-8에서는 15바이트입니다.

글자 수 FAQ

가족 이모지가 한 글자로 계산되는 이유는 무엇인가요?

지원 브라우저에서는 여러 코드 포인트를 사용자가 인식하는 하나의 grapheme cluster로 묶기 때문입니다.

UTF-8 바이트가 SMS 길이와 다른 이유는 무엇인가요?

SMS는 GSM-7, UCS-2 등 서비스별 인코딩과 분할 규칙을 사용하므로 UTF-8 저장 바이트와 기준이 다릅니다.

제출 플랫폼의 글자 수와 다르면 무엇을 따라야 하나요?

최종 제출 서비스가 공개한 공백·결합 문자 집계 기준과 그 서비스에 표시되는 값을 우선하세요.

입력할 수 있는 최대 길이가 있나요?

명시적인 제한은 없으며 실제 처리량은 브라우저와 기기의 사용 가능한 메모리에 의존합니다.

집계 기준

화면의 글자와 저장 용량을 구분하기 위해 각 지표에 다른 웹 표준 API를 사용합니다.

Grapheme 수

ECMA-402 Intl.Segmenter로 결합 문자와 이모지 시퀀스를 가능한 한 사용자가 인식하는 한 글자로 셉니다.

UTF-8 바이트

WHATWG TextEncoder로 UTF-8 인코딩 결과의 바이트 길이를 계산합니다.

단어와 줄

단어는 유니코드 공백으로 분리하고 줄은 CRLF, CR, LF를 모두 줄바꿈으로 정규화해 셉니다.

해석할 때의 한계

제출 서비스의 자체 집계 규칙이 있다면 그 기준을 최종값으로 사용하세요.

단어 수는 형태소 분석이 아닙니다

붙여 쓴 한글 어절은 하나로 셉니다. 원고지나 편집기의 언어별 단어 분석과 다를 수 있습니다.

UTF-8은 SMS 바이트가 아닙니다

SMS는 통신사와 인코딩 규칙이 별도이므로 이 도구의 UTF-8 바이트와 메시지 과금 단위가 다를 수 있습니다.

입력량은 기기 메모리에 의존합니다

명시적인 최대 길이는 없지만 매우 긴 원문은 브라우저 메모리를 사용합니다. Segmenter 미지원 환경에서는 코드 포인트 단위로 대체합니다.

검토와 참고 자료

검토 기록마지막 검토:
로직 버전: 20260724-1
검증 벡터: 한글·공백·이모지·줄바꿈

개인정보계산은 브라우저 안에서 실행됩니다. 오류를 신고할 때 원문을 보내지 마세요.

글자 수와 UTF-8 바이트 가이드
글자 수 불일치 신고 — 입력 길이, 브라우저, 5개 결과값과 기대값만 적어 주세요.