한글·이모지·줄바꿈
A 한글 😀↵B는 공백 포함 8자, 공백 제외 5자, UTF-8 15바이트, 4단어, 2줄입니다.
글자 수와 바이트 계산
자기소개서, SNS 문구, 원고, SMS 길이를 확인할 때 공백 포함·제외 기준과 UTF-8 바이트를 함께 봅니다.
UTF-8 바이트는 한글처럼 여러 바이트를 쓰는 문자를 포함할 때 글자 수와 다를 수 있습니다.
자기소개서 제한 확인제출 사이트의 공백 포함·제외 기준과 현재 원고를 비교합니다.
API payload 점검데이터베이스나 API의 UTF-8 바이트 제한을 넘는지 원문을 전송하지 않고 확인합니다.
SNS·원고 검수이모지와 줄바꿈이 섞인 문장의 grapheme, 단어, 줄 수를 나란히 확인합니다.
A 한글 😀↵B는 공백 포함 8자, 공백 제외 5자, UTF-8 15바이트, 4단어, 2줄입니다.
👨👩👧👦는 Intl.Segmenter를 지원하는 브라우저에서 하나의 grapheme으로 셉니다.
안녕하세요는 화면에서 5글자지만 UTF-8에서는 15바이트입니다.
지원 브라우저에서는 여러 코드 포인트를 사용자가 인식하는 하나의 grapheme cluster로 묶기 때문입니다.
SMS는 GSM-7, UCS-2 등 서비스별 인코딩과 분할 규칙을 사용하므로 UTF-8 저장 바이트와 기준이 다릅니다.
최종 제출 서비스가 공개한 공백·결합 문자 집계 기준과 그 서비스에 표시되는 값을 우선하세요.
명시적인 제한은 없으며 실제 처리량은 브라우저와 기기의 사용 가능한 메모리에 의존합니다.
화면의 글자와 저장 용량을 구분하기 위해 각 지표에 다른 웹 표준 API를 사용합니다.
ECMA-402 Intl.Segmenter로 결합 문자와 이모지 시퀀스를 가능한 한 사용자가 인식하는 한 글자로 셉니다.
WHATWG TextEncoder로 UTF-8 인코딩 결과의 바이트 길이를 계산합니다.
단어는 유니코드 공백으로 분리하고 줄은 CRLF, CR, LF를 모두 줄바꿈으로 정규화해 셉니다.
제출 서비스의 자체 집계 규칙이 있다면 그 기준을 최종값으로 사용하세요.
붙여 쓴 한글 어절은 하나로 셉니다. 원고지나 편집기의 언어별 단어 분석과 다를 수 있습니다.
SMS는 통신사와 인코딩 규칙이 별도이므로 이 도구의 UTF-8 바이트와 메시지 과금 단위가 다를 수 있습니다.
명시적인 최대 길이는 없지만 매우 긴 원문은 브라우저 메모리를 사용합니다. Segmenter 미지원 환경에서는 코드 포인트 단위로 대체합니다.
검토 기록마지막 검토:
로직 버전: 20260724-1
검증 벡터: 한글·공백·이모지·줄바꿈
개인정보계산은 브라우저 안에서 실행됩니다. 오류를 신고할 때 원문을 보내지 마세요.
글자 수와 UTF-8 바이트 가이드
글자 수 불일치 신고 — 입력 길이, 브라우저, 5개 결과값과 기대값만 적어 주세요.