생활·문서

글자 수와 바이트 차이|자소서 공백·줄바꿈은 어떻게 셀까?

자소서를 500자에 맞췄는데 제출창에서는 초과라고 나올 때가 있습니다. 글자 수, 바이트, 공백 처리 방식이 같은지부터 확인하면 불필요하게 문장을 줄이는 일을 피할 수 있습니다.

공백 포함·제외UTF-8줄바꿈제출창 최종 확인

500자와 500바이트는 다릅니다. 제출처가 세는 단위를 먼저 확인하세요

글자 수는 문자를 세는 값이고, 바이트는 정해진 인코딩으로 표현한 데이터 크기입니다. 바른계산소의 바이트는 UTF-8 기준이며 완성형 한글 ‘가’는 3바이트입니다. 공백·줄바꿈·이모지를 처리하는 방식에 따라 다른 입력창과 결과가 달라질 수 있습니다.

글자 수문자를 세는 기준 확인이 계산기는 유니코드 코드 포인트를 셉니다.
바이트UTF-8 데이터 크기한글·영문·이모지의 크기가 다릅니다.
제출 직전실제 입력창에서 확인기관의 안내와 최종 카운터를 함께 봅니다.
공백 포함·제외와 UTF-8 바이트 확인하기
노트북 문서의 길이와 문자 블록을 비교하며 글을 다듬는 사람의 일러스트
문장의 의미는 그대로여도 문자 종류와 공백 처리에 따라 표시되는 숫자는 달라질 수 있습니다.
이 글에서 바로 찾기

‘몇 글자’와 ‘얼마나 큰 데이터’는 다른 질문입니다

‘A’와 ‘가’는 이 계산기에서 각각 1자입니다. 그러나 UTF-8로 표현하면 A는 1바이트, 가는 3바이트입니다. 그래서 “500자 이내”와 “500바이트 이내”는 같은 제한이 아닙니다.

영문 예시

A를 500번 쓰면

공백 없이 500자·500바이트입니다. 기본 영문 대문자 A를 반복한 경우의 값입니다.

한글 예시

가를 500번 쓰면

공백 없이 500자·1,500바이트입니다. 글자 수는 같아도 UTF-8 바이트는 3배입니다.

실제 자소서는 한글·영문·숫자·기호가 섞이므로 ‘바이트를 3으로 나누면 글자 수’처럼 일괄 환산할 수 없습니다. 문장을 그대로 넣고 필요한 단위의 결과를 확인하는 편이 정확합니다.

한글, 띄어쓰기, 이모지 하나가 만드는 차이

아래 ‘글자 수’는 이 계산기의 코드 포인트 기준입니다. 코드 포인트는 컴퓨터가 문자를 구별하는 단위로, 눈에 보이는 글자 덩어리와 언제나 같지는 않습니다.

입력 예시공백 포함공백 제외UTF-8
A포함 1자제외 1자1바이트
포함 1자제외 1자3바이트
가 A · 띄어쓰기 1개포함 3자제외 2자5바이트
+ 줄바꿈(LF) + A포함 3자제외 2자5바이트
😀포함 1자제외 1자4바이트
👨‍👩‍👧‍👦포함 7자제외 7자25바이트

가족 이모지는 한 그림처럼 보여도 여러 문자와 연결 기호가 합쳐져 있습니다. 이처럼 눈에 한 덩어리로 보이는 단위를 기술 문서에서는 ‘그래핌 클러스터’라고 부릅니다. 그래핌을 세는 서비스와 코드 포인트를 세는 서비스의 결과가 다른 것은 계산 기준의 차이일 수 있습니다.

자소서나 신청서에서는 이모지가 꼭 필요한지부터 판단하세요. 핵심 내용을 전달하지 않는 장식 문자를 줄이면 길이 차이와 표시 오류를 함께 줄일 수 있습니다.

공백 제외에는 줄바꿈과 탭도 빠집니다

바른계산소는 ‘공백 포함’에서 입력 문자열의 코드 포인트를 그대로 세고, ‘공백 제외’에서는 일반 띄어쓰기·탭·줄바꿈 등 공백류를 제거합니다. 다른 도구가 일반 띄어쓰기만 빼고 있다면 같은 글도 공백 제외 값이 달라질 수 있습니다.

  • 엔터로 바꾼 줄과 자동으로 접힌 줄 구분직접 입력한 줄바꿈은 원문에 들어갑니다. 화면이 좁아 글이 다음 줄로 보이는 것은 그 자체로 문자를 추가하지 않습니다.
  • 줄 끝의 공백과 빈 줄 확인눈에 잘 보이지 않는 마지막 띄어쓰기, 문단 사이의 반복된 빈 줄도 확인하세요. 바이트 결과에는 이런 문자가 포함될 수 있습니다.
  • 워드·웹에서 복사한 문장은 최종 입력창에서 재확인탭, 특수 공백, 결합 문자 등이 함께 복사될 수 있습니다. 숫자 차이가 나면 차이가 시작되는 문장이나 문단부터 비교합니다.

원시 텍스트에서 LF는 1문자·1바이트, CRLF는 2문자·2바이트입니다. 다만 이 계산기 같은 브라우저 입력창은 줄바꿈을 정규화하므로 윈도에서 작성했다는 이유만으로 줄바꿈이 항상 2문자·2바이트로 계산되는 것은 아닙니다. 위 예제 표는 LF 한 개를 넣은 문자열 기준입니다.

‘글자 수’라는 이름 아래 여러 계산법이 있습니다

웹 입력창의 기본 길이 제한인 HTML maxlength는 UTF-16 코드 유닛이라는 단위를 사용합니다. 예를 들어 😀는 바른계산소의 코드 포인트 기준으로 1자지만 UTF-16에서는 2단위입니다. 다만 모든 제출 시스템이 이 기본 방식만 쓰는 것은 아닙니다.

한글도 겉모양만으로 내부 표현을 확정할 수는 없습니다. 완성형 ‘가’는 1코드 포인트·3바이트입니다. 같은 모양이어도 초성 ‘ᄀ’와 중성 ‘ᅡ’를 별도 코드 포인트로 저장한 문자열은 2코드 포인트·6바이트가 됩니다. 외부 문서에서 붙여넣은 일부 글자가 유독 다르다면 입력창의 표시와 제출처 안내를 함께 확인하세요.

이 계산기의 기준
글자 수: 유니코드 코드 포인트 수
공백 제외: 띄어쓰기·탭·줄바꿈 등 공백류 제거 후의 수
바이트: 공백을 포함한 원문을 UTF-8로 인코딩한 크기

마지막 확인은 실제 제출창에서 하세요

  1. 1
    제한 단위와 범위를 읽기

    ‘자’인지 ‘byte’인지, 공백 포함인지 제외인지, 문항별 제한인지 전체 제한인지 확인합니다.

  2. 2
    내용을 먼저 다듬고 길이 비교

    핵심 경험·행동·결과는 남기고 반복 표현부터 줄입니다. 바이트를 줄이려고 의미 없는 약어나 기호로 바꾸지 않습니다.

  3. 3
    최종 입력창에 붙여넣기

    입력하면서 잘린 부분이 없는지, 마지막 문장까지 들어갔는지, 줄바꿈이 의도대로 유지됐는지 확인합니다.

  4. 4
    최종 카운터와 저장 결과 확인

    안내된 제한 안에 들어가는지 보고 임시저장 후 다시 열어 확인합니다. 안내문과 입력창이 모순되면 제출처에 문의하고, 확인한 원문은 별도로 보관하세요.

자주 묻는 질문

한글 한 글자는 2바이트 아닌가요?

인코딩에 따라 다릅니다. 바른계산소가 사용하는 UTF-8에서는 완성형 한글 ‘가’가 3바이트입니다. 특정 기관이 한글을 2바이트로 세는 별도 규칙을 쓰면 그 기관의 안내와 결과를 확인해야 합니다.

공백 제외에는 엔터도 빠지나요?

바른계산소의 공백 제외는 일반 띄어쓰기뿐 아니라 줄바꿈·탭 등 공백류도 제거합니다. 제출처가 띄어쓰기만 제외하거나 줄바꿈을 다르게 처리한다면 숫자가 일치하지 않을 수 있습니다.

화면에서 두 줄이 되면 엔터 한 번으로 세나요?

아닙니다. 화면 폭 때문에 글이 다음 줄로 넘어가는 자동 줄바꿈은 직접 입력한 개행 문자와 다릅니다. 창을 좁게 만들었다는 이유만으로 원문의 글자 수가 늘어나는 것은 아닙니다.

이모지는 무조건 한 글자로 계산되나요?

아닙니다. ‘😀’는 이 계산기에서 1자로 세지만 ‘👨‍👩‍👧‍👦’처럼 여러 코드 포인트를 연결한 이모지는 7자로 셉니다. 눈에 보이는 한 덩어리와 프로그램의 문자 단위는 다를 수 있습니다.

자소서 카운터와 다르면 어느 숫자에 맞추나요?

공고의 글자·바이트·공백 규칙을 확인하고 실제 제출 입력창의 결과를 마지막으로 확인하세요. 안내문과 입력창이 모순된다면 담당자에게 문의해야 합니다. 외부 계산기의 숫자만으로 제출 가능 여부를 보장할 수 없습니다.

확인한 자료

브라우저·유니코드 공식 기술 문서와 바른계산소의 실제 계산 기준을 대조했습니다. 예시의 바이트는 UTF-8이며 파일 전체 크기가 아니라 문자열 자체의 인코딩 크기입니다. 학교·채용·행정 입력 시스템의 자체 규칙까지 동일하다는 뜻은 아닙니다.

전체 글 보기