Devin.KR

CHARACTER COUNTER · BYTES

글자수 세기

몇 글자인지, 몇 바이트인지

자기소개서 한 문단이나 '가나다' 세 글자를 붙여 넣으면 공백 포함·제외 글자수, 단어수, 줄수, UTF-8 바이트를 입력하는 즉시 셉니다. '가나다'는 3글자, UTF-8 9바이트로 나옵니다.

  • 실시간 계산
  • UTF-8 바이트
  • 원고지 매수
  • 브라우저에서만 처리
바로 사용하기 ↓
원고지 매수는 공백 포함 200자 기준입니다.
글자수(공백 포함)0
글자수(공백 제외)0
단어수0
줄수0
UTF-8 바이트0
원고지(200자)0매

MADE FOR YOUR WORK

이럴 때 쓰세요

자기소개서 분량 맞추기

지원서 항목의 '공백 포함 1,000자 이내' 같은 제한을 쓰는 동안 바로바로 확인합니다.

DB 컬럼 길이 점검

VARCHAR 길이가 바이트 단위인 DB 에 한글을 넣기 전에 UTF-8 바이트가 넘치지 않는지 봅니다.

SNS·광고 문구 길이

제목·요약문처럼 글자수 제한이 있는 곳에 넣을 문구를 다듬으며 길이를 맞춥니다.

원고 분량 어림하기

200자 원고지 기준 매수를 보고 청탁 원고나 과제 분량을 대략 가늠합니다.

STEP BY STEP

글자수 세기 사용 방법

이렇게 쓰세요

  1. 텍스트 붙여 넣기

    텍스트 칸에 직접 쓰거나 다른 곳에서 복사해 넣습니다.

  2. 표에서 숫자 확인

    글자수(공백 포함·제외), 단어수, 줄수, UTF-8 바이트, 원고지(200자)가 입력하는 즉시 바뀝니다.

  3. 제출처 기준과 맞추기

    제출처가 공백 포함인지 제외인지, 글자인지 바이트인지 확인하고 해당 줄을 봅니다.

  4. 지우고 다시

    지우기 버튼으로 칸을 비우고 다음 글을 셉니다.

UNDERSTAND THE BASICS

글자수와 바이트는 다르다

글자수는 사람이 보는 글자의 개수이고, 바이트는 그 글자를 컴퓨터에 저장할 때 드는 크기입니다. 같은 글자라도 인코딩에 따라 바이트가 달라집니다. 요즘 웹과 DB 의 표준인 UTF-8 에서 영문·숫자는 1바이트, 한글 완성형 한 글자는 3바이트, 이모지는 대부분 4바이트입니다.

예전 한국어 환경에서 쓰던 EUC-KR·CP949 에서는 한글이 2바이트입니다. 그래서 오래된 시스템이나 문자 메시지의 '80바이트' 같은 제한은 UTF-8 로 센 값과 맞지 않을 수 있습니다. 이 도구의 바이트는 UTF-8 기준만 보여 줍니다.

글자수도 생각보다 단순하지 않습니다. 이 도구는 유니코드 코드포인트 단위로 세어 이모지 하나를 1로 셉니다. 다만 피부색이 붙거나 여러 사람이 합쳐진 이모지, 국기처럼 여러 코드포인트로 된 문자는 2 이상으로 셀 수 있고, 맥에서 복사한 파일명처럼 자모가 풀어진 한글(NFD)은 한 음절이 2~3자로 셉니다.

문자별 UTF-8 바이트
문자글자수UTF-8 바이트EUC-KR 바이트(참고)
A111
가132
가나다396
공백 한 칸111
줄바꿈111
😀14표현 불가

글자수 세기 사용 안내

공백 포함·제외 글자수, 단어수, 줄수, UTF-8 바이트와 200자 원고지 매수를 실시간 계산합니다.

텍스트를 입력하거나 붙여 넣어 글자 수·단어 수 등 표시된 항목을 확인하세요. 공백과 줄바꿈 포함 여부를 구분해 원하는 기준으로 사용하세요.

QUICK EXAMPLE

글자수 세기 사용 예제

입력 · 시작

가나다

결과 · 확인

3글자 · UTF-8 9바이트

이모지와 결합 문자는 화면에 보이는 글자 수와 코드포인트 수가 다를 수 있습니다.

어떻게 구현했나

글자 수는 Array.from 으로 셉니다. 문자열의 length 는 UTF-16 단위라서 이모지 하나가 2로 세어지는데, Array.from 은 코드포인트 단위로 나눠 사람이 세는 숫자에 가깝습니다.

바이트는 TextEncoder 로 UTF-8 인코딩한 길이입니다. 한글은 한 글자에 3바이트라, 글자 수 제한이 아니라 바이트 제한이 걸린 컬럼이나 API 를 다룰 때 이 숫자가 필요합니다.

원고지 매수는 전체 글자 수를 200으로 나눈 값입니다. 실제 원고지는 줄바꿈마다 남는 칸이 생기므로 어림값입니다.

BEFORE YOU FINISH

자주 하는 실수

줄바꿈을 글자로 안 친다

이 도구는 줄바꿈도 공백 포함 글자수에 1자로 넣습니다. 제출 사이트가 줄바꿈을 빼고 센다면 문단 수만큼 차이가 납니다.

글자수 제한을 바이트로 착각한다

DB 컬럼이 VARCHAR(100) 이라도 DB 에 따라 100글자일 수도, 100바이트일 수도 있습니다. MySQL utf8mb4 는 글자, Oracle 은 기본 설정에서 바이트 기준입니다.

원고지 매수를 정확한 값으로 쓴다

원고지 매수는 공백 포함 글자수를 200으로 나눈 어림값입니다. 실제 원고지는 문단마다 남는 칸이 생겨 더 많이 나옵니다.

자주 묻는 질문

공백 포함 글자수와 공백 제외 글자수 차이는?

공백 포함은 띄어쓰기와 줄바꿈까지 모두 센 값이고, 공백 제외는 띄어쓰기·탭·줄바꿈을 빼고 센 값입니다. 어느 쪽을 쓰는지는 회사·사이트마다 다르니 공고를 확인하세요.

한글 한 글자는 몇 바이트인가요?

UTF-8 에서는 3바이트, EUC-KR·CP949 에서는 2바이트입니다. 이 도구의 바이트 칸은 UTF-8 기준입니다.

자소서 사이트와 글자수가 조금 달라요

흔한 원인은 줄바꿈을 세는 방식 차이입니다. 어떤 곳은 줄바꿈을 2자로, 어떤 곳은 0자로 셉니다. 이 도구는 1자로 셉니다.

단어수는 어떻게 세나요?

공백으로 나뉜 덩어리 수입니다. '안녕하세요 반갑습니다'는 2단어로, 조사가 붙은 어절도 한 단어로 셉니다.

이모지는 몇 글자로 세나요?

일반 이모지는 1글자, UTF-8 4바이트입니다. 여러 이모지를 이어 붙여 만든 가족·직업 이모지나 국기는 2글자 이상으로 셀 수 있습니다.

입력한 데이터는 어디에서 처리하나요?

이 도구의 입력 데이터는 브라우저에서 처리하며 도구 기능을 위해 서버로 업로드하지 않습니다. 결과를 공유하기 전 민감한 정보가 없는지 확인하세요.

함께 쓰면 좋은 도구

전체 도구 바로가기

손으로 익히기

문서 · 데이터 변환

개발 실무

한국 개발 특화

API · 네트워크

이미지 · 색상