글자 수 분석과 텍스트 정리 기준
텍스트 도구는 입력한 문장을 브라우저의 유니코드 문자열로 읽어 띄어쓰기 포함 글자수, 띄어쓰기 제외 글자수, 단어, 줄, 문장과 UTF-8 바이트 수를 계산합니다. 글자수는 Array.from으로 유니코드 코드 포인트를 세어 한글과 일반 이모지를 가능한 한 화면에서 보이는 문자에 가깝게 처리합니다. 다만 피부색 조합이나 가족 이모지처럼 여러 코드 포인트가 하나의 그림으로 결합되는 문자는 둘 이상으로 계산될 수 있습니다. ‘띄어쓰기 포함’은 스페이스, 줄바꿈, 탭을 포함한 전체 문자 수이고, ‘띄어쓰기 제외’는 이 공백 문자를 모두 제거한 뒤 센 값입니다. 자기소개서나 게시물처럼 서비스마다 공백 포함·제외 기준이 다른 글자 제한을 확인할 때 두 값을 함께 비교할 수 있습니다.
단어 수는 앞뒤 공백을 제거하고 하나 이상의 공백을 경계로 나눕니다. 한국어는 영어처럼 모든 단어가 공백으로 분리되지 않기 때문에 형태소 수가 아니라 띄어쓰기 기준 어절 수에 가깝습니다. 문장 수는 마침표, 물음표, 느낌표와 한국어·동아시아권 문장 부호를 경계로 나눈 참고치입니다. 줄 수는 줄바꿈 기준이며 빈 줄도 한 줄로 포함합니다. UTF-8 바이트는 웹 입력 제한이나 데이터 전송 크기를 가늠할 때 도움이 되지만 서비스가 UTF-16이나 다른 인코딩을 사용하면 실제 저장 용량은 달라질 수 있습니다.
줄바꿈 제거는 Windows의 CRLF와 macOS·모바일의 LF 등 서로 다른 줄바꿈을 한 칸의 공백으로 바꿉니다. 줄의 양쪽 공백도 함께 정리해 문장이 붙어서 의미가 달라지는 일을 줄입니다. 연속 공백 정리는 각 줄의 여러 칸과 탭을 한 칸으로 바꾸고 줄의 앞뒤 공백을 제거합니다. 빈 줄 제거는 내용이 없는 줄만 없애고 내용이 있는 줄 사이의 줄바꿈은 유지합니다. 따라서 여러 줄을 한 문단으로 만들 때는 ‘줄바꿈 제거’, 문단 구조를 유지하며 빈 행만 없앨 때는 ‘빈 줄 제거’를 선택하는 것이 좋습니다.
중복 줄 제거는 위에서부터 읽어 처음 등장한 줄만 남기고 이후 완전히 같은 줄을 삭제합니다. 이때 대소문자와 앞뒤 공백이 다르면 서로 다른 줄로 봅니다. 가나다·ABC 정렬은 한국어 로케일 비교와 숫자 자연 정렬을 적용하므로 ‘항목 2’가 ‘항목 10’보다 먼저 배치됩니다. 한글, 영문, 숫자, 특수문자를 함께 넣으면 문자 종류에 따른 브라우저 정렬 규칙이 적용되므로 중요한 목록은 결과를 한 번 확인하세요. 대문자·소문자 변환은 주로 영문에 적용되고 한글과 숫자는 그대로 유지됩니다.
입력한 원문과 처리 결과는 서버로 보내거나 localStorage에 저장하지 않습니다. 브라우저에는 마지막으로 선택한 작업 종류만 사용자 설정으로 남습니다. 페이지를 새로 고치면 원문과 결과가 사라지므로 필요한 내용은 결과 복사 버튼으로 보관하세요. 개인정보, 비밀번호, 계약서 원문처럼 민감한 내용을 다룰 때도 계산은 로컬에서 이루어지지만 화면 공유, 브라우저 확장 프로그램, 클립보드 기록 등 기기 환경의 보안은 사용자가 별도로 확인해야 합니다.
기능별 사용법과 처리 기준
글자수 세기
‘글자수 세기’를 선택하고 원문을 넣으면 띄어쓰기 포함·제외 글자수, 단어 수, 줄 수, 문장 수, UTF-8 바이트가 한 번에 표시됩니다. 제출처가 안내한 기준과 일치하는 항목을 확인하세요.
대소문자 변환
영문을 모두 대문자 또는 소문자로 바꿉니다. 상품 코드, 태그, 이메일 목록의 표기를 통일할 때 유용하며 한글·숫자·일반 문장부호는 그대로 남습니다.
줄바꿈 제거
복사 과정에서 잘게 나뉜 여러 줄을 한 문단으로 합칩니다. 단어가 서로 붙지 않도록 줄바꿈 자리를 공백 한 칸으로 바꾸고 불필요한 연속 공백을 정리합니다.
중복 줄 제거
한 줄에 하나씩 적은 이름, 주소, 키워드 목록에서 같은 줄을 제거합니다. 첫 번째 항목의 위치는 유지되며 대소문자나 공백이 다르면 다른 항목으로 판단합니다.
가나다·ABC 정렬
여러 줄 목록을 가나다와 알파벳 순으로 정렬합니다. 숫자가 포함된 항목은 숫자의 실제 크기를 고려해 정렬하므로 번호가 붙은 목록도 읽기 쉽게 정돈할 수 있습니다.
공백·빈 줄 정리
연속 공백 정리는 여러 칸과 탭을 한 칸으로 줄이고, 빈 줄 제거는 내용 없는 행만 삭제합니다. 원래 문단 구성이 필요하다면 줄바꿈 제거 대신 이 기능을 사용하세요.
구체적인 상황으로 이해하는 활용 예시
다음 세 상황은 도구의 처리 과정과 결과 해석을 설명하기 위한 가상 예시입니다. 입력 조건을 바꾸면 결과도 달라지므로 자신의 조건과 비교해 확인하세요.
1. 짧은 한글 문장의 글자와 바이트 비교
안녕 세상을 입력하면 공백 포함 5개 코드 포인트, 공백 제외 4개입니다. 한글 4글자를 UTF-8로 각각 3바이트, 공백을 1바이트로 계산하면 총 13바이트입니다. 제출 사이트가 글자수와 바이트 중 어떤 제한을 쓰는지 확인해야 같은 문장이 한쪽에서는 허용되고 다른 곳에서는 초과하는 이유를 이해할 수 있습니다.
2. PDF에서 복사한 줄바꿈 제거
첫 줄 오늘은, 둘째 줄 좋은 날이라는 두 줄을 넣고 줄바꿈 제거를 실행하면 오늘은 좋은 날로 합쳐집니다. 줄의 경계는 공백으로 연결되므로 두 단어가 붙는 것을 피할 수 있습니다. 시나 표처럼 줄 자체가 의미를 갖는 자료에는 일괄 적용하지 말고 원문과 정리 결과를 비교하세요.
3. 중복 명단과 정렬을 순서대로 적용
민수, 지수, 민수를 각각 한 줄씩 입력해 중복 줄 제거를 실행하면 3줄이 2개의 서로 다른 이름으로 줄어듭니다. 이어 그 결과를 입력창에 옮겨 정렬하면 가나다순으로 확인할 수 있습니다. 동명이인은 같은 줄로 취급될 수 있으므로 실제 참가자라면 민수A와 민수B처럼 구분 정보를 먼저 붙여야 합니다.