붙여넣기·입력·수정

초안의 구조와 속도를 측정

대화형 작업 공간은 여러 단위를 나란히 보고합니다. 재현 가능한 언어 가정이 필요하면 자동 대신 한국어, 영어, 스페인어, 일본어, 중국어, 타이어를 명시적으로 선택하세요.

단어 카운터를 불러오는 중…

텍스트를 분석하려면 JavaScript를 활성화하세요. 아래의 분할 방법, 구조 정의, 시간 안내는 그대로 제공됩니다.

공백이 아닌 경계

지역 인식 단어 계수의 동작 방식

text.split(/\s+/) 같은 단순한 방식은 공백 사이의 모든 구간을 단어로 취급합니다. 이는 모든 단어 사이에 공백을 두지 않는 문자 체계에서 실패하고, 구두점과 반복 구분자에 우연한 의미를 부여합니다. 이 카운터는 Intl.Segmenter에 단어 세그먼트를 요청해 구현체가 단어 유사로 표시한 세그먼트를 셉니다.

선택한 지역 설정은 명시적인 분할 맥락을 제공합니다. 자동은 브라우저의 지역 협상을 따르고, 명시적 선택은 ko, en, es, ja, zh, th를 요청합니다. 같은 인터페이스가 문장 경계에는 문장 단위를 사용합니다. API의 표준 배경은 ECMA-402 Intl.Segmenter 정의와 Unicode Standard Annex #29를 참고하세요.

이 표준들은 모든 입력에 대해 하나의 영원한 총계를 약속하지 않습니다. 유니코드 데이터, 지역 맞춤, 사전 분할, 구현체 정의 isWordLike 분류는 브라우저 엔진과 버전에 따라 달라질 수 있습니다. 계수가 계약적 출판·과금 업무의 일부라면 지역 설정, 브라우저, 규칙을 기록하세요.

단어
브라우저가 단어 유사로 분류한 지역 인식 세그먼트.
문장
지역 인식 문장 경계 분석이 반환한 비어 있지 않은 세그먼트.
단락
하나 이상의 빈 줄로 구분된 비어 있지 않은 블록.
줄
인식된 유니코드 줄바꿈 문자로 구분된 논리적 줄.
시간
단어 수를 선택한 읽기·말하기 속도로 나눈 값.

네 가지 관련 측정

단어·문장·단락·줄은 서로 다른 질문에 답합니다

지표활용경계 규칙
단어 수편집 분량, 과제, 콘텐츠 기획공백 분할이 아닌 지역 인식 단어 유사 세그먼트.
문장 수속도와 대략적 가독성 검토지역 인식 문장 분할; 마침표만으로 모든 사례가 결정되지 않습니다.
단락 수문서 구조와 훑어읽기최소 하나의 빈 줄로 구분된 비어 있지 않은 텍스트 블록.
줄 수대본, 자막, 원문, 내보내기CRLF는 하나의 줄바꿈; CR, LF, NEL, U+2028, U+2029도 줄을 만듭니다.

빈 입력은 0줄입니다. 텍스트가 존재하면 인식된 모든 줄바꿈이 한 줄을 끝내고 다른 줄을 시작하므로, 끝의 줄바꿈은 의도적으로 마지막 빈 줄을 추가합니다. 이 인터페이스에서 텍스트 영역 HTML 동작은 분석 전에 CRLF와 CR을 LF로 변환합니다. 논리적 줄 총계는 같지만 바이트·코드 유닛 비교는 이 변환을 고려해야 합니다.

투명한 경험칙

조절 가능한 속도로 읽기·말하기 시간 추정

읽기 시간과 말하기 시간은 같은 단어 총계에서 계산되지만 별도의 분당 단어 수 설정을 사용합니다. 산술은 의도적으로 단순합니다. 단어 수를 분당 단어 수로 나눕니다. 속도를 올리면 추정이 짧아지고 내리면 길어집니다.

속도는 문서의 속성이 아닙니다. 밀도 높은 기술 문장, 낯선 이름, 수식, 화면 시연, 청중 질문, 극적 휴식, 언어 학습자의 속도는 모두 실제 시간을 일반적 기본값에서 멀어지게 합니다. 컨트롤로 특정 독자나 발표를 모델링하고 시간이 정해진 발표는 리허설하세요.

다국어 텍스트에서 단어 분할과 전달 속도는 별개의 선택입니다. 일본어나 타이어를 선택하면 경계 요청 방식이 바뀔 뿐, 하나의 보편적 WPM 값으로 모든 언어를 비교할 수 있다는 뜻이 아닙니다.

플랫폼 제한이 필요하신가요?

단어 수는 편집 분량을 추정합니다. 사용자 이름, 메시지, 데이터베이스 필드, API 페이로드는 그래핀, UTF-16 유닛, 코드 포인트, 바이트를 지정하는 경우가 많습니다.

글자 수 세기 열기 →

계약을 재현 가능하게

공식 계수에는 지역 설정과 엔진 버전이 함께해야 하는 이유

  1. 1

    원본 보존

    게시될 정확한 초안을 계수하세요. 이 도구는 유니코드 정규화, 대소문자 통합, 구두점 재작성을 하지 않습니다. 브라우저는 CRLF·CR 줄끝을 LF로 노출합니다.

  2. 2

    지역 설정 기록

    다른 검토자나 빌드 시스템이 가정을 재현해야 한다면 자동 대신 명명된 지역 설정을 사용하세요.

  3. 3

    논쟁적 사례 테스트

    축약형, 하이픈, 약어, 이모지, 공백 없는 문자가 포함된 예시를 선택한 환경의 회귀 사례로 보관하세요.

ECMA-402는 일부 경계 세부사항을 구현체와 그 국제화 데이터에 맡깁니다. 서버 라이브러리, 데스크톱 편집기, 검색 인덱스, 브라우저는 모두 표준을 준수하면서도 경계 사례에서 불일치할 수 있습니다. 외부 제출 포털이 권위라면 그 규칙과 최종 표시 총계가 이 계획 도구보다 우선합니다.

브라우저 문자열은 로컬에 유지

유니코드 정규화 없이 로컬 계수

분석은 현재 브라우저 탭에서 실행됩니다. LiveParse는 입력한 텍스트를 계수 서비스로 보내거나 서버 측 문서 이력을 만들지 않습니다. 알려지지 않은 원격 API에 붙여넣으면 안 되는 초안에 유용하며, 브라우저 확장·클립보드 관리자·기기 백업·스크린샷은 별개의 프라이버시 경계입니다.

이 도구는 텍스트 영역 값에 NFC, NFD, NFKC, NFKD 정규화를 적용하지 않습니다. 미리 합쳐진 악센트 문자와 분해된 문자+기호 시퀀스는 구별되게 유지됩니다. 텍스트 영역 HTML 동작은 분석 전에 CRLF와 CR을 LF로 변환합니다. 코드 포인트·UTF-16·UTF-8 단위는 글자 수 세기로 확인하세요.

JavaScript 문자열은 짝이 없는 UTF-16 서러게이트를 포함할 수 있습니다. 지역 분할은 엔진이 보유한 문자열을 분석할 수 있지만, 엄격한 UTF-8 인코딩은 고립된 코드 유닛을 유니코드 스칼라 값으로 보존할 수 없습니다. 관련 글자 도구는 이런 입력에 UTF-8 바이트를 사용 불가능으로 보고합니다.

층위 배우기

그래핀 클러스터, 코드 포인트, UTF-16 코드 유닛, UTF-8 바이트는 서로 다른 제한·잘라내기 동작을 가진 별개 단위입니다.

유니코드 길이 단위 비교 →

질문과 답

단어 수 세기 FAQ

이 단어 카운터는 무엇을 세나요?

선택한 지역 설정으로 단어 유사 세그먼트와 문장을 세고, 별도로 비어 있지 않은 단락과 논리적 줄을 셉니다. 단어 수와 분당 단어 수 설정으로 읽기·말하기 시간도 추정합니다.

단어 카운터마다 결과가 다른 이유는?

단어 경계는 보편적이지 않습니다. 구두점, 축약형, 하이픈, 이모지, 공백 없는 문자를 카운터마다 다르게 처리할 수 있습니다. 이 도구는 브라우저의 지역 인식 분할 데이터를 사용하므로 선택한 지역과 엔진이 경계 사례에 영향을 줍니다.

중국어·일본어·한국어·타이어 텍스트도 세나요?

네. 중국어, 일본어, 한국어, 타이어를 선택하거나 자동으로 두세요. 지역 인식 분할이 공백 분할보다 적합하지만 브라우저의 유니코드·사전 데이터에 따라 결과가 달라질 수 있습니다.

단락과 줄은 어떻게 세나요?

단락은 하나 이상의 빈 줄로 구분된 비어 있지 않은 블록입니다. 분석 규칙은 CRLF를 하나의 줄바꿈으로 인식하고 CR, LF, NEL, 줄 구분자, 단락 구분자도 인식합니다. 빈 입력은 0줄이고 마지막 줄바꿈은 마지막 빈 줄을 만듭니다.

읽기·말하기 시간은 어떻게 계산되나요?

각 추정치는 단어 수를 선택한 분당 단어 수로 나눕니다. 청중, 언어, 난이도, 휴식, 전달 방식에 따라 실제 시간이 달라지므로 속도는 조절 가능하며 결과는 계획용 추정입니다.

텍스트가 업로드되거나 정규화되나요?

아니요. 계산은 현재 브라우저 탭에서 실행되며 텍스트를 업로드하지 않습니다. 유니코드 정규화 없이 텍스트 영역 값을 분석하므로 정규화 등가 표기가 서로 다른 코드 포인트·바이트 수를 가질 수 있습니다. 텍스트 영역 HTML 동작은 분석 전에 CRLF와 CR을 LF로 변환합니다.