文字数カウンター
入力と同時に集計。日本語の「1文字」は数え方で結果が変わるため、複数の基準を並べて表示します。
0文字数(書記素)
0コードポイント数
0行数
0語数
0UTF-8 バイト
0全角英数
0半角英数
0全角かな
0半角スペース
0CRLF改行
X(Twitter)判定
—
X は英数字を 1、それ以外(日本語・絵文字)を 2 と重み付けして 280 と比較します。単なる文字数では判定できません。
「文字数」がズレる理由
同じ 👨👩👧 を例にすると、実際には複数のコードポイントが結合して1文字に見えています。
- 書記素 — 人間が「1文字」と知覚する単位。日本語の原稿チェックはこれを使うのが正解
- コードポイント — Unicode の1文字。結合絵文字は複数になる
- UTF-16 / バイト数 — プログラムやファイルサイズの単位。日本語は1文字3バイト
「サロゲートペア余剰」が 0 より大きければ、絵文字や追加漢字が含まれています。