文字数・単語数カウント
入力しながら文字数、単語数、行数、段落数、バイト数を数え、各文字の出現頻度も確認できます。すべてブラウザ内で動作します。
すべてブラウザ内で動作します。アップロード、記録、保存は一切行いません。
すべての文字のカウント
上に入力または貼り付けると、含まれるすべての文字がここに一覧表示されます。
| 文字 | コードポイント | 回数 | 割合 |
|---|
入力に合わせてカウントが更新されます。入力欄の文字数制限には文字数、語数の指定には単語数、データベースの列にはバイト数を。何もどこにも送信されないので、未公開の下書きは未公開のままです。
仕組み
文字はUnicodeのコードポイントとして数えるので、アクセント付きの文字も1文字です。バイトはUTF-8でエンコードした後に数えます。VARCHARの上限やHTTPペイロードが実際に測っているのはこちらです。「é」は1文字で2バイト、「あ」は1文字で3バイトです。
単語とは、スペースを含まない文字の連なりです。「well-known」は1語、「don't」も1語と数えます。日本語と中国語には区切りとなるスペースがないため、これらの文字で書かれたテキストは、ブラウザが使うUnicodeの辞書ベースの分かち書きによって単語に分割されます。行数は改行の数に1を足したもの、段落は空行で区切られたまとまりです。
読了時間は、単語数を1分あたり200語で割ったものです。一般的な散文を黙読するときのよくある平均値であり、あなたのテキストを測定したものではありません。また、1分あたりの語数という速さが当てはまらない日本語と中国語では表示されません。
頻度表は、句読点やスペースを含むすべての文字を数えるので、合計は総文字数と一致します。大文字と小文字は、まとめるよう指定しない限り別々に数えます。まとめた場合は小文字の形で表示します。表示するものがない文字(ノーブレークスペース、ゼロ幅接合子、紛れ込んだ制御文字など)はその名前で表示され、各行にはコードポイントが付きます。
例
| ケース | 入力 | 結果 |
|---|---|---|
| いろは歌(すべてのかなを一度ずつ使う歌) | いろはにほへと ちりぬるを わかよたれそ つねならむ うゐのおくやま けふこえて あさきゆめみし ゑひもせす | 54文字、34語 |
よくある質問
ワープロソフトとカウントが合わないのはなぜですか?
定義が異なるからです。ハイフンでつないだ複合語を2語と数えるもの、数字を無視するもの、改行を単語の区切りとみなすものとそうでないものがあります。ここで使っている規則は上に書いてあるので、自分がどの数字を見ているのかがわかります。
メタディスクリプションではどのカウントが重要ですか?
文字数です。ただし検索エンジンは固定の文字数ではなく表示幅で切り詰めるので、155文字は規則ではなく目安と考えてください。
テキストで最も多い文字がスペースなのはなぜですか?
たいていそうなるからです。一般的な散文では5〜6文字に1つほどスペースが入るので、ほとんどのテキストで大差をつけて1位になります。表は面白いものではなく実際にあるものを数えます。入力するつもりのなかった文字が見えてくるのも、そのおかげです。
テキスト中の見えない文字を見つけるにはどうすればよいですか?
頻度表でその名前を探してください。ワープロからコピーしたノーブレークスペース、ウェブページから紛れ込んだゼロ幅スペース、ファイル先頭のバイトオーダーマーク。それぞれに行と名前とコードポイントがあります。見た目が同じ2つの文字列が一致しない理由を突き止めるには、たいていこれが最も早い方法です。
一部の絵文字が2文字以上と数えられるのはなぜですか?
多くの絵文字は1つのコードポイントですが、国旗や家族の絵文字は複数のコードポイントを結合したものです。ここではコードポイントを数えるので、それらは2文字以上と表示されます。
知っておきたいこと
- すべてこのページ内で数えます。入力した内容は送信、記録、保存されません。
- 他者が課す上限は、文字以外のものを数えている場合があります。データベースのカラムならバイト数、一部のAPIならUTF-16単位です。両方の数値を表示しているので、自分に当てはまるほうを確認できます。