テキスト統計

次へ

このツールは貼り付けたテキストの構造をすばやく点検します。空白ありとなしの文字数、単語数、文の数、段落数、音節数、1文あたりの平均単語数を表示します。文字数と段落数は日本語でも正確ですが、単語・文・音節の判定は空白で語を区切る言語向けに設計されている点にご注意ください。文字数上限の確認、長すぎる文の発見、課題要件のチェックに役立ちます。

テキストを分析する手順

  1. 1

    テキストを貼り付ける

    ツイートから1万語の下書きまで、何でも入力できます。分析はテキスト全体に対して実行されます。

  2. 2

    「分析」をクリック

    ツールはUnicode対応の正規表現で単語を区切りますが、区切りに空白を使うため、日本語のように空白で語を分けない言語では連続した文字列がまとめて1単語として数えられます。文字数と段落数は日本語でも正確です。

  3. 3

    結果を読む

    7行が表示されます。文字数の合計、単語数、文の数、段落数、音節数、平均文長です。

  4. 4

    繰り返す

    テキストを編集して再実行すると、推敲や加筆に伴う変化を確認できます。

各指標が示すもの

指標 なぜ重要か
空白ありの文字数 ツイート、SMS、メタディスクリプションの上限
空白なしの文字数 文字単位課金の多くが用いる基準
単語数 分量と要件、テンポと読者(空白区切りの言語向け)
文の数 密度。少なすぎ = 冗長、多すぎ = ぶつ切り(。は未対応)
段落数 構成。ウェブ文章は3〜5文ごとに区切ると読みやすい
音節数 Flesch-Kincaid などの読みやすさ指標の入力(英語向け)
1文あたりの平均単語数 14〜20語なら自然に読める。25語超で読者が疲れ始める

カウンターが使うルール

  • 単語: [\p{L}\p{N}']+ で照合するため、don't、20th、café はそれぞれ1単語として数えます。空白がない日本語では語ごとに分割されず、連続した文字列が1単語になります。
  • 文: .、!、? の連続を1つの区切りとして数えます。U.S.A. のような略語では多く数え、中国語・日本語で使う全角の 。、!、? は認識しないため、これらの言語は1文として記録されます。
  • 段落: 空行(連続する2つの改行)で区切ります。
  • 音節: 末尾の e を除いて母音のまとまりを数える軽量な推定です。英語では手作業の集計と約5%以内で一致しますが、日本語には当てはまりません。

ヒント

  • ウェブ文章では、1文あたりの平均語数を20語未満に抑えることを目指しましょう(空白区切りの言語向け)。
  • 英語では、音節数を単語数で割った値が1.8を超える場合、多音節語を短い同義語に置き換えることを検討してください。
  • 長い文章で段落数が1の場合、ほぼ確実にEnterキーの押し忘れです。

よくある質問

文字数と段落数は日本語でも正確に数えられ、文字数は日本語で最も役立つ指標です。一方、単語数・文の数・音節数は空白で語を区切る言語向けに設計されています。日本語は空白がなく文末に「。」を使うため、単語数は実態とずれ、文の数はほぼ1になり、音節数は意味を持ちません。

ピリオド付きの略語(Dr.、e.g.、U.S.A.)が数を膨らませます。気になる場合は分析前に削除または置換してください。

文の長さは読みやすさ指標の入力の1つですが、すべてではありません。たとえば Flesch-Kincaid は単語あたりの音節数も重み付けします。

厳密な上限はありませんが、非常に長い文書(約200KB超)は処理に少し時間がかかることがあります。

入力したテキストは集計のため当社のサーバーに送信され、第三者と共有されることはありません。統計を返すためだけに処理されます。

関連ツール

このツールは他の言語でも利用できます