公開ページのキーワード密度を測る方法

ページのアドレスとキーワード(またはフレーズ)を入力します。サーバーがそのページを一度取得し、表示テキストを抽出して、キーワードの出現回数とテキストに占める割合を表示します。

テキストはブラウザでの見え方に合わせて読み取ります。タグ・スクリプト・スタイルを除去し、HTML エンティティをデコードするため、空白を含むフレーズやアクセント付き・非ラテン文字の語も書かれているとおりに数えます。取得に失敗した場合は、ゼロではなく理由を表示します。

  1. ページのアドレスを貼り付けます。example.com/page のようにプロトコルなしのドメインも受け付け、https:// を補います。
  2. 数えるキーワードまたはフレーズを入力します。照合は大文字と小文字を区別しません。
  3. 「密度をチェック」を押すと、サーバーがページを取得し、表に 5 行が表示されます。
  4. 表示テキストの文字数、キーワードの文字数、出現回数、キーワードが占める文字数、そして密度を確認します。
  5. 取得できない場合は理由を表示します。無効なアドレス、プライベート/内部アドレス、タイムアウト、HTTP エラー、読み取れるテキストがないページのいずれかです。

数値が数えているもの、照合の仕組み、結果から分からないこと

数値が数えているもの

テキストの文字数は、タグを除去し、HTML エンティティをデコードし、連続する空白を 1 つにまとめた後の表示文字数です。空白自体は数えないため、コードのインデントやマークアップで数値が膨らむことはありません。script・style・noscript・template・head の内容は除外します。

密度はキーワードがテキストに占める割合で、キーワードの文字数 × 出現回数 ÷ 表示テキストの文字数 × 100 を小数第 1 位で四捨五入した値です。7 文字のキーワードが表示 12,000 文字中に 4 回出現する場合は 0.2% です。

照合の仕組み

照合は大文字と小文字を区別せず、完全一致する文字列の重複しない出現を数えます。「SEO」と「seo」は同じキーワードとして扱い、空白を含むフレーズは 1 行にあっても改行をまたいでも見つかります。部分文字列の照合なので、「start」の中の「art」も数えます。ステミングや同義語、単語境界の処理はなく、中国語・日本語・韓国語のテキストは空白がなくても一致します。

ナビゲーションやフッターを含む表示テキスト全体を検索します。これはクローラーがその URL で読むテキストだからです。数えるのは入力した 1 ページのみで、サイト内の他のページにある同じフレーズは合算しません。

結果から分からないこと

キーワード密度は記述的な統計値であり、ランキング要因ではありません。Google は推奨パーセントを公表しておらず、その値だけでページが最適化される閾値も存在せず、数値が高いことが自動的に有害でもありません。目安の範囲を追うのではなく、自分のページ同士を比較してください。

測るのは取得した 1 つの HTML 応答だけです。画像、alt 属性、動画、PDF、ログイン後の内容、クライアント側 JavaScript が後から描画する内容は含まれません。チェックのたびにサーバーがページを再取得し、チェックは接続ごとに回数制限があり、結果はその時点のページを表します。

最近使ったツール: