取得したページテキスト内でキーワードの出現回数を数え、文字数ベースでテキストに占める割合を計算します。
ページのアドレスとキーワード(またはフレーズ)を入力します。サーバーがそのページを一度取得し、表示テキストを抽出して、キーワードの出現回数とテキストに占める割合を表示します。
テキストはブラウザでの見え方に合わせて読み取ります。タグ・スクリプト・スタイルを除去し、HTML エンティティをデコードするため、空白を含むフレーズやアクセント付き・非ラテン文字の語も書かれているとおりに数えます。取得に失敗した場合は、ゼロではなく理由を表示します。
テキストの文字数は、タグを除去し、HTML エンティティをデコードし、連続する空白を 1 つにまとめた後の表示文字数です。空白自体は数えないため、コードのインデントやマークアップで数値が膨らむことはありません。script・style・noscript・template・head の内容は除外します。
密度はキーワードがテキストに占める割合で、キーワードの文字数 × 出現回数 ÷ 表示テキストの文字数 × 100 を小数第 1 位で四捨五入した値です。7 文字のキーワードが表示 12,000 文字中に 4 回出現する場合は 0.2% です。
照合は大文字と小文字を区別せず、完全一致する文字列の重複しない出現を数えます。「SEO」と「seo」は同じキーワードとして扱い、空白を含むフレーズは 1 行にあっても改行をまたいでも見つかります。部分文字列の照合なので、「start」の中の「art」も数えます。ステミングや同義語、単語境界の処理はなく、中国語・日本語・韓国語のテキストは空白がなくても一致します。
ナビゲーションやフッターを含む表示テキスト全体を検索します。これはクローラーがその URL で読むテキストだからです。数えるのは入力した 1 ページのみで、サイト内の他のページにある同じフレーズは合算しません。
キーワード密度は記述的な統計値であり、ランキング要因ではありません。Google は推奨パーセントを公表しておらず、その値だけでページが最適化される閾値も存在せず、数値が高いことが自動的に有害でもありません。目安の範囲を追うのではなく、自分のページ同士を比較してください。
測るのは取得した 1 つの HTML 応答だけです。画像、alt 属性、動画、PDF、ログイン後の内容、クライアント側 JavaScript が後から描画する内容は含まれません。チェックのたびにサーバーがページを再取得し、チェックは接続ごとに回数制限があり、結果はその時点のページを表します。