PageRankとSEO

PageRankはGoogleのオリジナルのリンク解析アルゴリズムです。その概要、ランダムサーファーモデルと公式、Reasonable Surferアップデート、ツールバーから2024年のAPIリークまでの歴史、今もコアランキングシステムである理由、そしてあなたのリンクと内部構造にとっての意味について説明します。

初回公開:2026年6月27日 · 最終更新:2026年8月13日 · Advanced
言語

PageRankは、Larry PageとSergey Brinがスタンフォード大学で発表した再帰的なリンクグラフモデルです。ページのスコアは、そのページにリンクしているページのスコアに依存し、公開されたモデルでは、各ページはアウトバウンドリンク全体にスコアを分配します(「リンクは投票である」というのは、これを簡略化した言い方です)。公開されていたツールバースコアは2016年に廃止されましたが、Googleのランキングシステムガイドには、PageRankが今もコアランキングシステムの1つとしてリストされており、オリジナルから進化しています。2024年のAPIリークに関するリークベースの報道では、少なくとも7つの内部のPageRank関連フィールドが説明されていましたが、Googleはそれぞれの機能を確認していません。実務者(この著者を含む)は、クロール予算や正規化にも関与していると考えていますが、Googleはそれを直接文書化していません。Reasonable Surfer特許は、すべてのリンクが同等に重み付けされるわけではないモデルを説明していますが、これは特許であり、確認された現在の本番環境での重み付けではありません。nofollowスカルプティングは2009年以降廃止されており、Googleは30xリダイレクトがPageRankを失うことはなくなったと述べています。もはや公開スコアはありません。AhrefsのURL Ratingのようなサードパーティの指標はプロキシであり、PageRankそのものではありません。

TL;DR — PageRankは再帰的なグラフモデルです。ページのスコアは、「ランダムサーファー」がリンクをたどってそのページに到達する確率であり、そのスコアはリンク元のページのスコアに依存します。発表されたモデルでは、各ページはそのPageRankを外部リンクに分割し、計算は収束するまで反復的に実行されます。元の1998年のアルゴリズムは2006年頃に内部的に置き換えられ、Reasonable Surfer特許は、すべてのリンクが同じ価値を渡すわけではないモデルを説明しています(これは特許の主張であり、確認された現在の重み付けではありません)。公開ツールバースコアは2016年に廃止されました。Googleは今でもPageRankを中核となるランキングシステムとして挙げています。Googleの2024年のAPIリークに関するリークベースのレポートでは、少なくとも7つの内部のPageRank関連フィールドが説明されており、実務者(この著者を含む)は、PageRankがクロール予算や正規化にも影響を与えると考えていますが、Googleはその直接的な関連性を文書化していません。Nofollowスカルプティングは2009年以降廃止されており、Googleは30xリダイレクトがPageRankを失わなくなったと述べています。

PageRankが実際に何であるか

PageRankは数学的なリンク解析モデルであり、公開されているツールバーのスコアや現代のランキングの完全な説明ではありません。 Evidence for this claim Official or primary documentation supporting the adjacent article claim, with scope limited to the source's published description. Scope: No ranking guarantee or undisclosed system mechanics are inferred beyond the cited source. Confidence: high · Verified: Stanford: PageRank paper Googleの現在のドキュメントでは、実際の重みやページごとの値を開示せずに、継続的な使用が確認されています。 Evidence for this claim Official or primary documentation supporting the adjacent article claim, with scope limited to the source's published description. Scope: No ranking guarantee or undisclosed system mechanics are inferred beyond the cited source. Confidence: high · Verified: Google: Ranking systems guide

PageRankは、1996年から1998年にかけてスタンフォード大学でLarry PageとSergey Brinが開発したリンク解析アルゴリズムです。この名前には二重の意味があります——Larry Pageにちなんで名付けられ、かつウェブページをランク付けするからです。ウェブをグラフとして扱い、インバウンドリンクを投票とみなし、各ページにランダムサーファー——ランダムにリンクをクリックし、時折ランダムなページにジャンプする人——がそのページにたどり着く確率を表すスコアを割り当てます。

以下は、1999年のスタンフォード大学の論文に基づく公開された歴史的モデルです。Googleがその後進化したことを確認しているモデルです(下記の「Googleは今もPageRankを使っていますか?」を参照)。そのため、数式と計算例は、元の公開アルゴリズムがどのように機能したかを示すものであり、Googleの現在の内部計算をリアルタイムで説明するものではありません。

元の論文の数式:

PR(A) = (1-d)/N + d * (PR(B)/L(B) + PR(C)/L(C) + PR(D)/L(D) + …)
  • d減衰係数、通常は0,85:サーファーがランダムなページにジャンプするのではなく、クリックを続ける確率。
  • N — ページの総数。
  • L(x) — ページx上のアウトバウンドリンクの数。
  • PR(x) — ページxのPageRank。

この数式からいくつかのことが導き出されます。あなたのPageRankは、あなたにリンクしているページのPageRankに依存します——これが再帰的であり、数値が収束するまで反復的に計算する必要がある理由です。各リンク元ページは、そのPageRankをすべてのアウトバウンドリンクに分割するため、アウトバウンドリンクが増えるごとに、各リンクが渡すシェアが希薄化します。また、減衰係数——0,85——は、各ステップでサーファーがチェーンを放棄して最初からやり直す15%の確率をモデル化しており、これが数学を「ランクシンク」(アウトバウンドリンクのないページ)に崩壊させないようにしています。

簡略化した計算例(あくまで説明用——仕組みを示すためのおもちゃのグラフであり、実際のサイトやGoogleの計算ではありません):ページB、C、DがそれぞれページAにのみリンクし、B、C、DのそれぞれがPageRank 1でアウトバウンドリンクを1つ持っているとします(つまり、それぞれが自分のスコア全体をAに渡します)。N = 4d = 0.85の場合:

PR(A) = (1 - 0.85)/4 + 0.85 * (1/1 + 1/1 + 1/1) = 0.0375 + 2.55 = 2.5875

この1回のパスで仕組みがわかります——各リンク元ページのスコアをアウトバウンドリンク数で割ったものがAのスコアに加算されます——しかし、実際の計算では、スコアが変化しなくなるまで、これをウェブ上のすべてのページで反復します。これが下記の「収束」の意味です。

ほとんど誰も言及しない、そして私がThe Evolution Of Google PageRankで詳しく調べたニュアンスが1つあります:元の論文に掲載された数式には数学的な誤りが含まれています。先頭の定数は(1-d)と書かれていますが、確率の合計が実際に1になるためには(1-d)/N——ページの総数で割る——であるべきです。小さなことですが、基礎となる論文でさえバグが存在することを思い出させる面白い例です。

すべてのリンクが平等ではない——Reasonable Surfer

元のモデルは、すべてのリンクを等しい確率でクリックするランダムなサーファーを想定していました。Reasonable Surfer特許(2004年に出願、2010年に取得、2016年に更新)は、異なるアプローチを説明しています:一部のリンクを他のリンクよりもクリックする可能性が高いサーファーであり、そのためそれらのリンクはより多くのPageRankを渡すことになります。特許は、Googleが使用できる方法として主張したものを説明しています——これは、今日の本番環境で実行されている正確な重みやロジックの証明ではなく、Googleは「カウント」されるものの現在の項目別リストを公開していません。以下の機能は、特許が説明した可能性として扱い、検証された本番の重みとしては扱わないでください:

  • リンクの位置 — メインコンテンツはサイドバーやフッターよりも優れています。
  • アンカーテキスト — より長く、より情報量が多く、より関連性の高いアンカー。
  • 視覚的な目立ちやすさ — フォントサイズ、スタイル、フォールドの上か下か。
  • リンク先 — ソースと宛先の間のトピックの整合性。
  • 実際のクリックデータ — ユーザーが実際にそのリンクをクリックする頻度。

特許に記載されている内容に基づく実用的な要点:高権威ページの本文にあるリンクは、同じリンクをそのページのフッターに詰め込むよりも、妥当に価値が高い可能性があります。実際の人物が実際にクリックするような、編集上のコンテンツ内リンクを追求することは、現在の重みが確認されていない場合でも、合理的な保険となります。

簡単な歴史

  • 1996–1998 — スタンフォード大学で開発。(正確性のために言及:後にBaiduの創業者となるRobin Liは、1996年に類似のリンクランキングのアイデアであるRankDexの特許を取得しました。)
  • 1998 — 特許出願(1998年1月9日);論文が続きます。
  • ~2000 — Googleツールバーが一般向けの0〜10のスコア(対数スケール)を公開。
  • ~2006 — 元のアルゴリズムは、より高速でリソース消費の少ないバージョンに内部的に置き換えられます。
  • 2009 — Googleがnofollowの仕組みを変更し、PageRankスカルプティングを廃止(「神話」を参照)。
  • 2013 — ツールバーのPageRankの最後の一般公開アップデート(12月)。
  • 2016 — ツールバーのPageRankが完全に削除されました。Gary Illyesも30xリダイレクトがPageRankを失わなくなったことを確認。
  • 2017 — Illyesが今も使用されていることを確認:「18年経った今もPageRankを使っています。」
  • 2019 — 元の特許が失効(2019年9月24日)。
  • 2024Google APIリークにより、少なくとも7つのPageRankバリアントが明らかになったと報じられました。更新されたSEOスターターガイドは、PageRankがまだアクティブであることを確認。

Googleは今もPageRankを使用していますか? はい。

これは、多くの人が実際に抱く疑問であり、根拠は明白です。Googleの ランキングシステムガイド では、PageRankを “one of our core ranking systems used when Google first launched” (翻訳) 「Googleがサービスを開始した当初に使われていた中核的なランキングシステムの1つ」 と説明し、さらに “it continues to be part of our core ranking systems.” (翻訳) 「現在も中核的なランキングシステムの一部であり続けている」と述べています。2016年にツールバーのスコアが削除されたことで消えたのは表示であり、アルゴリズムではありません。

2024年5月、匿名の情報源が何千もの内部のGoogle検索APIドキュメントファイルをリークしました。SparkToroは元のレポートを公開し、Search Engine Landはさらなる分析で続きました。Googleはリークされたフィールド名を確認も説明もしていません。以下は、それらのフィールドが何である可能性が高いかについての業界の解釈であり、Googleが公開した仕様ではありません:

フィールド推定される意味(リーク分析によるもので、Googleが確認したものではありません)
rawPagerankリンクグラフからの未処理の基本値
pageRank2更新/修正されたバージョン
pageRank_NS「最近傍シード」— 信頼できるシードサイトからの距離。ドキュメント理解に関連。非推奨と報告されています
firstCoveragePageRankGoogleがページを最初に発見したときのPageRank
ToolBarPageRank古い公開ツールバースコア — 保存されており、更新されていません

同じリーク情報には、リンク品質ティアシステム(低/中/高)についての記述があり、これによってPageRankやアンカーのシグナルがリンクを通じて流れるかどうかが決まるとされています。また、クリックデータ(NavBoost)がリンクがどのティアに入るかに影響するとされています。ただし、これもリークに基づく報告であり、Googleが直接文書化したものではありません。もし正確であれば、低ティアのリンクは何も渡さない可能性があります。正規化の観点からの私の見解については、私の正規化ガイドをご覧ください。この記事は実務者による分析であり、Googleの仕様書ではありません。

ランキング以外の役割 — PageRankの他の仕事(実務者分析)

PageRankはおそらくランキングの入力要素だけではないでしょう。しかし、何が確認されていて何が確認されていないかを正確にしたいと思います。Google自身の文書では、PageRankがクロール予算や正規化の入力要素として明示されているわけではありません。以下は実務者による分析です。私のGoogle PageRankの進化に基づくもので、Googleのクロール需要と正規化の文書、およびページの重要性に関する一般的な記述から推測したものであり、Googleによる直接の確認ではありません。

  • クロール予算の要素である可能性が高い。 Googleのクロール需要に関する文書では、クロール頻度がインデックス内でのページの重要度・人気度に結び付けられていますが、PageRankを具体的に挙げているわけではありません。一般的な実務者の解釈では、重要なページ(PageRankが高いページ)ほど頻繁にクロールされるということです。これは、このクラスター内の他の場所にあるクロール予算クロール頻度に関連します。
  • 正規化のシグナルとして妥当。 Googleが重複ページのクラスターから正規ページを選ぶ際、公には完全に列挙されていない約40のシグナルを考慮します。リンクの権威はその入力の1つであると理解されており、実務者の推測では、PageRankが高いページほど正規ページとして選ばれる可能性が高いということです。この推測はGoogleによって独立に確認されているわけではありません。

「リンクはもう重要ではない」— そのニュアンス

2023年、Gary Illyesはリンクが彼のトップ3には入っていないと述べ、「しばらく前からそうだ」と語りました。SERPconf 2024ではさらに踏み込み、「ページをランク付けするのに必要なリンクはごくわずかだ」と述べ、その後、私が会場で聞いたところ、すぐに発言を撤回しました(「あれは絶対に言うべきではなかった」)。John Muellerも同様に、リンクの重みは時間とともに低下すると述べ、リンク数に過度に焦点を当てるべきではないと述べています。

正直な解釈:確立されたサイトにとって、リンクは以前ほど重要ではありませんが、それでも基盤となるものです。権威の確立、クロールの優先順位、正規化のために重要です。「決定力が弱まった」ことは「無関係になった」ことではありません。

あなたのSEOにとっての意味

  • 本当に権威のある、トピックに関連するページからリンクを得る。 再帰的な計算により、強力で関連性の高いページからの1つのリンクは、弱いページからの多数のリンクに勝ります。
  • 編集上の、コンテンツ内のリンクを追求する。 Reasonable Surferのロジック:実際のユーザーがクリックするであろうリンクを、フッターではなく本文で追求します。
  • 内部リンクをPageRankの配管として扱う。 サイトの構造が、マネーページへのPageRankの流れを決定します。重要なページにはリンクを多く張り、浅い階層に保ちます。
  • nofollowでスカルプティングしない。 2009年から機能していません。nofollowされたPageRankは再分配されずに消えます。
  • 30xリダイレクトを恐れない。 2016年以降、PageRankの損失はありません。
  • リンクスキームを避ける。 低品質のリンクは「低」ティアに分類され、シグナルを一切渡さない可能性があります。せいぜい無駄な努力です。

位置づけ

PageRank は、クロールとリンクがそもそも重要である理由であり、そのためクロールのサブクラスターに位置しています。発見と取得の側面については、クロールクロール予算クロール頻度を参照してください。Google がどの URL を保持するかを形作る仕組みについては、正規化を参照してください。より広い全体像については、検索の仕組み を参照してください。

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.