外部リンク抽出ツール
ページのソースコードを貼り付けてください。パソコンのほとんどのブラウザでは、Ctrl+U(MacではCmd+Option+U)でソースを表示できます。
HTMLの取得元となるページのアドレスです。そのサイトへのリンクは内部リンクとして数えられ、相対リンクはこのベースURLを基準に解決されます。空欄にすると、すべての絶対リンクが一覧表示されます。
先にページのHTMLソースを貼り付けてください。
このHTMLは2,000,000文字を超えています。ページの一部に絞って貼り付けてください。
https://example.com/page のような完全なアドレスを入力するか、空欄のままにしてください。
ブラウザの設定により、次のステップで使うHTMLをこのページに保持できませんでした。このページのサイトデータを許可するか、貼り付ける範囲を減らしてから、もう一度お試しください。
このHTMLを読み取れませんでした。ページのソースをもう一度貼り付けて、再度お試しください。
生のHTMLを貼り付けると、そこに含まれるすべての外部リンクが重複なしのすっきりしたリストで取得できます。必要に応じてベースURLを入力すると、抽出ツールはどのホストを内部とみなすかを把握でき、それ以外のホストへのリンクが報告されます。リンク漏れや古いパートナーリンクの確認、外部リンクがポリシーの想定どおりの宛先に張られているかの確認に役立ちます。
外部リンクを抽出する方法
-
1
ソースを提供
ページの生のHTMLを貼り付けます。必要に応じてベースURLを追加すると、どのホストが内部かを抽出ツールが判別できます。空欄の場合はすべてのホストが外部として扱われます。
-
2
抽出を実行
サブドメインを内部として扱うかどうか、nofollow、sponsored、ugcのリンクを含めるかどうかを選びます。続いて、すべての`<a href>`と`<area href>`が読み取られ、相対リンクはベースURLを基準に解決され、別のホストへのhttp/httpsリンクだけが残されます。重複したリンクは1つにまとめられ、出現回数が数えられます。
-
3
リストを確認
外部URLが表にまとめられ、各URLのアンカーテキスト、rel値(nofollow、sponsored、ugc)、出現回数を確認できます。内部リンクの数も表示されます。
-
4
結果を活用
すべてのURLをクリップボードにコピーするか、表をCSVファイルとしてダウンロードしてスプレッドシートで使うか、任意の宛先を新しいタブで開きます。
抽出ツールが外部とみなすもの
リンクは、そのホストが指定したベースURLのホストと異なる場合に外部とみなされます。比較では大文字と小文字の違いや先頭のwww.は無視されるため、example.comとwww.example.comは同じサイトとして扱われます。サブドメインは初期設定では別ホストとして扱われるため、blog.example.comはwww.example.comにとって外部です。ホストのすべてのサブドメインを内部として扱うには、サブドメインのオプションで「はい」を選んでください。ベースURLを空欄にすると、すべてのhttp/httpsリンクが外部として一覧表示されます。
表には宛先ごとに、アンカーテキスト(画像リンクと<area>のマップ領域では代替テキスト)、そのリンクで見つかったrel値(nofollow、sponsored、ugcは強調表示)、出現回数が表示されます。CSVダウンロードには、同じ列に加えてドメインも含まれます。
無視される対象
mailto:、tel:、javascript:、およびフラグメントのみの#のhref。- ベースURLが空欄の場合の相対URL。ベースURLがないとリンク先を判断できないため、数を数えるだけです。ベースURLを指定すると相対URLは解決され、内部リンクとして数えられます。
//cdn.example.comのようなプロトコル相対URLは常にホストを含むため、チェックの対象になります(ベースURLがない場合はhttpsとして扱われます)。 hrefのないアンカータグ(これらはナビゲーション可能なリンクではありません)。
ヒント
- ページがJavaScriptを使用する場合はレンダリング後のHTMLを貼り付けます。 フレームワークがクライアント側で生成するリンクは、レンダリングされたDOMを貼り付けたときだけ現れます(例:DevToolsからouterHTMLをコピー)。
- トラッキング用ラッパーに注意します。
/go/や/out/を経由するアフィリエイトリダイレクトは実際の宛先を隠すことがあります。抽出ツールはラッパーのURLをそのまま返すため、宛先が不自然な場合は生のhrefを確認してください。 - 比較前に正規化します。 フラグメントやトラッキングパラメータが異なるURLは別リンクとして数えられるため、抽出結果を2回比較する前にURLを正規化してください。
- 時間を置いて比較します。 毎月抽出ツールを実行してリストを差分比較します。自分で追加していない新しい外部リンクは、テーマやプラグインが侵害された最初の兆候です。
よくある質問
HTMLに書かれている通りのhrefを抽出します。すべてのリダイレクトを追跡するとレポートの生成が大幅に遅くなり、宛先のボット保護が作動する可能性もあります。最終的なランディングURLが必要な場合は、別途解決してください。
いいえ。抽出ツールは渡されたHTMLをそのまま解析します。フレームワークがクライアント側でレンダリングするリンクは、レンダリング済みのDOMを貼り付けた場合にのみ表示されます(例:DevToolsからouterHTMLをコピー)。
一覧に表示されるのは、別のホストへのhttp/httpsリンクだけです。相対パスは内部リンクとして扱われ(ベースURLがない場合は数を数えるだけです)、mailto:、tel:、javascript:のリンクはスキップされます。また、サブドメインのオプションで「はい」を選ぶとサブドメインは内部として扱われ、nofollow、sponsored、ugcのリンクに関するオプションで「いいえ」を選ぶとそれらのリンクは除外されます。
貼り付けたHTMLとベースURLはお使いのブラウザ内に留まり、当社のサーバーに送信されることも、ページのURLに追加されることもありません。リンクはこのページ上で抽出され、ステップ間ではHTMLがこのタブの一時ストレージに保持されます。保持されるのは、やり直すかタブを閉じるまでです。
関連ツール
Page Speed Insights
任意の URL を入力すると、Google PageSpeed Insights・GTmetrix・WebPageTest で無料の速度監査を開き、Core Web Vitals と Lighthouse スコアを確認できます。
バックリンクアンカーテキスト分析ツール
バックリンク、CSV行、URL | アンカーのペア、またはアンカーテキスト行を貼り付け、重複を数えて Anchor Text,Count,Share のCSVを出力します。
短縮リンクデコーダー
bit.ly、t.co、tinyurlなどの短縮リンクを展開します。クリック前に、各リダイレクトのホップ、ステータスコード、最終的な行き先を確認できます。
Open Graph チェッカー
ページの HTML を貼り付けるだけで、どの Open Graph タグと Twitter Card タグがあり、どの必須タグが欠けているか、そして各タグの正確な値を瞬時に確認できます。
SERPプレビュー
公開前にGoogleの検索結果をプレビューします。リアルタイムの文字数カウンターが長すぎるタイトルやメタディスクリプションを警告し、Google風のスニペットで結果の見え方を確認できます。
メタタグジェネレーター
タイトル、説明、canonical、Open Graph、Twitterカード、アイコン、PWA、JSON-LD構造化データを含む完全なメタタグ一式を生成します。
このツールは他の言語でも利用できます
- Extractor de enlaces externos [ES]
- Trình trích liên kết bên ngoài [VI]
- 외부 링크 추출기 [KO]
- Ekstraktor Tautan Eksternal [ID]
- Ekstraktor linków zewnętrznych [PL]
- Extracteur de liens externes [FR]
- Extrator de Links Externos [PT]
- Extraktor für externe Links [DE]
- مُستخرج الروابط الخارجية [AR]
- Extractor voor externe links [NL]
- Extraherare för externa länkar [SV]
- เครื่องดึงลิงก์ภายนอก [TH]
- External Links Extractor [EN]
- Estrattore di Link Esterni [IT]
- Инструмент для извлечения внешних ссылок [RU]
- Dış Bağlantı Çıkarıcı [TR]
- 外部链接提取器 [ZH]