Website Explorer

サイトを巡回して階層構造をツリーで可視化。ページのタイトル・サイズ・更新日時・発リンク/被リンクを丸ごと確認できます。

  1. 調べたいサイトのトップページなどの URL を入力します。
  2. 「探査開始」を押すと、同一ドメイン内のページを自動でたどり、サイト構造をツリーに組み立てます。
  3. ツリーのページを選ぶと、右側にそのページの詳細(タイトル・サイズ・更新日時・発リンク/被リンク)が表示されます。
  4. 「リンクエラー」「外部リンク」「リソース」「更新状況」タブで一覧確認、サイトマップ(XML/テキスト)や CSV も出力できます。
このツールは ご自身が管理するサイトの調査 を目的としています。 大規模サイトはページ数が膨大になるため、「詳細設定」の上限値を適切に調整してください。
相手サイトの robots.txt に従います。 巡回が禁止されているURLは取りに行かず、その旨を結果に表示します(2026-09-23〜)。

探査履歴

保存された履歴はありません。探査を実行すると、この端末内に自動保存されます(最新 30 件・サーバーには送信されません)。

探査完了
巡回 0 発見 0 確認済 0 正常 0 転送 0 リンク切れ 0 エラー 0

ページがまだありません。

ページ詳細

Website Explorer(サイト構造ビューワー)とは

入力したURLを起点に同じドメイン内のページを自動でたどり、サイト全体の構造をエクスプローラ形式のツリーに組み立てるツールです。 ページごとにタイトル・サイズ・更新日時・発リンク/被リンクが分かり、リンク切れ・外部リンク・使用しているリソースの一覧も同時に集まります。 サイトの引き継ぎやリニューアル前の棚卸し、公開したまま忘れていたページ探しに使えます。インストールは不要です。

使い方(4ステップ)

  1. URLを入れる。調べたいサイトのトップページなどのURLを入力します。
  2. 「探査開始」を押す。同じドメイン内のページを自動でたどり、ツリーに組み立てます。上限は「詳細設定」で変えられます。
  3. ツリーから選ぶ。ページを選ぶと、右側にそのページの詳細(タイトル・サイズ・更新日時・発リンク/被リンク)が出ます。
  4. 一覧と書き出し。「リンクエラー」「外部リンク」「リソース」「更新状況」の各タブで確認し、サイトマップ(XML・テキスト)や CSV に書き出せます。

巡回のきまり

ページを取りに行く前に、相手サイトの robots.txt を必ず読みます。 自分の名前(MachToolsWebsiteExplorer)または * のグループで禁止されているURLは取得せず、その旨を表示します。 いちばん長く当てはまった規則を採用し、同じ長さなら許可を優先します(RFC 9309)。robots.txt が読めなかったときは、安全側に倒して巡回を止めます。 名乗る User-Agent は MachToolsWebsiteExplorer/1.0 (+https://www.mach-tools.net/dev/webex/) です。

よくある質問 (FAQ)

巡回しません。ページを取りに行く前に相手サイトの robots.txt を読み、自分の名前(MachToolsWebsiteExplorer)または * の規則で禁止されていれば取得を中止し、その旨を表示します。robots.txt が読めなかったときも、安全側に倒して巡回を止めます。

このツールはご自身が管理するサイトの調査を目的としています。robots.txt は守りますが、巡回は相手のサーバーに負荷をかける行為です。自分の管理下にないサイトを調べるときは、上限を小さくし、相手の利用規約も確認してください。

保存しません。ページの取得は当サイトのサーバーを経由しますが、結果はその場でお使いのブラウザへ返すだけで、内容を保存も収集もしていません。探査履歴はお使いのブラウザの中だけに残ります。

「詳細設定」で上限を決められます。既定は最大300ページ・発見リンク3000件までです。大規模なサイトほど時間と相手の負荷が増えるので、まず小さい上限で試してください。

XML(sitemap.xml の形)とテキスト(URLを1行ずつ)の2種類を書き出せます。あわせて、巡回したページの一覧を CSV でも保存できます。

見つかったURLに実際にアクセスし、返ってきたHTTPステータスで分けています。200番台を正常、300番台を転送、400・500番台をリンク切れとして一覧にします。接続できなかったものはエラーとして分けます。