Website Explorer(サイト構造ビューワー)とは
入力したURLを起点に同じドメイン内のページを自動でたどり、サイト全体の構造をエクスプローラ形式のツリーに組み立てるツールです。 ページごとにタイトル・サイズ・更新日時・発リンク/被リンクが分かり、リンク切れ・外部リンク・使用しているリソースの一覧も同時に集まります。 サイトの引き継ぎやリニューアル前の棚卸し、公開したまま忘れていたページ探しに使えます。インストールは不要です。
使い方(4ステップ)
- URLを入れる。調べたいサイトのトップページなどのURLを入力します。
- 「探査開始」を押す。同じドメイン内のページを自動でたどり、ツリーに組み立てます。上限は「詳細設定」で変えられます。
- ツリーから選ぶ。ページを選ぶと、右側にそのページの詳細(タイトル・サイズ・更新日時・発リンク/被リンク)が出ます。
- 一覧と書き出し。「リンクエラー」「外部リンク」「リソース」「更新状況」の各タブで確認し、サイトマップ(XML・テキスト)や CSV に書き出せます。
巡回のきまり
ページを取りに行く前に、相手サイトの robots.txt を必ず読みます。
自分の名前(MachToolsWebsiteExplorer)または * のグループで禁止されているURLは取得せず、その旨を表示します。
いちばん長く当てはまった規則を採用し、同じ長さなら許可を優先します(RFC 9309)。robots.txt が読めなかったときは、安全側に倒して巡回を止めます。
名乗る User-Agent は MachToolsWebsiteExplorer/1.0 (+https://www.mach-tools.net/dev/webex/) です。
よくある質問 (FAQ)
robots.txt を読み、自分の名前(MachToolsWebsiteExplorer)または * の規則で禁止されていれば取得を中止し、その旨を表示します。robots.txt が読めなかったときも、安全側に倒して巡回を止めます。