Domain Extractor
Domain Extractor — ブラウザで動作します。入力は保存されません。
ドメイン抽出
値を入力してから「計算する」を押してください。
入力はブラウザ内にのみ残り、サーバーへは送信されません。
使い方
- テキスト / URL一覧にログ、メモ、1行URLを貼ります。
- 抽出するを押します。http/httpsの有無にかかわらずホストパターンを探します。
- 結果は小文字に正規化し、先頭の
www.だけ外し、同じドメインは1行です。 - 上に抽出数とユニークドメインが表示されます。この版では両者は同じです。
- リセットで入力と一覧を空にします。ネットワーク照会はしません。
- 取り出した一覧はリスト並べ替えで五十音・重複整理をさらにできます。ハングルドメインはPunycodeに変えてから抽出する方が安全です。
ポイント
ドメイン抽出は本文からASCIIホスト名だけを拾う作業です。http://やhttps://、先頭のwww.は参考だけで、ホスト文字列を小文字で残します。サブドメイン(blog.example.com)は残し、wwwだけ除きます。パス・クエリ・ポート・IPv4はドメイン一覧に入れません。抽出数とユニークドメインはこの版では同じ値です。
正規表現が英数字ラベル中心なので、ハングル国際化ドメイン(IDN)は拾いにくいことがあります。そのときはPunycode変換でxn--を作ってから再抽出してください。メールの@後ろを専用に集めないので、アドレス収穫はメール抽出を使ってください。入力はブラウザにだけ残り、DNS照会はしません。競合URL一覧やアクセスログからホストだけ集めて在庫を作るとき、重複なしのドメイン一覧がすぐ出ます。
例
https://www.Example.com/aとblog.example.com、www.example.comを入れるとexample.comとblog.example.comの2行になります。大文字とwwwは正規化され、同じホストが何度出ても1行です。192.168.0.1はホストパターンに合わず欠けるのが正常です。抽出結果をリスト並べ替えに貼って五十音にすると報告書用ドメインリストになります。www付きとなしは同じホストにまとまり1行だけ残ります。
関連: メール抽出 · リスト並べ替え · テキスト検索/置換
よくある質問
URLからドメインだけ抽出できますか?
はい。スキームとwwwを無視し、ホストを小文字のユニーク一覧にします。パスとクエリは捨てます。
サブドメインもドメイン抽出に残りますか?
残ります。<code>www</code>だけ除き、<code>api.example.com</code>のような他のサブドメインはそのまま1行になります。
ハングルドメインも抽出されますか?
このパターンはASCIIラベル中心です。ハングルIDNはPunycode変換で<code>xn--</code>を作ってから抽出する方が安全です。
メールアドレスのドメインも拾いますか?
本文でホストのように見えれば拾うことがありますが、アドレス収穫専用ではありません。メールはメール抽出を使ってください。
IPアドレスはドメインとして扱いますか?
IPv4はこのホストパターンに合わず一覧に入れないのが正常です。数字アドレスは別にフィルタしてください。
ドメイン一覧はサーバーへ送られますか?
いいえ。DNS照会なしでブラウザ内の正規表現だけで抜き、ホスト一覧を送信しません。ドメイン在庫を整理する下書き用です。
最終確認日: 2026-09-04