도메인 추출
붙여 넣은 텍스트·URL에서 도메인만 뽑아 중복 없이 목록으로 만듭니다.
도메인 추출
값을 입력한 뒤 계산하기를 눌러주세요.
입력은 브라우저에만 남고 서버로 전송되지 않습니다.
사용 방법
- 텍스트 / URL 목록에 로그, 메모, 한 줄 URL을 붙여 넣습니다.
- 추출하기를 누릅니다. http/https 유무와 상관없이 호스트 패턴을 찾습니다.
- 결과는 소문자로 정규화되고, 앞의
www.만 떼며, 같은 도메인은 한 줄입니다. - 위에 추출 수와 고유 도메인이 표시됩니다. 이 버전에서는 둘이 같습니다.
- 초기화로 입력과 목록을 비웁니다. 네트워크 조회는 하지 않습니다.
- 뽑아 낸 목록은 목록 정렬로 가나다·중복 정리를 한 번 더 할 수 있습니다. 한글 도메인은 퓨니코드로 바꾼 뒤 추출하는 편이 안전합니다.
핵심 개념
도메인 추출은 본문에서 ASCII 호스트명만 골라내는 작업입니다. http://나 https://, 앞의 www.는 참고만 하고 호스트 문자열을 소문자로 남깁니다. 서브도메인(blog.example.com)은 유지하고 www만 제거합니다. 경로·쿼리·포트·IPv4는 도메인 목록에 넣지 않습니다. 추출 수와 고유 도메인은 이 버전에서 같은 값입니다.
정규식이 영문·숫자 라벨 위주라 한글 국제화 도메인(IDN)은 잘 안 잡힐 수 있습니다. 그때는 퓨니코드 변환으로 xn--를 만든 뒤 다시 추출하세요. 이메일 @ 뒤를 전용으로 모으지는 않으니 주소 수확은 이메일 추출기를 쓰세요. 입력은 브라우저에만 남고 DNS 조회는 하지 않습니다. 경쟁사 URL 목록이나 접속 로그에서 호스트만 모아 인벤토리를 만들 때 중복 없는 도메인 목록이 바로 나옵니다.
예시
https://www.Example.com/a와 blog.example.com, www.example.com을 넣으면 example.com과 blog.example.com 두 줄이 됩니다. 대문자와 www는 정규화되고, 같은 호스트가 여러 번 나와도 한 줄입니다. 192.168.0.1은 호스트 패턴에 맞지 않아 빠지는 것이 정상입니다. 추출 결과를 목록 정렬에 붙여 가나다로 정리하면 보고서용 도메인 리스트가 됩니다. www가 붙은 주소와 안 붙은 주소는 같은 호스트로 합쳐져 한 줄만 남습니다.
자주 묻는 질문
URL에서 도메인만 추출할 수 있나요?
네. 스킴과 www를 무시하고 호스트를 소문자 고유 목록으로 만듭니다. 경로와 쿼리는 버립니다.
서브도메인도 도메인 추출에 남나요?
남습니다. www만 제거하고 api.example.com처럼 다른 서브도메인은 그대로 한 줄이 됩니다.
한글 도메인도 추출되나요?
이 패턴은 ASCII 라벨 중심입니다. 한글 IDN은 퓨니코드 변환으로 xn--를 만든 뒤 추출하는 편이 안전합니다.
이메일 주소의 도메인도 잡히나요?
본문에 호스트처럼 보이면 잡힐 수 있지만, 주소 수확 전용은 아닙니다. 메일은 이메일 추출기를 쓰세요.
IP 주소는 도메인으로 보나요?
IPv4는 이 호스트 패턴에 맞지 않아 목록에 안 넣는 것이 정상입니다. 숫자 주소는 따로 필터하세요.
도메인 목록이 서버로 전송되나요?
아니요. DNS 조회 없이 브라우저에서만 정규식으로 뽑고 호스트 목록을 전송하지 않습니다. 도메인 인벤토리를 정리하는 초안용입니다. 관련: 이메일 추출 · 목록 정렬 · 텍스트 찾기/바꾸기
최종 검토일: 2026년 9월 4일