HTML 링크 추출
HTML에서 href·src URL을 중복 없이 수집합니다.
HTML → href / src
값을 입력한 뒤 계산하기를 눌러주세요.
a[href], img/script/iframe/source/link[src|href] 등을 수집합니다.
사용 방법
- HTML 칸에 페이지 소스나 조각 마크업을 붙여 넣습니다.
- 추출을 누르면 결과 영역이 열리고 href 개수와 src 개수가 표시됩니다.
- 목록에는 href 줄이 먼저, 이어서 src 줄이 탭으로 구분되어 나옵니다.
- 주소가 하나도 없으면 목록에 없음이 표시됩니다.
- 결과 복사로 목록을 가져가고, 초기화는 입력을 비우며 결과 영역을 숨깁니다.
핵심 개념
HTML 링크 추출은 문서에 걸린 주소를 종류별로 모아 중복을 제거합니다. 주소 속성이 있는 요소의 값은 href 목록으로, 소스 속성이 있는 요소의 값은 src 목록으로 들어갑니다. 같은 문자열이 두 번 나와도 한 번만 셉니다. 빈 값은 건너뜁니다. 깨진 이미지, 외부 스크립트, 페이지 이동 경로를 한눈에 볼 때 HTML 링크 추출이 크롤링 초안을 대신합니다. 개수는 중복을 뺀 고유 주소이므로, 같은 파일을 여러 태그가 가리켜도 통계는 한 번만 올라갑니다.
상대 경로는 절대 URL로 바꾸지 않으므로 슬래시로 시작하는 값도 그대로 나옵니다. 인라인 스크립트나 CSS url() 함수 속 경로는 속성 수집 대상이 아닙니다. 이 HTML 링크 추출은 소스를 서버로 보내지 않습니다. 메타 추출·제목 추출과 함께 쓰면 검색 요소와 리소스 목록을 같은 소스에서 나눠 확인할 수 있습니다. 목록은 종류 이름과 탭, 주소 순이라 표에 붙여 열을 나누기 쉽고, 아무 주소도 없으면 없음이 표시됩니다.
예시
앵커와 이미지, 스크립트 태그가 있는 소스를 넣고 추출하면 href 집계에 링크 주소가, src 집계에 이미지·스크립트 주소가 오며 목록은 href 탭 URL, src 탭 URL 형식입니다. 같은 이미지 경로가 두 번 나와도 src 숫자는 한 번만 올라갑니다. 결과 복사로 목록을 표에 붙여 깨진 경로를 걸러 낼 수 있습니다.
자주 묻는 질문
HTML 링크 추출은 어떤 속성을 모으나요?
문서에서 주소 속성과 소스 속성을 각각 수집합니다. 앵커뿐 아니라 스타일시트 링크, 이미지, 프레임, 스크립트도 포함됩니다.
HTML 링크 추출에서 같은 URL이 여러 번이면?
문자열 기준으로 한 번만 넣습니다. href 묶음과 src 묶음은 따로 중복을 제거합니다.
HTML 링크 추출 목록에서 href와 src 순서는?
주소 속성 줄이 모두 나온 뒤 소스 속성 줄이 이어집니다. 각 줄은 종류 이름, 탭, URL입니다.
상대 경로는 HTML 링크 추출에서 절대 주소가 되나요?
되지 않습니다. 속성에 적힌 문자열을 그대로 모으므로 사이트 주소를 붙이려면 따로 처리해야 합니다.
HTML 링크 추출 소스는 서버로 전송되나요?
아니요. 파싱과 복사가 브라우저에서만 이루어지고 초기화하면 결과 영역이 숨겨집니다.
HTML 링크 추출에 주소가 없으면 목록은?
href와 src 숫자가 0이고 목록에는 없음이 들어갑니다. 빈 속성 값은 처음부터 세지 않으며, 추출 후에야 결과 영역이 열립니다. 관련: HTML 메타 추출 · HTML 제목 추출 · HTML 에디터
최종 검토일: 2026년 9월 4일