제가 손수 작성한 첫 번째 사이트맵에는 알아차리는 데 일주일이 걸리는 버그가 있었습니다. 제 URL 중 하나에는 앰퍼샌드가 포함된 쿼리 문자열이 있었습니다. ?id=1&sort=name- 그리고 나는 그것을 a에 바로 붙여넣었습니다 <loc> 태그. Google Search Console 은 전체 사이트 맵을 유효하지 않은 것으로 표시했지만 오류 메시지가 모호하여 문제가 다른 곳에 있다고 가정했습니다. 그렇지 않았습니다. 원시 앰퍼샌드는 XML 에서 불법입니다; 로 작성해야합니다 &. 한 캐릭터가 전체 파일을 깨뜨렸고, 이해하지 못하는 문제를 찾는 동안 그 안의 모든 페이지가 제출되지 않았습니다.
그 경험은 제가 사이트맵에 대해 생각하는 방식을 형성했고 결국에는 왜 사이트맵을 추가했는지에 대해 설명했습니다 XML 사이트맵 생성기 에 Toolz.dev니다. 사이트맵은 개념적으로 하드하지 않습니다 - 그것은 태그에 싸여 URL 의 목록입니다 - 하지만 형식은 용서하지 않는,그리고 사람을 위로 트립 부품은 정확히 기계가 처리해야 부품: 예약 문자 탈출,모든 URL 이 절대적임을 검증,중복 잡기,아래에 머물 protocol's 크기 제한. 사이에 SEO 를 실행하는 내 자신의 프로젝트에 대한 구축 워드 프레스 플러그인 WP 관리, 나는 셀 수있는 것보다 더 많은 사이트 맵을 생성했으며, 매번 같은 소수의 실수가 반복됩니다.이 가이드는 사이트 맵이 실제로 무엇인지, 그 안에 무엇이 속하는지, 그리고 생성기가 날카로운 모서리를 제거하는 방법을 안내합니다.
TL;DR: XML 사이트맵은 sitemaps.org 형식의 site's 중요 URL 목록이므로 검색 엔진이 효율적으로 크롤링할 수 있습니다. 각
<url>가 필요합니다<loc>그리고 선택 나를 수 있습니다<lastmod>,<changefreq>, 그리고<priority>태그. 단일 파일의 상한은 50,000 URL 과 50MB 입니다. The XML 사이트맵 생성기 URL의 일반 목록을 가져 와서 올바르게 이스케이프하고 중복을 제거하고 제한에서 경고하고 다운로드하여 제출할 수있는 유효한 sitemap.xml을 생성합니다 - 모두 브라우저에서.
XML 사이트맵이란 무엇이며, 필요한가요?
XML 사이트맵은 검색 엔진이 알고 싶은 사이트의 URL 을 나열하는 파일입니다. sitemaps.org 에 게시되고 Google,Bing 및 기타 모든 주요 엔진에서 지원하는 작고 잘 정의된 표준을 따르는 파일입니다. 파일은 각 URL 을 a 로 감싸줍니다 <url> 싱글 내부의 요소입니다 <urlset>그리고 네임스페이스를 선언하여 파서가 말하는 프로토콜 버전을 알 수 있도록 합니다.
최소 유효한 사이트맵은 다음과 같습니다:
<?xml version="1.0" encoding="UTF-8"?>
<urlset xmlns="http://www.sitemaps.org/schemas/sitemap/0.9">
<url>
<loc>https://example.com/</loc>
</url>
</urlset>
그것이 전체 모양입니다. 다른 모든 것들 - 날짜,빈도, 우선 순위 -은 하나의 필수 요소 위에 선택적 장식입니다 <loc>.
하나 필요하십니까? 검색 엔진은 주로 링크를 따라 페이지를 찾으므로 사이트 맵없이 작고 잘 연결된 사이트가 잘 발견되는 경우가 많습니다. 그러나 사이트 맵은 몇 가지 일반적인 상황에서 유지율을 얻습니다: 크롤러가 합리적인 수의 홉에서 모든 페이지에 도달하지 못할 수있는 큰 사이트; 그것을 가리키는 외부 링크가 거의없는 새로운 사이트; 깊은 아카이브 콘텐츠와 같이 내부적으로 잘 연결되지 않은 페이지가있는 사이트; 또는 자주 변경되고 신선도를 신호하려는 사이트. 사이트 맵은 색인 생성을 보장하지 않습니다 - 명령이 아니라 초대장입니다 - 그러나 중요한 URL 을 쉽게 찾을 수있게하며 Google 에 그렇지 않으면 놓칠 수있는 페이지에 대해 알려주는 깨끗한 채널을 제공합니다.
각 URL 항목에는 어떤 정보가 들어가나요?
요구되는 것 이상으로 <loc>의, 프로토콜은 세 가지 선택적 자식 태그를 정의하고, 그들이 얼마나 중요한지에 대한 민속이 많이있다. 여기에 정직한 버전입니다.
<loc> 는 페이지 URL 입니다. 절대적이어야 합니다 - 로 시작해서 http:// 또는 https://- 자격을 갖추고 XML이 이스케이프되었습니다. 이것은 내 오래된 앰퍼샌드 버그가 살았던 태그이며 생성기는 5개의 XML 특수 문자를 자동으로 이스케이프하므로 절대로 충돌하지 않습니다.
<lastmod> 페이지가 마지막으로 변경된 날짜입니다. W3C Datetime 형식: 둘 중 하나입니다 2026-07-25 또는 전체 타임스탬프와 같습니다 2026-07-25T14:30:00+00:00. 이것은 진정으로 중요합니다. Google은 사용한다고 밝혔습니다 lastmod 페이지를 다시 그릴 때를 알려주는 신호로, 값이 정확하고 일관성이 있는 경우니다. 모든 페이지에 스탬프를 찍는다면 today's 날짜 모든 빌드에,당신은 크롤러에 거짓말을하고 그것은 당신을 무시하는 법을 배울 것입니다. 실제 수정 날짜를 사용합니다.
<changefreq> 페이지가 얼마나 자주 변경되는지 암시합니다 - always, hourly, daily, weekly, monthly, yearly, 또는 never. 구글은 이 태그를 대체로 무시하고 기껏해야 약한 힌트로 취급한다는 점을 분명히 했습니다. 포함하는 것은 해롭지 않지만 그것에 대해 고민하지 마십시오.
<priority> 는 0.0 에서 1.0 까지의 숫자로 page's 중요성을 상대적으로 제안합니다 자신의 사이트에 다른 페이지. 다른 사이트와의 순위에는 영향을 미치지 않으며 Google 도 대부분 무시합니다. 일반적인 실수는 모든 페이지를 1,0 으로 설정하여 태그를 무의미하게 만드는 것입니다. 전혀 사용하는 경우 진정으로 가장 중요한 페이지에 높은 값을 예약하십시오.
발전기를 사용하면 신청할 수 있습니다 changefreq, priority, 그리고 lastmod 모든 URL에 대해 전역적으로 적용되며 공백으로 남겨둔 태그를 완전히 생략합니다. 따라서 그냥 사이트맵을 원하는 경우 <loc> 완벽하게 유효하고 점점 더 인기를 얻고 있는 항목을 정확하게 얻을 수 있습니다.
sitemap.xml 파일을 만들려면 어떻게 해야 합니까?
워크플로는 빠르고 손으로 작성한 사이트맵을 괴롭히는 형식 오류를 제거하도록 구축되었습니다.
URL 을 입력에 한 줄에 하나씩 붙여넣는 것으로 시작합니다. CMS,크롤링 또는 스프레드시트 열에서 내보낸 목록을 붙여넣을 수 있습니다. 빈 줄은 무시되고 다음으로 시작하는 모든 줄은 무시됩니다 # 는 주석으로 취급되므로 URL 을 삭제하지 않고 주석을 달거나 일시적으로 비활성화할 수 있습니다. 모든 줄은 WHATWG URL 파서를 통해 실행됩니다: 유효하지 않은 경우 절대 http 또는 https URL은 건너뛰고 보고되므로 상대 경로를 벗어나거나 오타가 자동으로 출력을 손상시키지 않습니다.
다음으로 기본값을 설정합니다. 드롭다운에서 변경 빈도를 선택하고,원하는 경우 우선 순위를 설정하고,마지막으로 수정된 날짜를 켜십시오 - 기본값은 오늘이지만 아무 날짜나 선택할 수 있습니다. 그런 다음 정리 결정: 중복 제거를 활성화하여 반복된 URL 을 삭제합니다 (기본적으로 켜짐,복제하기 때문입니다 <loc> 항목은 일반적인 복사 붙여넣기 아티팩트입니다.) 선택적으로 목록을 알파벳순으로 정렬하여 이전 버전과 비교하여 더 쉽게 스캔하고 차이점을 찾을 수 있습니다.
출력은 무엇이든 변경하면서 실시간으로 업데이트됩니다. 제대로 보이면 XML 을 복사하거나 XML 로 직접 다운로드하십시오 sitemap.xml. 이 도구는 또한 얼마나 많은 URL이 들어왔는지, 파일 크기, 건너뛴 줄, 그 이유를 보고합니다. 따라서 신뢰할 수 있는 XML 덩어리가 아니라 파일에 들어간 내용이 정확히 무엇인지 명확하게 설명할 수 있습니다.
사이트맵은 어디에 두고 어떻게 제출하나요?
파일을 생성하는 것은 작업의 절반입니다; 나머지 절반은 검색 엔진에 이를 알리는 것입니다.
첫째, 사이트맵.xml 을 사이트에 업로드's 루트 그래서 도달할 수 있습니다 https://yoursite.com/sitemap.xml. 위치는 사람들이 기대하는 것보다 더 중요합니다: 사이트맵은 동일한 디렉토리 수준 또는 그 위치 아래에 있는 URL 만 포함할 수 있으므로 루트에 넣으면 전체 사이트를 다룰 수 있습니다. 대부분의 호스트와 CMS 플랫폼을 사용하면 웹 루트에 정적 파일을 삭제하거나 경로에서 제공할 수 있습니다.
두번째, google 검색 콘솔에 사이트맵 URL을 제출하세요 indexing → Sitemaps 아래,그리고 Bing Webmaster Tools 에 해당하는 섹션 아래에 있습니다. 전체 URL 을 붙여넣으면 엔진이 이를 가져오고,읽은 URL 수를 보고하고,에러를 플래그합니다. 또한 Google 이 실제로 페이지를 색인화했는지 여부를 볼 수 있으며,이는 사이트맵을 읽었는지 여부와는 별개입니다.
셋째 - 그리고 이것은 대부분의 사람들이 건너 뛰는 단계입니다 - robots.txt에 참조를 추가하세요. 한 줄, Sitemap: https://yoursite.com/sitemap.xml를 사용하면 크롤러가 사이트맵을 아무데도 제출하지 않고도 자동으로 사이트맵을 검색할 수 있습니다. 벨트와 버팀대가 움직이며 자연스럽게 사이트맵과 쌍을 이룹니다 robots.txt 발전기 사이트맵 라인이 이미 있는 상태에서 해당 파일을 생성할 수 있는 사이트에서. 두 도구는 함께 사용하도록 설계되었습니다: robots.txt 는 크롤러에게 액세스할 수 있는 내용을 알려주고 사이트맵은 존재하는 내용을 알려줍니다.
크기 제한은 무엇이며, 이를 초과하면 어떻게 되나요?
Sitemaps.org 프로토콜은 단일 사이트맵 파일을 에서 캡핑합니다 50,000 URL 및 50MB 압축되지 않음. 이는 하드 제한입니다. 둘 중 하나를 위반하는 파일은 거부됩니다. 파서가 무제한 파일을 메모리에 로드할 필요가 없도록 존재합니다.
대부분의 사이트에 대 한 이것은 문제가 되지 않습니다; 당신은 오래 전에 당신이 방을 다 떨어질 페이지가 부족할 것입니다. 하지만 대형 전자 상거래 카탈로그,뉴스 아카이브,사용자 생성-콘텐츠 사이트는 일상적으로 50,000 URL 을 지나 날 려 때,대답은 a 사이트맵 색인: 여러 사이트맵 파일(각각 제한 아래)에 URL을 분할하고 이를 나열하는 하나의 인덱스 파일을 만듭니다. 인덱스는 a를 사용합니다 <sitemapindex> 대신 래퍼 <urlset>그리고 검색 엔진은 먼저 인덱스를 가져온 다음 각 하위 사이트맵을 가져옵니다.
생성기는 빌드할 때 URL 과 출력의 바이트 크기를 계산하고,인덱스 뒤에 여러 파일로 분할하라는 일반 언어 메모와 함께 두 제한 중 하나를 넘은 순간을 경고합니다. 그 조기 경고는 고의적입니다 - 한계를 넘었다는 것을 발견하는 최악의 시간은 Search Console 이 거부 한 파일을 제출 한 후입니다. 갈 때 카운트를 알면 실패가 계획 결정으로 바뀝니다.
비교: 사이트맵에 속하는 것과 속하지 않는 것
사이트맵은 의도의 진술입니다 - "these are the canonical pages I want indexed" - 그래서 당신이 빼는 것은 당신이 넣은 것만큼 중요합니다. 정크로 패딩하는 것은 혼합 신호를 보내고 Google 이 얼마나 신뢰하는지 희석시킬 수 있습니다.
| 포함하다 | 제외하다 |
|---|---|
| 순위를 매기려는 표준적이고 색인 가능한 페이지입니다 | 중복되거나 비정규적인 URL |
| 중요 콘텐츠 및 카테고리 페이지 | robots.txt 또는 noindex 에 의해 차단된 페이지 |
| 다시 작성하려는 신선한 페이지 | 리디렉션 (3xx) 및 오류 페이지 (4xx/5xx) |
| 내부적으로 약하게 연결된 페이지 | 추적 매개 변수 또는 세션 ID가 있는 URL |
기본 원칙은 사이트맵의 모든 URL 이 200 상태를 반환하고,정규적이며, 검색 결과에서 기꺼이 볼 수 있는 페이지가 되어야 한다는 것입니다. URL 을 나열한다고 해서 Google 이 색인을 생성하도록 강요하지는 않으며,다른 곳에서 무시하라고 Google 에 지시한 페이지 목록 - noindex 태그 또는 robots.txt 블록을 통해 - 은 모순적입니다. 최고의 페이지에 대한 집중된 사이트맵은 크롤러가 이론적으로 도달할 수 있는 모든 것의 철저한 덤프를 일관되게 능가합니다.
SEO 툴킷에서 사이트맵 생성기는 어디에 적합합니까?
나는 관련없는 가제트의 더미가 아닌 연결된 유틸리티 세트로 Toolz.dev 를 구축하고,기술 - SEO 도구는 그룹으로 작동하도록 설계되었습니다. 사이트 맵 생성기는 가장 직접적으로 와 쌍을 이룹니다 robots.txt 발전기- 두 파일은 귀하의 사이트와 크롤러 사이의 표준 악수이며, 하나는 액세스 할 수있는 것을 말하고 다른 하나는 존재하는 것을 나열합니다. 페이지 수준에서, 그만큼 메타 태그 생성기 제목,설명, 그리고 각각의 사이트맵 URL 이 검색 결과와 소셜 공유에 어떻게 나타나는지를 결정하는 Open Graph 태그를 생성합니다. 그리고 URL 자체를 빌드할 때,the 슬러그 생성기 페이지 제목을 처음부터 좋은 사이트맵을 만드는 깨끗하고 읽기 쉬운 경로로 바꿉니다.
그들을 연결하는 스레드는 각각이 데이터를 업로드하지 않고 정확하고 로컬로 하나의 작업을 수행한다는 것입니다. 그 마지막 요점은 사이트 맵 도구에 부수적이지 않습니다: URL 목록은 사실상 아직 시작하지 않았을 페이지를 포함하여 전체 사이트 구조의 맵이며 태그로 감싸기 위해 타사 서버로 보내서는 안됩니다. 여기있는 모든 것은 브라우저에서 실행되므로 NDA 하에서 스테이징 사이트 및 클라이언트 작업에서 안전하게 사용할 수 있습니다 - 개인 정보 보호 입장에 대해 길게 가이드에 썼습니다 클라이언트 측 도구를 사용하여 데이터를 비공개로 유지합니다. 그것은 내가 사이트의 모든 유틸리티에 가져오는 것과 동일한 건물 철학이며, 이를 풀었습니다 웹 개발자 툴킷 가이드: 작고 날카로우며 정직한 도구는 귀하의 데이터를 입장료로 원하는 비대해진 올인원 플랫폼을 능가합니다.
사이트맵을 구축할 때 흔히 저지르는 실수
반복되는 오류는 이름을 지정할 가치가 있으므로 피할 수 있습니다. 첫째, 탈출하지 못한 특수 캐릭터- 내가 열었던 앰퍼샌드 버그. 생 &, <, 그리고 > URL 의 문자는 XML 을 깰. 생성기는 자동으로 모든 다섯 예약 문자를 탈출하지만,나중에 파일을 손으로 편집하는 경우,그것을 염두에 두어야합니다.
두번째, 상대 또는 프로토콜 상대 URL. ᅡ <loc> 절대적이어야 하며 계획을 포함해야 합니다. /about 또는 //example.com/about 둘 다 유효하지 않습니다; 오직 https://example.com/about 작동합니다. 이 도구는 적절한 절대 URL 이 아닌 모든 것을 통과하지 않고 거부하고보고합니다.
셋째, 비정규적이거나 색인화할 수 없는 URL을 포함합니다- 리디렉션,noindexed 페이지,또는 추적 매개 변수와 중복. 이들은 모순 신호와 낭비 크롤링 예산을 보냅니다. canonical 200-status 페이지에 사이트 맵을 유지.
넷째, 진부하거나 부정직합니다 lastmod 날짜니다. 모든 배포에 현재 날짜로 모든 페이지를 스탬프 Google 은 태그를 완전히 불신하는 가르칩니다. 실제 수정 날짜를 사용하거나 떠나십시오 lastmod 속이기보다는 꺼져라.
다섯째, 사이트맵을 다시 제출하거나 참조하는 것을 잊어버렸습니다. 파일을 생성하는 것은 그 자체로는 아무 것도 하지 않습니다 - 업로드하고 Search Console 에 제출하고 robots.txt 에서 이상적으로 가리켜야 합니다. 크롤러가 들어보지 않은 사이트맵이 서버에 있는 것은 단지 파일일 뿐입니다.
자주 묻는 질문
XML 사이트맵이란 무엇입니까?
XML 사이트맵은 검색 엔진이 효율적으로 찾아 크롤링할 수 있도록 사이트의 중요한 URL 을 나열하는 파일입니다. sitemaps.org 프로토콜을 따르며 각 URL 을 a 로 래핑합니다 <url> 선택 사항인 마지막 수정 날짜, 변경 빈도 및 우선 순위가 있는 요소입니다. 하나를 제출하면 검색 엔진이 내부적으로 잘 연결되지 않은 페이지를 검색하는 데 도움이 됩니다.
sitemap.xml 파일을 만들려면 어떻게 해야 합니까?
이 생성기에 site's URL 을 붙여넣고,한 줄에 하나씩,원하는 변경 빈도와 우선 순위를 설정한 다음,sitemap.xml 로 결과를 복사하거나 다운로드합니다. 해당 파일을 website's 루트 디렉터리에 업로드하면 그대로 유지됩니다 https://yoursite.com/sitemap.xml그리고 Google Search Console에 URL을 제출하세요. 전체 과정은 몇 분 정도 걸립니다.
ChangeFreq와 Priority는 실제로 무엇을 합니까?
changefreq 은 페이지가 얼마나 자주 변경되고 우선 순위 (0,0 ~ 1,0) 가 사이트의 다른 페이지와 관련하여 중요성을 암시하는지를 암시합니다. 둘 다 명령이 아니라 힌트입니다. Google 은 대체로이를 무시하고 자체 신호에 해를 끼치 지 않으므로 changefreq 을 대략적으로 설정하고 가장 중요한 페이지에 우선 순위 1,0 을 예약하십시오.
하나의 사이트맵에 포함할 수 있는 URL은 몇 개입니까?
단일 사이트맵 파일은 50,000개의 URL과 50MB의 압축으로 제한됩니다. 사이트가 더 큰 경우 여러 사이트맵 파일로 URL을 분할하고 해당 파일을 Sitemap 색인에 나열합니다. 이 도구는 한도가 초과되면 즉시 경고하므로 파일을 분해할 때를 알 수 있습니다.
lastmod 날짜는 어떤 형식이어야 합니까?
W3C Datetime 형식을 사용하십시오: 2026-07-25 와 같은 일반 날짜 또는 2026-07-25T14:30:00+00:00 와 같은 전체 타임스탬프. 이 생성기는 둘 다 허용하고 lastmod 를 입력하지 않고 lastmod 를 활성화하면 today's 날짜로 기본 설정됩니다. 정확한 lastmod 값은 검색 엔진이 진정으로 변경된 페이지를 다시 그리는 것을 우선시하도록 도와줍니다.
내 사이트맵에 모든 페이지를 포함해야 합니까?
순위를 매기려는 표준적이고 인덱싱 가능한 페이지를 포함하고 중복,리디렉션, 오류 페이지 및 robots.txt 또는 noindex 태그에 의해 차단된 모든 것을 제외하십시오. URL 을 나열한다고 해서 인덱싱이 보장되는 것은 아니며 낮은 값의 URL 로 파일을 패딩하면 혼합 신호가 전송됩니다. 최상의 페이지의 집중된 사이트맵은 철저한 페이지보다 더 잘 작동합니다.
사이트맵을 생성한 후 어디에서 제출해야 합니까?
사이트 루트에 sitemap.xml 을 업로드한 다음,Google Search Console 의 Indexing → Sitemaps 아래와 Bing Webmaster Tools 에 전체 URL 을 제출합니다. "Sitemap: 을 추가할 수도 있습니다 https://yoursite.com/sitemap.xml" 모든 크롤러가 자동으로 검색할 수 있도록 robots.txt 파일에 줄을 서세요.
내 URL 목록이 비공개로 유지됩니까?
예. 전체 사이트맵은 일반 JavaScript 로 브라우저에 구축됩니다. 전체 사이트 구조를 노출시킬 수 있는 URL 은 전송,로그 또는 저장되지 않으며,페이지가 로드된 후에도 도구는 네트워크 연결 없이 계속 작동합니다.



