이 게시물은 쿠팡파트너스 활동의 일환으로, 이에 따른 일정액의 수수료를 제공받습니다.
서치어드바이저 사이트 진단 화면 해석과 수집 실패 원인

서치어드바이저 수집 실패는 대부분 로봇 차단, 호스트 불일치, 리디렉션, 네이버 쪽 지연 중 하나이며, 진단 화면 네 그룹을 위에서부터 읽으면 원인이 좁혀집니다.

등록은 끝났습니다. 사이트맵도 넣었고 RSS도 넣었어요. 그런데 며칠이 지나도 네이버에서 글 제목을 검색하면 아무것도 안 나오고, 서치어드바이저 화면에는 초록색과 회색 표시가 섞여 있는데 무엇이 문제인지 알 길이 없는 상태. 등록 절차를 다룬 글은 많지만 그다음 화면을 어떻게 읽는지 설명하는 자료는 드뭅니다. 이 글은 네이버 서치어드바이저 등록 방법, 구글 서치콘솔만으로는 안 되는 이유에서 소유확인과 제출까지 마친 뒤의 이야기예요.

한 가지 미리 밝혀 둘 점이 있습니다. 서치어드바이저 도움말 원문은 searchadvisor.naver.com의 "가이드" 메뉴 안에 있는데, 이 글을 쓰면서 그 페이지를 직접 열어 대조하지 못했어요. 그래서 아래 인용은 네이버 가이드 문구를 그대로 옮긴 카페24·아임웹 같은 플랫폼 도움말과 실사용 기록을 교차해 확인한 것만 실었고(2026-09-21 기준), 확인이 안 된 항목은 "화면에서 확인"이라고 적었습니다.

진단 화면은 네 그룹으로 나뉜다

리포트 메뉴의 사이트 진단(사이트 최적화)은 항목을 하나씩 나열하는 대신 네 묶음으로 보여줍니다. 네이버 가이드 문구를 옮긴 자료에 따르면 각 묶음이 보는 것은 아래와 같아요.

그룹가이드가 설명하는 진단 내용블로거가 손댈 수 있는 것
검색 로봇 수집"로봇 룰 설정에 따른 수집 가능한 문서의 양과
올바른 XML 사이트맵과 RSS가 존재하는지 여부를 확인합니다."
robots.txt, 사이트맵·RSS 주소
콘텐츠 관리"웹 페이지의 제목 및 설명이 콘텐츠 주제를
명확하게 설명할 수 있도록 지정 되었는지를 살펴 진단합니다."
글 제목, 검색 설명
사이트 구조HTML을 잘 사용해 검색 엔진이 이해할 수 있는지 검토테마의 헤딩 구조, 링크 방식
사이트 활성화지속적인 업데이트가 있는지, 방문자가 꾸준히 있는지발행 주기

여기서 순서가 중요합니다. 첫 번째 그룹이 빨간색이면 나머지 셋은 볼 필요가 없어요. 로봇이 못 들어오는 사이트의 제목이 좋은지 나쁜지는 의미가 없으니까요. 반대로 첫 번째가 정상인데 네 번째만 낮다면 그건 설정 문제가 아니라 발행 빈도 문제라, 설정 화면을 아무리 뒤져도 고쳐지지 않습니다.

📌 사이트 진단은 네이버 서치어드바이저 리포트 메뉴에서 검색 로봇 수집·콘텐츠 관리·사이트 구조·사이트 활성화 네 그룹으로 사이트 최적화 상태를 보여주는 기능입니다.

검증 메뉴의 두 도구: 웹 페이지 최적화와 URL 검사

진단이 사이트 전체의 요약이라면, 검증 메뉴는 페이지 하나를 찍어서 보는 자리예요. 웹 페이지 최적화에 글 주소를 넣으면 로봇 룰, 로봇 메타 태그, 제목·설명, 오픈그래프 같은 항목이 통과했는지 항목별로 표시됩니다. 정확한 항목 이름과 개수는 화면에서 확인하는 게 맞고, 읽는 요령은 하나입니다. 빨간 항목 중 "로봇"이 들어간 것부터 봅니다. 나머지는 노출 품질 문제지만 로봇 항목은 노출 여부 자체를 가르거든요.

URL 검사는 그 페이지가 네이버 색인에 들어갔는지를 알려 줍니다. 실사용 기록에 인용된 결과 문구는 세 가지로 갈립니다.

  • "문서가 성공적으로 색인 됐습니다. 해당 문서를 검색할 수 있습니다." — 검색 대상에 들어간 상태
  • "수집 됐습니다. 미색인 문서로 검색 대상이 아닙니다." — 로봇은 다녀갔지만 색인에서 빠진 상태
  • "URL 검사에 실패했습니다. 수집 데이터가 없거나, URL 이상으로 결과를 확인 할 수 없습니다" — 로봇이 아직 오지 않았거나 주소가 다른 상태

두 번째와 세 번째의 차이가 핵심이에요. 두 번째는 수집은 됐으니 아래 "수집 실패 원인"이 아니라 콘텐츠 품질 쪽 문제고, 세 번째만이 이 글에서 다루는 수집 문제입니다. 구글 서치콘솔에 익숙하다면 두 번째가 "크롤링됨 - 현재 색인이 생성되지 않음"에 가깝고, 세 번째가 "발견됨 - 현재 색인이 생성되지 않음"이나 "URL이 Google에 등록되어 있지 않음"에 가깝다고 보면 돼요. 서치콘솔 쪽 상태 해석은 구글 서치콘솔 사용법, 계정만 만들면 끝이라는 착각에 있습니다.

웹 페이지 수집 요청, 하루 한도와 세 가지 결과

요청 메뉴의 웹 페이지 수집은 글 하나를 콕 집어 로봇을 부르는 기능입니다. 한도가 있어요. 복수의 실사용 자료와 아임웹 FAQ가 하루 최대 50개로 안내하고 있습니다(2026-09-21 기준, 공식 가이드 원문은 searchadvisor.naver.com 가이드 메뉴에서 확인). 글이 200편인 블로그를 새로 등록했다면 나흘에 걸쳐 나눠 넣어야 한다는 뜻이죠. 이 한도 때문에 사이트맵·RSS 제출이 필요한 겁니다. 수집 요청은 급한 글 몇 편을 앞당기는 용도고, 나머지는 사이트맵으로 로봇이 알아서 찾게 두는 구조예요.

요청 뒤 화면에는 결과가 세 가지 중 하나로 남습니다. 실사용 기록에 인용된 표기는 "수집 성공", "서버 오류", "수집 보류"예요. 결과가 채워지기까지는 "빠르면 수 분, 늦으면 며칠"로 안내돼 있습니다.

  • 수집 성공: 로봇이 페이지를 받아 갔다는 뜻이지 색인됐다는 뜻은 아닙니다. 며칠 뒤 URL 검사로 색인 여부를 따로 봐야 해요.
  • 서버 오류: 로봇이 접속했는데 내 서버가 정상 응답을 못 준 경우입니다. Blogger 같은 호스팅형 플랫폼에서는 드물고, 워드프레스 자체 호스팅에서 방화벽이 네이버 로봇(Yeti)을 막을 때 자주 나옵니다.
  • 수집 보류: 네이버가 지금은 가져가지 않기로 한 상태입니다. 아래 원인 다섯 가지가 전부 여기로 모여요.

사이트맵·RSS 제출 뒤 수집이 안 될 때, 이 순서로 본다

원인은 크게 다섯 갈래입니다. 위에서부터 확인하면 대부분 세 번째 안에서 끝나요.

1. 로봇이 차단돼 있다. robots.txt에서 네이버 로봇 Yeti가 막혀 있거나, 페이지에 noindex 로봇 메타 태그가 붙어 있는 경우예요. 가이드는 색인되지 않는 콘텐츠의 첫 점검 항목으로 noindex 메타 태그 제거를 꼽습니다. 검증 메뉴의 robots.txt 항목과 웹 페이지 최적화의 로봇 항목 두 곳이 모두 초록이어야 통과입니다.

2. 제출한 주소와 등록한 호스트가 다르다. 서치어드바이저는 사이트를 호스트 단위로 등록합니다. www.example.com으로 등록했는데 사이트맵 안의 링크가 example.com이거나, 그 반대이면 로봇은 다른 사이트로 봅니다. 아임웹 FAQ는 이 경우를 두고 "대표 도메인과 등록된 주소가 다르면 네이버 서치어드바이저가 두 도메인을 다른 주소로 감지해서 RSS를 등록할 수 없습니다"라고 설명해요. 사이트맵·RSS 안의 링크가 절대 경로인지, 등록한 호스트와 글자까지 같은지 봅니다. Blogger 커스텀 도메인이라면 리디렉션 설정에서 www와 non-www 중 하나로 통일돼 있는지도 함께 확인해야 합니다.

3. 리디렉션되는 페이지다. 워드프레스 정보꾸러미 기록에 "리디렉션된 페이지" 표시로 수집이 보류된 사례가 있는데, 원인은 사이트맵의 URL 끝에 슬래시가 빠져 있어 네이버가 301 리디렉션으로 인식한 것이었어요. 최종 주소로 직접 응답하는 URL만 제출해야 합니다. 가이드도 자바스크립트 리디렉션 대신 HTTP 리디렉션을 쓰라고 안내합니다.

4. 본문이 로봇 눈에 안 보인다. 자바스크립트로만 본문을 그려 넣거나 frame 태그 안에 본문을 넣은 구조는 수집이 돼도 내용이 비어 있습니다. 가이드는 링크도 자바스크립트 이동 대신 표준 <a href> 태그로 걸라고 하고, nofollow가 걸린 링크는 따라가지 않습니다. 대부분의 블로그 플랫폼은 해당 없지만, 테마를 직접 손본 경우엔 확인 대상이에요.

5. 내 쪽 문제가 아니다. 위 넷이 다 정상인데도 보류가 길어지는 경우가 있습니다. 서치어드바이저 문의에 대한 네이버 쪽 답변으로 인용되는 문구는 이렇습니다. "네이버 검색 엔진이 일시적으로 처리할 URL 요청이 급증하거나 내부적으로 문서를 구분하는 시기에 있거나 도메인 점수 및 사이트의 인지도 등 다양한 이슈들로 수집이 지연될 수 있습니다." 이때 할 일은 설정을 건드리는 게 아니라 발행을 이어 가는 것뿐이에요. 사이트 활성화 그룹이 보는 게 바로 그것이고, 네이버가 사이트를 평가하는 방식은 네이버 블로그 C-Rank·D.I.A. 알고리즘, "매일 써야 오른다"는 착각에서 따로 다뤘습니다.

Blogger 사용자가 넣어야 할 주소 두 개

Blogger는 사이트맵과 RSS를 자동으로 제공합니다. 커스텀 도메인 기준으로 사이트맵은 /sitemap.xml, RSS는 /feeds/posts/default?alt=rss예요. 둘 다 등록한 호스트 그대로 붙여 넣습니다. 가이드는 RSS에 글 전문이 들어가도록 권장하는데, Blogger 설정의 "사이트 피드" 항목에서 피드를 "전체"로 두면 됩니다. "짧게"로 돼 있으면 RSS로 들어온 로봇이 본문 없는 문서를 받아 가요.

제출 뒤 화면에서 볼 것은 마지막 수집 일시와 수집된 URL 수입니다. 사이트맵의 URL 수가 실제 발행 글 수와 크게 다르면 사이트맵이 옛 주소를 가리키고 있다는 신호예요. 특히 도메인을 바꾼 블로그는 이 숫자부터 봐야 합니다.

정리하면 순서는 이렇습니다. 진단 첫 그룹 → 검증의 로봇 항목 → 사이트맵 링크의 호스트와 슬래시 → URL 검사 문구 → 그래도 보류면 기다림. 다섯 가지 중 넷은 내 설정에서 끝나고, 마지막 하나만 시간이 답이에요.

서치어드바이저 수집 자주 묻는 질문

Q. 웹 페이지 수집 요청은 하루에 몇 개까지 되나요?
복수의 실사용 자료와 아임웹 FAQ 기준으로 하루 최대 50개입니다(2026-09-21 기준). 공식 가이드 원문은 searchadvisor.naver.com의 가이드 메뉴에서 확인할 수 있습니다.

Q. 수집 성공으로 표시됐는데 검색에는 왜 안 나오나요?
수집 성공은 로봇이 페이지를 가져갔다는 뜻이고 색인과는 별개입니다. 검증 메뉴의 URL 검사에서 "문서가 성공적으로 색인 됐습니다"가 나와야 검색 대상입니다.

Q. Blogger 블로그의 사이트맵과 RSS 주소는 무엇인가요?
등록한 호스트 뒤에 사이트맵은 /sitemap.xml, RSS는 /feeds/posts/default?alt=rss를 붙인 주소입니다. 둘 다 등록한 호스트(www 포함 여부)와 글자까지 같아야 합니다.

Q. 사이트맵의 URL이 "리디렉션된 페이지"로 보류되는 이유는 무엇인가요?
제출한 URL이 다른 주소로 301 이동하는 경우입니다. URL 끝 슬래시 누락으로 리디렉션이 생긴 사례가 보고돼 있으며, 최종 주소로 직접 응답하는 URL만 제출해야 합니다.

출처

  • 네이버 서치어드바이저 — searchadvisor.naver.com (가이드 메뉴 원문은 이 글 작성 시 직접 대조하지 못함)
  • 브런치, "검색엔진 최적화 요소 : 네이버 서치 어드바이저" (사이트 최적화 네 그룹 가이드 문구 인용) — brunch.co.kr
  • 와이두유리브, "네이버 서치어드바이저" (가이드의 색인·링크 수집 점검 항목 정리) — thisisthereason.com
  • 아임웹 FAQ, "네이버 서치어드바이저에 RSS 제출 시 오류 메시지가 나타나요" — imweb.me
  • 아임웹 FAQ, "사이트 정보 재수집 요청 및 수집주기 변경하기" — imweb.me
  • 하우투딕, "네이버 검색 수집 요청 방법 웹마스터 도구 웹 페이지 수집" (수집 결과 표기·URL 검사 문구) — howtodic.com
  • 워드프레스 정보꾸러미, "네이버 서치어드바이저 수집 제한: 리디렉션된 페이지 문제" — thewordcracker.com
  • 쇼트그램스, "네이버 서치어드바이저 'URL 검사에 실패했습니다…'" (수집 지연 관련 네이버 답변 인용) — shortgrams.com