구글 SEO
noindex
noindex 다른 표기: 노인덱스, 색인 제외
noindex는 특정 페이지를 검색결과에 노출하지 말라고 검색엔진에 지시하는 메타 태그나 HTTP 헤더입니다.
- noindex를 메타 태그와 HTTP 헤더로 작성하는 방법
- robots.txt 차단과 noindex를 같이 쓰면 안 되는 이유
- 지금 내 페이지에 noindex가 걸려 있는지 확인하는 방법
noindex는 어디에서 쓰이나요?
검색 노출이 불필요한 페이지를 결과에서 빼고 싶을 때 씁니다.
- 내용이 같은 페이지가 여러 URL로 중복될 때
- 관리자·태그 페이지처럼 검색에 나올 필요가 없는 페이지
- 얇은 내용의 페이지를 사이트 품질 판단에서 분리하고 싶을 때
noindex는 어떻게 작성하나요?
페이지 head 안 메타 태그나 서버 응답 헤더에 적습니다.
<meta name="robots" content="noindex" /> HTML 이 아닌 PDF 등에는 응답 헤더로 씁니다 HTTP/1.1 200 OK X-Robots-Tag: noindex
지킬 규칙은 두 가지입니다.
- robots.txt로 크롤링 자체를 막은 페이지에는 넣지 않습니다
- 색인은 막고 링크는 따라가게 하려면 noindex, follow로 함께 적습니다
noindex가 왜 중요한가요?
걸어 둔다고 바로 검색결과에서 사라지지는 않습니다. 구글이 그 페이지를 다시 크롤링해야 반영되며, 페이지 중요도에 따라 반영까지 몇 달이 걸릴 수 있습니다(구글 검색 센터).
robots.txt로 크롤링 자체를 막은 페이지는 크롤러가 noindex 태그를 읽을 수 없습니다. 이 경우 다른 사이트의 링크를 통해 검색결과에 계속 나타날 수 있습니다.
noindex라는 태그는 왜 생겼나요?
사이트 안 모든 페이지가 검색에 노출될 필요는 없습니다. 얇은 내용의 페이지가 다수 색인되면 사이트 전체 품질 판단에 불리할 수 있어, 특정 페이지를 선택적으로 제외하는 장치가 필요해졌습니다.
내 상황에 적용하려면?
페이지 소스보기에서 robots 메타 태그 값을 확인합니다.
- noindex를 걸 페이지에 robots.txt 차단이 겹쳐 있지 않은지 확인했습니다
- 페이지 소스에서 robots 메타 태그 값을 확인했습니다
- HTML이 아닌 파일은 X-Robots-Tag 헤더로 확인했습니다
- 서치 콘솔에서 색인 상태가 실제로 바뀌었는지 확인했습니다
noindex에 대한 흔한 오해는 무엇인가요?
| 오해 | 실제 |
|---|---|
| 노출이 안 되는 페이지는 다 noindex 때문입니다 | 검색엔진이 아직 그 URL을 발견하지 못한 경우도 있어 사이트맵·내부링크로 발견을 도와야 합니다 |
| noindex와 robots.txt 차단은 같은 효과입니다 | robots.txt는 크롤링을 막고 noindex는 색인만 막아, 둘을 같이 쓰면 noindex 지시를 검색엔진이 못 읽는 문제가 생깁니다 |
검색엔진이 페이지를 수집하는 절차는 색인 항목에서, 크롤링 자체를 제어하는 방법은 robots.txt 항목에서, 중복 페이지를 대표 URL로 정리하는 방법은 canonical 항목에서 다룹니다.
자주 묻는 질문
noindex를 걸면 바로 검색결과에서 사라지나요?
아닙니다. 페이지 중요도에 따라 구글봇이 재방문하기까지 몇 달이 걸릴 수도 있습니다.
robots.txt로 막은 페이지에 noindex를 추가하면 되나요?
효과가 없을 수 있습니다. 색인만 막고 싶다면 크롤링은 허용한 상태에서 noindex를 써야 합니다.
미색인 페이지는 전부 noindex 설정 탓인가요?
아닙니다. noindex 없이도 검색엔진이 아직 그 URL을 발견하지 못해 미색인인 경우가 있습니다.
참고 자료
이 페이지가 도움이 되었나요?
10초면 됩니다 · 남겨주신 의견은 다음 개정에 반영됩니다