고아 페이지(Orphan Page)는 같은 웹사이트의 다른 어떤 페이지에서도 내부 링크를 받지 못해, 검색엔진 크롤러와 방문자가 링크를 따라서는 도달할 수 없고 URL을 직접 알거나 사이트맵, 외부 링크를 거쳐야만 닿을 수 있는 페이지다.
Ahrefs는 고아 페이지를 “사이트의 다른 곳에서 오는 내부 링크가 없어 검색엔진이 발견하기 어려울 수 있는 페이지”로 정의한다 (Ahrefs, How to Find and Fix Orphan Pages).
페이지 자체에는 아무 문제가 없어도 고아가 될 수 있다. 문제는 페이지가 아니라 그 페이지로 가는 길이 없다는 데 있다.
검색엔진이 페이지를 발견하는 주된 경로가 링크이고, 페이지의 중요도를 가늠하는 신호도 링크이기 때문이다. 고아 페이지는 두 가지를 모두 잃는다.
첫째는 발견이다.
구글은 크롤링 단계를 설명하면서 새 페이지는 이미 파악된 페이지에서 새 페이지로 연결되는 링크를 추출할 때 발견되고, 일부는 사이트 소유자가 제출한 사이트맵으로 발견된다고 밝힌다 (Google 검색 센터, Google 검색의 작동 방식). 내부 링크도 없고 사이트맵에도 없는 페이지는 구글이 존재 자체를 모를 수 있다.
둘째는 평가다. 구글은 링크를 신호로 사용해 페이지의 관련성을 파악하고 크롤링할 새 페이지를 찾는다고 적는다 (Google 검색 센터, Google의 링크 권장사항). 내부 링크가 없으면 사이트 안에서 흐르는 페이지랭크를 받지 못하고, 앵커 텍스트로 전달되는 주제 신호도 없다.
셋째는 사람이다. 메뉴나 본문 링크로 닿을 수 없는 페이지는 방문자도 찾지 못하므로, 색인이 되더라도 사이트 안에서 이어지는 유입이 없다.
방향이 반대다. 고아 페이지는 들어오는 내부 링크가 없는 페이지이고, 데드엔드 페이지는 나가는 링크가 없는 페이지다.
| 구분 | 고아 페이지 | 데드엔드 페이지 | 깊은 페이지 |
|---|---|---|---|
| 상태 | 들어오는 내부 링크 0개 | 나가는 링크 0개 | 링크는 있으나 홈에서 클릭 수가 많음 |
| 크롤러 관점 | 링크로는 발견 불가 | 발견되지만 다음으로 못 감 | 발견되지만 늦게, 드물게 옴 |
| 주된 해결 | 관련 페이지에서 링크 추가 | 본문과 내비게이션에 링크 추가 | 상위 허브에서 링크 추가 |
도구에 따라 판정 범위도 다르다. 어떤 도구는 사이트맵에 있는데 내부 링크가 없는 URL만 고아로 보고, 어떤 도구는 백링크나 애널리틱스 데이터에서만 발견된 URL까지 포함한다.
대부분 실수로 생긴다. Ahrefs는 가장 흔한 원인으로 사이트 이전, 내비게이션 변경, 사이트 리디자인, 품절 상품 처리, 테스트와 개발용 페이지에 대한 절차가 없는 것을 꼽는다 (Ahrefs, How to Find and Fix Orphan Pages).
의도적으로 만드는 경우도 있다. 광고 전용 랜딩 페이지처럼 사이트 내 동선에 넣고 싶지 않은 페이지가 그렇다. 이런 페이지는 고칠 대상이 아니고, 검색에 나올 필요가 없다면 noindex를 붙여 두면 된다.
링크를 따라가는 크롤링으로 얻은 URL 목록과, 링크와 무관하게 얻은 URL 목록을 대조한다. 뒤쪽 목록에만 있는 URL이 고아 페이지 후보다.
가장 정확한 2번 자료는 서버 로그다. 크롤러와 방문자가 실제로 요청한 URL이 전부 남기 때문이고, 사이트맵에도 없고 백링크도 없는 고아 페이지는 로그 파일 분석이나 CMS 내보내기로만 잡힌다. Ahrefs도 자사 사이트 감사 도구가 백링크나 사이트맵으로 발견된 고아 페이지만 보여 준다고 한계를 적어 둔다.
2026년 10월 6일 이 위키의 용어 문서 126편을 전부 내려받아 문서끼리 주고받는 내부 링크를 집계했다. 목록 페이지(/wiki/)에서 오는 링크는 빼고 셌다.
| 항목 | 값 |
|---|---|
| 조사한 문서 | 126편 |
| 목록 페이지에서 링크되는 문서 | 126편 (완전한 고아 페이지 0편) |
| 다른 문서에서 오는 링크가 0개인 문서 | 21편 (16.7%) |
| 문서당 유입 링크 중앙값 | 4개 |
| 유입 링크가 가장 많은 문서 | /wiki/geo/ (58개 문서에서 링크) |
완전한 고아 페이지는 없었지만 21편은 목록 페이지 하나에만 매달려 있었다. 목록 구조가 바뀌거나 페이지네이션이 생기면 바로 고아가 되는 상태다.
21편 가운데 15편은 조사일 기준 최근 열흘 안에 발행한 문서였다. 문서를 발행할 때 새 문서에서 나가는 링크만 넣고, 기존 문서에서 새 문서로 들어오는 링크는 넣지 않았기 때문이다.
페이지의 가치에 따라 링크를 걸거나, 합치거나, 지운다. 모든 고아 페이지에 링크를 거는 것이 답은 아니다.
| 페이지 상태 | 처리 |
|---|---|
| 검색 유입이나 전환 가치가 있음 | 주제가 맞는 페이지 본문과 상위 카테고리에서 내부 링크 추가 |
| 내용이 다른 페이지와 겹침 | 대표 페이지로 합치고 301 리디렉션 |
| 가치가 없고 대체 페이지도 없음 | 삭제하고 404 또는 410 응답, 사이트맵에서 제거 |
| 의도적으로 분리한 랜딩 페이지 | 그대로 두고 필요하면 noindex |
링크를 걸 때는 푸터에 한 줄 몰아넣는 방식보다 주제가 이어지는 본문 안에서 설명이 되는 앵커 텍스트로 거는 편이 낫다. 구글은 href 속성이 있는 <a> 요소만 안정적으로 크롤링할 수 있다고 밝히므로, 자바스크립트 클릭 이벤트로만 이동하는 링크는 내부 링크로 치지 않는 것이 안전하다 (Google 검색 센터, Google의 링크 권장사항).
사이트맵에 넣는 것만으로는 반쪽 해결이다. 구글은 페이지가 500개 이하이고 내부적으로 긴밀히 연결된 사이트는 사이트맵이 필요하지 않을 수 있다고 설명하는데, 홈페이지에서 시작되는 링크를 따라 중요한 페이지를 모두 발견할 수 있기 때문이다 (Google 검색 센터, 사이트맵이란 무엇인가요?).
구글이 기본으로 삼는 발견 경로는 링크이고 사이트맵은 보조라는 뜻이다. 사이트맵은 발견은 도와도 내부 링크가 전달하는 중요도 신호는 대신하지 못한다.
재발을 막으려면 발행 절차에 한 단계를 넣는다. 새 페이지를 낼 때 그 페이지로 링크할 기존 페이지를 두세 개 정해 함께 고치고, 사이트 개편 전후로 크롤링 결과를 비교해 유입 링크가 0이 된 URL을 확인한다.
Screaming Frog SEO Spider, Ahrefs Site Audit, Semrush Site Audit 같은 사이트 감사 도구가 고아 페이지 보고서를 제공한다. 도구는 사이트맵, 애널리틱스, 서치 콘솔, 백링크 같은 추가 URL 출처를 연결해야 고아 페이지를 찾을 수 있고, 링크만 따라가는 기본 크롤링으로는 원리상 하나도 찾지 못한다.
도구가 사이트맵이나 백링크로 그 URL을 알게 됐지만, 사이트를 크롤링하는 동안 그 URL로 가는 내부 링크를 하나도 만나지 못했다는 뜻이다. 링크가 자바스크립트로만 만들어지거나 크롤링 범위 밖 페이지에만 있을 때도 같은 경고가 뜨므로, 고치기 전에 실제로 링크가 없는지 페이지 소스에서 확인한다.
서치폴라리스가 AI 검색 가시성을 진단하고 GEO 실행까지 대행합니다.