속설이 반박보다 오래 사는 이유
살아남는 속설에는 대개 세 가지 우군이 있습니다. 믿는 값이 쌉니다. 실행이 체크박스 하나면 되고 다시 쓰는 일이 아니기 때문입니다. 내 데이터로는 반증할 수 없습니다. 그렇게 하고 나서 순위가 오른 페이지는 안 했더라면 어땠을지 보여줄 수 없으니까요. 그리고 진짜 상관관계에 얹혀 갑니다. 참인 무언가가 바로 옆에 서서, 신뢰를 빌려줄 만큼 가까이 있습니다.
마지막 대목 때문에 정면 반박으로는 좀처럼 죽지 않습니다. 긴 페이지가 짧은 페이지보다 위에 오는 일은 실제로 흔합니다. 다만 길이는 주제를 다 다뤘다는 증상이지 순위의 원인이 아닙니다. 오래된 도메인의 사이트가 실제로 더 잘하는 일도 흔합니다. 링크를 얻고 이력을 쌓을 시간이 더 길었으니까요. 상관관계를 주장에서 떼어내면 대부분은 다툴 거리가 사라집니다.
뒷받침이 없는 온페이지 주장
거의 모든 감사 대화에 등장하며, 실무자들의 의심에 맡겨진 게 아니라 구글이 하나하나 직접 답한 것들입니다.
| 주장 | 문서가 말하는 것 |
|---|---|
| keywords 메타 태그가 도움이 된다 | 순위에 쓰이지 않으며, 2009년부터 그렇게 밝힘 |
| 이상적인 글자 수가 있다 | 최소도 최대도, 목표치가 존재하지 않음 |
| 키워드 밀도에 맞는 수치가 있다 | 그런 수치는 없음. 채워 넣기는 스팸으로 봄 |
| 한 페이지에 H1은 정확히 하나여야 한다 | 어느 수준의 제목이든 여러 개여도 무방 |
| 제목은 엄격한 순서를 지켜야 한다 | 수준을 건너뛰어도 검색에 문제가 되지 않음 |
| «LSI 키워드»를 넣어야 한다 | 구글 시스템이 쓰는 것이 아님 |
제목 항목은 두 번 볼 값이 있습니다. 감사 도구가 가장 크게 해를 끼치는 곳이기 때문입니다. H1이 둘이라고 점수를 깎는 채점기는 검색엔진의 규칙이 아니라 자기 규칙을 보고하는 중입니다. 제목은 그 아래 내용을 설명해야 합니다. 그래야 읽는 사람이 훑기 좋고 기계에 구조가 보이니까요. 잘 쓸 이유는 되지만 숫자를 좇을 이유는 아닙니다.
중복 콘텐츠 페널티
그런 것은 없습니다. 구글의 입장은 같은 내용이 여러 URL 아래 있다는 사실만으로는 사이트에 조치를 취할 근거가 되지 않는다는 것입니다. 의도적으로 속이려는 중복은 별개고요. 보통 벌어지는 일은 통합입니다. 검색엔진이 한 URL을 표준으로 고르고 나머지의 신호를 그 안으로 접어 넣습니다.
그렇다고 중복이 공짜가 되지는 않습니다. 두 가지 방식으로 값을 치르는데, 둘 다 정리의 문제이고 정리로 풀립니다. 한 페이지에 쌓였어야 할 신호가 거의 같은 여러 페이지로 흩어집니다. 그리고 크롤링의 힘이 아무것도 더하지 않는 페이지로 흘러갑니다. 큰 사이트에서는 체감되고 작은 사이트에서는 보이지 않습니다.
이 구분은 붙들 값이 있습니다. 고치는 방법을 통째로 바꾸기 때문입니다. 페널티라면 삭제와 재심사 요청이 필요합니다. 통합이라면 선택을 검색엔진에 맡기지 말고 표준 URL을 직접 선언하는 일이 필요합니다. 태그이지 사과가 아닙니다.
링크, 도메인, 그리고 돈
| 주장 | 문서가 말하는 것 |
|---|---|
| 구글 광고를 사면 자연 검색 순위가 오른다 | 명시적으로 부정. 두 시스템은 별개 |
| 오래된 도메인은 오래돼서 더 잘 나온다 | 도메인 나이 자체는 아무 일도 하지 않음 |
| 도메인에 키워드가 있으면 힘을 받는다 | 효과가 매우 작고, 2012년에 의도적으로 축소 |
| nofollow로 내부 PageRank를 몰아줄 수 있다 | 스컬프팅은 2009년에 끝남. 지금은 힌트 |
| 사이트를 검색엔진에 등록해야 한다 | 필요 없음. 발견은 링크를 따라 이뤄짐 |
| 애널리틱스 데이터가 순위에 들어간다 | 구글은 순위에 애널리틱스를 쓰지 않는다고 밝힘 |
두 가지는 풀어 쓸 값이 있습니다. nofollow는 2019년에 크롤링에서도 순위에서도 지시가 아니라 힌트로 다시 해석됐습니다. 그래서 옛 스컬프팅 요령은 두 번 실패합니다. 아무것도 아껴지지 않고, 링크는 그래도 따라갈 수 있으니까요. 그리고 사람들이 순위 요인이기를 가장 바라는 지표인 이탈률은 요인이 아닙니다. 검색엔진에는 그것에 대한 믿을 만한 접근 수단이 없고, 그렇게 말하고 있습니다.
새 사이트 이야기는 물리치기보다 정직하게 답할 값이 있습니다. 구글은 새 도메인을 붙들어 두는 공식 샌드박스를 운영한다는 것을 부인합니다. 사실인 것은 새 사이트에는 시스템이 따져볼 이력이 거의 없다는 점입니다. 링크도 없고, 누군가를 만족시켰다는 기록도 없습니다. 그것을 모으는 데는 시간이 걸립니다. 기다림은 실재합니다. 사람들이 상상하는 장치가 실재하지 않을 뿐입니다.
AI와 함께 온 새 무리
생성형 검색은 일 년 사이에 새 방법들을 한 무더기 낳았고, 그것들은 틀을 정확히 따릅니다. 받아들이기 싸고, 내 데이터로 반증할 수 없으며, AI 답변이 열 개의 파란 링크와 다르게 움직인다는 진짜 관찰에 실려 있습니다.
- 내 콘텐츠를 언어 모델에 선언하는 파일. 구글은 검색이 llms.txt를 쓰지 않는다고 했고, 그때 끌어온 비유가 keywords 메타 태그였습니다. 내 통제 아래 있고, 나 자신에 대해 주장하며, 검증할 방법이 없는 파일입니다.
- 기계 크기로 미리 잘라 놓은 콘텐츠. 검색 쪽 검색 시스템은 알아서 분절합니다. 앞질러 조각으로 쓰면 그 조각을 읽어야 하는 사람 독자를 잃습니다.
- 기계용으로 쓴 두 번째 버전의 페이지. 현대적 명분을 단 클로킹이며, 두 번째 버전을 크롤러용으로 쓰던 시절과 같은 스팸 정책 위반입니다.
페이지가 AI 답변에 나올 수 있는지를 실제로 정하는 조건은 화려하지 않고 이미 문서에 있습니다. 페이지가 색인에 있어야 하고 스니펫을 보여줄 자격이 있어야 합니다. 기술적 요구는 그게 전부입니다. 그 너머는 예전과 같은 일입니다. 질문에 대한 더 나은 답이 되는 것, 검색엔진이 가져오고 렌더링하고 저장할 수 있는 페이지 위에서요.
돈을 쓰기 전에 주장을 시험하기
대부분 오 분이면 결판나고, 그 습관은 아직 아무도 적지 않은 주장에도 그대로 옮겨 갑니다.
- 1차 출처를 찾으세요. 글을 인용한 글이 강연을 인용한 것은 1차 출처가 아닙니다. 검색엔진 자체 문서나 이름이 붙은 발언이 1차 출처입니다.
- 그 주장이 실제로 무엇에 관한 것인지 확인하세요. 기능에 대한 자격, 순위, 크롤링은 서로 다른 세 가지 결과이고, 조언은 늘 하나를 약속하면서 다른 하나의 증거를 인용합니다.
- 날짜를 확인하세요. 검색은 바뀌고, 2015년에 맞았던 발언이 그 뒤 두 번 뒤집혔을 수도 있습니다.
- 그것이 얹혀 가는 상관관계에 이름을 붙이세요. 그 방법이 진짜 무언가의 증상이라면, 진짜인 쪽을 하면 증상은 따라옵니다.
- 틀렸을 때의 값을 매기세요. 싸고 해롭지 않으면 감으로 남겨도 되고, 스프린트를 먹는 것에는 1단계에서 찾은 출처가 필요합니다.