Deepindex Lab
← 기술 블로그

저품질 링크의 지문: 구글이 걸러내는 링크 패턴

“절대 안 걸리는 백링크”를 내세우는 판매자들이 있습니다. 그 주장을 평가하려면 반대편, 즉 구글이 무엇을 어떻게 걸러내는지를 알아야 합니다. 필터의 원리를 알면 판매자의 말이 아니라 지면 자체를 보고 판단할 수 있게 됩니다. 구글은 링크 스팸의 유형을 공식 문서에 명시해 두었고, 2021년 이후로는 이를 식별하는 전용 알고리즘(SpamBrain 계열)을 상시 가동하고 있습니다. 이 글은 그 필터가 잡아내는 공통 지문을 정리합니다.

공식 문서가 명시한 링크 스팸

구글 웹 검색 스팸 정책의 링크 스팸 항목은 구체적입니다. 순위 조작 목적의 링크 매매(금전, 물품, 서비스 대가 포함), 과도한 상호 링크 교환, 자동화 프로그램에 의한 링크 생성, 키워드 앵커로 도배된 대규모 기고 캠페인, 저품질 디렉토리·북마크 사이트 링크, 위젯에 심어 배포되는 링크, 여러 사이트 푸터에 광범위하게 박히는 링크, 포럼 서명·댓글 스팸이 전부 열거되어 있습니다. 요컨대 “편집자가 콘텐츠 가치 때문에 걸어준 링크”가 아닌 모든 인위적 경로가 정책상 스팸이며, 목록은 예시일 뿐 취지가 같다면 새로운 수법도 같은 정책의 적용을 받습니다.

중요한 것은 처벌 방식의 변화입니다. 과거에는 페널티(순위 강등)가 주된 대응이었다면, 지금의 기본 대응은 **무효화(devaluation)**입니다. 스팸으로 분류된 링크는 조용히 계산에서 제외됩니다. 판매자와 구매자는 아무 일도 없다고 느끼지만, 실제로는 돈이 아무 효과 없는 링크에 나가고 있는 상태. 이것이 “안 걸리는 링크”의 흔한 실체입니다.

겉보기에 같은 링크들 중 스팸 지문이 찍힌 것들이 걸러지는 구도

알고리즘이 잡는 지문들

개별 링크가 아니라 패턴을 보면 스팸은 지문을 남깁니다.

  • 출처 사이트의 프로필: 트래픽이 없는데 아웃바운드 링크만 많은 사이트, 주제가 잡탕인 사이트(대출·카지노·건강·SEO가 한 블로그에), 서로를 순환 참조하는 사이트군. 링크를 파는 지면은 개별 링크보다 지면 자체가 먼저 식별되고, 그 순간 거기 실린 모든 링크가 함께 무효화됩니다.
  • 문맥 부재: 본문 주제와 무관하게 삽입된 링크, 문단 흐름을 끊는 앵커. 언어 모델 기반 분석이 강해진 지금, 문맥 불일치는 과거보다 훨씬 정밀하게 잡힙니다. 여행 글 한가운데 갑자기 등장하는 대출 앵커 같은 고전적 사례는 이제 기계가 사람보다 빨리 찾아냅니다.
  • 획일성: 같은 앵커, 같은 문장 구조, 같은 게재 형식, 비슷한 글 길이의 반복. 사람 백 명의 자발적 링크는 절대 이렇게 균일하지 않고, 균일함은 곧 한 명의 기획자가 있었다는 증거입니다.
  • 네트워크 흔적: 같은 소유자의 사이트군에서 나오는 링크들은 호스팅, 템플릿, 등록 정보, 링크 구조의 유사성으로 군집이 드러납니다.
  • 시간 패턴: 여러 사이트에서 같은 시기에 일괄 게재되고 일괄 삭제되는 링크들은 거래의 시간표를 그대로 남깁니다.

무효화와 수동 조치는 다르다

여기서 두 가지 결과를 구분해둘 필요가 있습니다. 무효화는 알고리즘이 링크를 조용히 0으로 계산하는 것으로, 통지도 페널티도 없습니다. 투자 손실이지 사고는 아닙니다. 수동 조치는 구글 직원이 검토 후 서치콘솔로 통지하는 제재로, 순위 강등이나 색인 제외가 따르며 재검토 요청으로만 풀립니다. 수동 조치는 링크 몇 개로 발생하지 않고, 명백하고 대규모의 조작 패턴에서 나옵니다. 그래서 실무 리스크 평가의 질문은 “이 링크가 걸릴까”가 아니라 “내 링크 프로필 전체가 캠페인의 지문을 남기고 있나”가 되어야 합니다. 개별 링크의 은닉 기술을 파는 판매자보다, 프로필 전체의 자연스러움을 관리하는 파트너가 필요한 이유입니다.

구매자가 스스로를 지키는 검수 기준

링크 게재를 검토할 때 다음을 확인하면 위 지문의 대부분을 피할 수 있습니다. 게재 사이트에 실제 검색 트래픽이 있는가(추정 트래픽 0은 무효화된 사이트의 대표 증상), 최근 글들이 색인되고 있는가, 사이트의 주제가 일관되며 내 주제와 접점이 있는가, 내 링크가 실릴 글이 그 자체로 읽을 만한가, 그리고 앵커텍스트를 내가 다양하게 지정할 수 있는가입니다.

검수를 통과한 지면이라도 시간이 지나 변질될 수 있다는 점은 감안해야 합니다. 운영자가 바뀌며 링크 판매장이 되거나, 콘텐츠 갱신이 끊겨 색인이 빠지는 사이트가 나옵니다. 그래서 링크 포트폴리오는 매입 시점의 검수와 별개로 반기 정도의 주기로 재점검할 가치가 있습니다. 유실되거나 변질된 링크를 파악하고 있어야 프로필의 실제 상태를 알 수 있습니다.

마지막으로 균형을 위해 덧붙이면, 이 필터들의 목적은 링크 빌딩의 근절이 아니라 신호 품질의 유지입니다. 색인된 지면, 관련 있는 주제, 자연스러운 문맥, 다양한 앵커라는 기본기를 지킨 링크는 분류상 스팸 지문이 없고, 그래서 계속 작동합니다. Deepindex Lab의 게재 기준이 이 검수 항목들과 일치하는 것은 우연이 아닙니다. 구글의 필터를 피하는 방법을 연구하는 것보다, 필터가 통과시키도록 설계된 것을 만드는 편이 유일하게 지속 가능한 전략이기 때문입니다.