검색엔진(Search Engine)은 웹에 흩어진 문서를 수집해 분석·저장해 두었다가, 사용자가 검색어를 입력하면 그중 가장 적합한 문서를 골라 순서대로 보여주는 시스템입니다. 구글·네이버·빙이 대표적이고, 최근에는 문서 목록 대신 답을 직접 써 주는 생성형 엔진도 같은 자리를 차지하고 있습니다.
검색엔진은 “검색창이 있는 사이트”가 아니라 세 가지 일을 하는 시스템을 가리킵니다. 문서를 찾아 오고, 내용을 이해해 저장하고, 질문에 맞춰 순서를 매기는 일입니다.
구글 검색 센터 문서는 이 과정을 크롤링, 색인 생성, 검색결과 게재의 세 단계로 설명합니다. SEO에서 다루는 거의 모든 문제는 이 세 단계 중 어디에서 막혔는지로 정리됩니다.
| 단계 | 하는 일 | 여기서 막히면 |
|---|---|---|
| 크롤링 | 페이지를 찾아 내용을 내려받는다 | 존재 자체를 모른다 |
| 색인 생성 | 내용을 분석해 데이터베이스에 저장한다 | 검색 대상에 들어가지 못한다 |
| 검색결과 게재 | 질문에 맞는 문서를 골라 순서를 매긴다 | 있지만 뒤로 밀린다 |
순서가 중요합니다. 앞 단계가 안 되면 뒤 단계는 시작조차 하지 않습니다. 순위가 안 오른다고 콘텐츠부터 손대는 경우가 많은데, 색인이 안 된 페이지라면 아무리 잘 써도 소용이 없습니다.
각 단계는 보장되지 않습니다. 같은 구글 문서는 “구글은 검색 센터의 기본 지침을 따른 페이지라도 크롤링·색인·게재를 보장하지 않는다”고 적고 있고, 돈을 받고 더 자주 크롤링하거나 순위를 올려 주지도 않는다고 밝힙니다. 규모도 짐작해 둘 만합니다. 구글은 공식 소개 페이지에서 자사 색인이 수천억 개의 웹페이지를 담고 있고 크기가 1억 GB(100,000,000기가바이트)를 훨씬 넘는다고 설명합니다. 전 세계 점유율로 보면 StatCounter의 2026년 8월 집계에서 구글이 91.1%, 빙이 4.5%, 야후가 1.23%입니다. StatCounter는 자사 추적 코드가 설치된 사이트로 들어온 검색 유입을 세는 방식이라 국가별·서비스별로 편차가 있고, 이 수치는 전 세계 합산 값입니다.

웹에 같은 주제를 다룬 문서가 수없이 많기 때문입니다. 검색엔진의 일은 “관련 있는 문서를 전부 보여주기”가 아니라 “가장 도움이 될 문서를 앞에 두기”입니다. 사용자가 첫 화면에서 답을 찾지 못하면 그 검색엔진을 떠나기 때문에, 순서를 잘 매기는 것이 곧 서비스의 품질입니다.
그래서 검색엔진은 문서의 내용뿐 아니라 누가 썼는지, 다른 사이트가 이 문서를 얼마나 참조하는지, 사용자가 어떤 기기에서 보는지 같은 신호를 함께 봅니다. SEO는 이 신호들을 정확하게 전달하는 일입니다.
순위 경쟁의 결과는 한쪽으로 크게 쏠립니다. SEO 도구 업체 Ahrefs가 자사 콘텐츠 데이터베이스의 페이지 약 140억 개를 분석한 자료(2023년 12월 갱신)에서 96.55%는 구글 검색 유입이 0이었고, 1.94%는 월 1~10회에 그쳤습니다. 영어권 페이지가 대부분인 데이터라 국내 사이트에 그대로 옮길 수는 없고, 국내 공개 조사는 아직 없습니다. 다만 색인에 들어가는 것과 검색 유입을 얻는 것 사이에 큰 간격이 있다는 점은 분명히 보여줍니다.

구글은 검색어의 의미, 콘텐츠의 관련성, 품질, 사용성, 사용자의 맥락이라는 다섯 가지 묶음으로 순위를 매긴다고 공개합니다. 구글의 검색 작동 방식 소개 페이지와 검색 센터 문서는 관련성을 판단하는 요소가 “수백 가지”이며 위치·언어·기기 같은 정보가 포함될 수 있다고 설명합니다. 개별 요소의 가중치는 공개하지 않습니다.
| 구글이 밝힌 요소 | 보는 것 | 사이트가 할 일 |
|---|---|---|
| 검색어의 의미 | 검색어 뒤의 의도, 오타·동의어 | 사용자가 실제로 쓰는 표현을 파악한다 |
| 관련성 | 검색어와 같은 단어가 들어 있는지를 출발점으로 한 내용 일치도 | 제목·본문에 핵심 표현을 분명히 쓴다 |
| 품질 | 관련 문서 중 가장 도움이 되는 것, 전문성·신뢰성 신호 | 근거와 출처가 있는 글을 쓴다 |
| 사용성 | 다른 신호가 비슷할 때 더 쉽게 볼 수 있는 페이지 | 모바일 화면·로딩 속도를 챙긴다 |
| 맥락과 설정 | 위치, 검색 기록, 검색 설정 | 지역 정보 등을 정확히 적는다 |
이 기준은 계속 바뀝니다. 구글은 2023년 한 해 동안 검색 품질 테스트 719,326건(실사용자 대상 실험 16,871건, 결과 비교 실험 124,942건 포함)을 돌려 4,781건의 변경을 적용했다고 밝혔습니다. 하루 평균 10건이 넘는 변경이 반영되는 셈이라, 특정 요령보다 위 다섯 가지 원칙에 맞추는 편이 오래갑니다.
광고 영역은 돈을 내고 사는 자리이고, 자연 검색(오가닉) 영역은 위의 순위 기준으로만 정해지는 자리입니다. 검색엔진의 주 수입원은 검색 결과에 붙는 광고이고, 광고주는 대개 클릭당 비용을 냅니다. 반면 자연 검색 순위는 앞서 본 것처럼 구글이 돈을 받고 올려 주지 않는다고 명시한 영역입니다.
| 검색 광고 | 자연 검색 | |
|---|---|---|
| 노출 방식 | 입찰과 광고 품질로 결정 | 검색엔진의 순위 기준으로 결정 |
| 비용 | 클릭 등 성과마다 지불 | 노출·클릭 자체는 무료 |
| 표시 | “스폰서” 등 광고 표시가 붙는다 | 표시 없음 |
| 멈추면 | 예산이 끝나는 즉시 사라진다 | 순위가 유지되는 동안 유입이 이어진다 |
| 담당 분야 | SEM·검색 광고 | SEO |
둘은 서로의 순위에 영향을 주지 않습니다. 구글의 존 뮬러는 광고 순위와 검색 순위가 “완전히 분리된 시스템”이라고 답했고, Search Engine Journal도 구글 측 발언을 정리해 광고 집행은 순위 신호가 아니라고 결론 내렸습니다. 광고비를 많이 쓴다고 자연 검색 순위가 오르지는 않습니다. 그래서 SEO 성과를 볼 때는 광고 유입을 빼고 자연 검색 유입만 따로 봐야 합니다.

기존 검색엔진은 문서 목록을 돌려주고 고르는 일은 사용자에게 맡깁니다. 반면 ChatGPT나 구글 AI 오버뷰 같은 생성형 엔진은 여러 문서를 읽고 답 자체를 써서 보여준 뒤 근거가 된 출처를 답니다.
| 검색엔진 | 생성형 엔진 | |
|---|---|---|
| 결과물 | 문서 목록 | 작성된 답변 + 출처 |
| 사용자가 하는 일 | 목록에서 고른다 | 답을 읽는다 |
| 사이트의 목표 | 상위 노출 | 답변 안의 인용 |
다만 둘은 별개가 아닙니다. 생성형 엔진도 답을 쓰려면 먼저 문서를 크롤링하고 색인해야 합니다. 앞의 세 단계는 양쪽에 똑같이 적용됩니다.
업종에 따라 답이 갈립니다. 네이버는 자체 색인과 자체 순위 로직을 쓰고, 블로그·카페·플레이스 같은 자사 서비스를 검색 결과에 섞어 보여줍니다. 구글에서 통하는 방법이 네이버에서 같은 효과를 내지 않는 경우가 많습니다.
B2B나 기술 제품처럼 검색어가 전문적일수록 구글 비중이 커지고, 지역 기반 서비스나 소비재는 네이버 비중이 큽니다. 어느 쪽 유입을 먼저 챙길지는 실제 유입 데이터를 보고 정합니다.
컨설턴트의 실전 팁
구글과 네이버를 함께 맡으면 저는 구글을 기준으로 잡습니다. 어느 검색엔진 유입이 더 중요하냐는 우선순위의 문제가 아닙니다. 글의 품질과 작성 기준을 구글 쪽에 맞춘다는 뜻입니다. 구글 기준으로 잘 쓴 글은 네이버에서도 크게 어긋나지 않습니다.
네이버를 위해 글을 따로 쓰지는 않습니다. 같은 사이트 안에서 페이지끼리 같은 검색어를 두고 겹치지 않도록(키워드 카니발리제이션) 타이틀을 조금 바꿔 주는 정도로 대응합니다.