AI 검색 노출 용어사전
25개 · 공식 문서 기준 정의
AI 검색
AI 개요AI Overviews
구글 검색 결과 맨 위에 AI가 생성해 보여주는 요약과 참조 링크.
여러 검색을 실행해 합성한 답변이며, 기존 검색에 도움이 된다고 판단할 때만 표시된다. 구글은 AI 개요에 표시되기 위한 별도 요구사항이 없다고 밝힌다.
AI 모드AI Mode
구글 검색에서 대화형으로 질문을 이어가는 AI 답변 화면.
AI 개요와 같은 검색 확장 기법을 쓰지만 다른 모델과 기법이 쓰일 수 있어 표시되는 링크 집합이 다를 수 있다.
검색 확장query fan-out
AI가 질문을 여러 하위 주제로 쪼개 관련 검색을 여러 번 실행한 뒤 합치는 기법.
병원 정보가 지역·과목 검색과 병원명 검색 양쪽에서 읽히고 한 답변에 섞이는 이유다. 여러 곳의 값이 다르면 AI는 그중 하나를 고르거나 섞는다.
ChatGPT 검색ChatGPT search
ChatGPT가 웹을 검색해 답하고 출처 링크를 붙이는 기능.
OpenAI의 검색용 크롤러(OAI-SearchBot)가 읽을 수 있는 사이트만 표시된다. 메디스펙 데이터랩의 인용 측정은 이 기능을 켠 상태에서 답변을 관측한다.
인용citation
AI 답변이 근거로 붙인 출처 링크.
데이터랩에서 인용은 답변 본문에 나타난 출처 URL을 뜻한다. 같은 질문에 여러 출처가 붙을 수 있고, 출처 없이 답하는 경우도 있다.
GEOGenerative Engine Optimization
생성형 AI 답변에 사이트가 인용되게 하려는 활동을 가리키는 업계 용어.
구글·OpenAI·네이버 공식 문서에는 이 말이 없다. 문서가 요구하는 것은 색인될 수 있는 페이지, 텍스트로 된 정보, 크롤러 허용 같은 검색 기본이다.
크롤러·접근
크롤러crawler
웹 페이지를 자동으로 읽어 가는 프로그램. 검색로봇이라고도 부른다.
검색엔진과 AI 서비스는 각자 크롤러를 두며, robots.txt로 허용과 차단을 정한다. 어떤 크롤러를 막았는지에 따라 검색·AI 노출이 달라진다.
OAI-SearchBot
OpenAI의 검색 노출용 크롤러. 이 봇을 거부한 사이트는 ChatGPT 검색 답변에 표시되지 않는다.
학습용 GPTBot과 별개로 제어된다. 검색에 나오고 싶으면 robots.txt에서 허용하고 공개 IP 대역의 요청을 막지 않아야 한다.
ChatGPT-User
이용자가 ChatGPT에서 링크를 열거나 답을 요청할 때 페이지를 가져오는 요청.
이용자가 시작한 동작이라 robots.txt 규칙이 적용되지 않을 수 있다고 OpenAI가 밝힌다. 봇 차단 솔루션이 이 요청을 막으면 이용자 앞에서 페이지가 열리지 않는다.
GPTBot
OpenAI의 모델 학습용 수집 크롤러.
GPTBot을 차단하면 사이트 콘텐츠를 학습에 쓰지 말라는 뜻이며, 검색 노출(OAI-SearchBot)과는 독립적이다. 학습만 거부하고 검색은 허용할 수 있다.
Googlebot
구글 검색의 크롤러. AI 개요·AI 모드도 이 크롤러가 읽은 페이지를 쓴다.
크롤링 접근은 robots.txt의 Googlebot 지침으로 관리한다. 다른 구글 시스템의 AI 학습·그라운딩 제한은 Google-Extended라는 별도 토큰으로 한다.
Yeti
네이버 검색로봇의 이름.
robots.txt에서 Yeti 또는 전체 로봇에 Allow를 설정하라고 네이버가 안내한다. 차단이 필요해도 IP 기준이 아니라 robots.txt로 하라고 명시한다.
robots.txt
사이트 루트에 두는 텍스트 파일로, 크롤러별 허용·차단을 적는다.
홈페이지 주소 뒤에 /robots.txt 를 붙이면 누구나 볼 수 있다. 'AI 봇 전부 차단' 한 줄이 남아 있으면 검색 노출까지 함께 막히므로 용도별로 나눠 적는다.
발신 IP 검증IP range verification
요청의 발신 IP를 벤더가 공개한 대역과 대조해 진짜 크롤러인지 확인하는 방법.
유저 에이전트 문자열은 누구나 흉내 낼 수 있어 IP 대조가 필요하다. 메디스펙 데이터랩의 AI 봇 방문 집계는 검증을 통과한 요청만 센다.
색인·구조
색인indexing
검색엔진이 페이지를 읽어 검색 결과에 낼 수 있도록 저장하는 일.
구글 AI 기능에 참조 링크로 뜨려면 페이지가 색인돼 있어야 한다. 서치콘솔 URL 검사에서 우리 병원 페이지가 색인되는지 확인할 수 있다.
noindex
이 페이지를 검색에 넣지 말라는 메타 태그 또는 헤더.
제작 과정에서 남은 noindex 한 줄이면 검색과 AI 기능에서 페이지가 빠진다. 페이지 소스에서 의도된 설정인지 확인한다.
nosnippet
검색 결과와 AI 기능에 표시되는 페이지 정보를 제한하는 컨트롤.
data-nosnippet, max-snippet과 함께 구글이 제공하는 미리보기 제어 장치다. 노출 제한용이며 정보 정정에는 쓰이지 않는다.
구조화 데이터structured data
페이지 정보를 검색엔진이 읽기 쉬운 형식(schema.org)으로 함께 적는 마크업.
구글은 구조화 데이터가 화면에 보이는 텍스트와 일치해야 한다고 한다. AI 기능을 위해 별도로 추가해야 하는 schema.org 데이터는 없다.
서치콘솔Google Search Console
구글이 제공하는 무료 사이트 관리 도구.
URL 검사로 색인 여부를 확인하고 재크롤링을 요청할 수 있다. AI 기능에서 온 방문은 실적 보고서의 '웹' 검색 유형에 섞여 보고된다.
서치어드바이저Naver Search Advisor
네이버가 제공하는 사이트 등록·소유 확인·사이트맵 제출 도구.
소유 확인은 병원 명의 계정으로 해 두는 게 나중 비용을 줄인다. 검색 반영은 로봇 방문 후 최대 1주일이라고 네이버가 안내한다.
비즈니스 프로필Google Business Profile
구글 지도·검색에 표시되는 사업자 정보 등록 도구.
구글은 비즈니스 프로필 정보를 최신으로 유지하라고 권장한다. 홈페이지·외부 정보 페이지와 같은 값이어야 AI가 합성한 답변에 같은 정보가 들어간다.
재크롤링recrawl
바뀐 페이지를 검색엔진이 다시 읽어 가는 일.
구글은 재크롤링이 며칠에서 몇 달까지 걸릴 수 있다고 한다. 정보를 바꾼 날 서치콘솔에서 요청하고, 다른 채널의 정보도 같은 날 함께 바꾼다.
측정
AI 인용 인덱스
메디스펙 데이터랩이 격주로 내는 AI 검색 인용 출처 성적표.
질문 500개(지역 100 × 과목 5)를 ChatGPT 웹검색에 묻고 답변이 인용한 출처를 집계한다. 병원 실명 순위는 내지 않고, 메디스펙 및 운영에 관여한 사이트는 순위에서 제외한다.
회차
질문 500개를 한 바퀴 다 묻는 측정 단위.
회차 번호는 바뀌지 않으며 각 호는 그 회차의 기록이다. 회차 간 비교는 잠정 오차범위 밖의 변동만 서술한다.
출처 유형
인용된 도메인을 성격별로 묶은 분류.
리뷰·예약 플랫폼, 지역·과목별 의료 정보 사이트, 의료 매체·공공기관, 블로그·카페, 기타로 나눈다. 병원 자사 사이트는 실명 대신 하나로 묶어 집계한다.