블로그/코멘터리· 9분 소요

AI 검색은 브랜드 자사 사이트를 인용할까? 뷰티 인용 3,814건을 측정했습니다

Yong Suk Choi, Chief Business Officer, BAZZAAL

작성자

최용석

커버 이미지 - AI 검색은 브랜드 자사 사이트를 인용할까? 뷰티 인용 3,814건을 측정했습니다

요즘 국내 에이전시들이 파는 AI 검색 체크리스트는 대체로 같습니다. 스키마를 붙이고, llms.txt를 올리고, 이미지형 상세페이지를 텍스트로 바꾸라는 것. 그 권고의 근거가 되는 연구를 일주일 동안 직접 읽고, K-뷰티 미국 자사몰을 대상으로 저희 나름의 측정을 돌렸습니다. 체크리스트의 대부분은 아직 입증되지 않았거나 이미 검증되어 기각된 항목이었습니다. 반대로 검증을 통과한 부분은 거의 아무도 보지 않는 곳을 가리키고 있었습니다.

확인한 것은 네 가지입니다. 대부분의 팀이 쓰는 "빅4" 프레임은 이미 낡았습니다. 저희가 테스트한 AI 크롤러는 전부 자사 사이트 본문을 온전히 받아갔고, 따라서 접근성은 애초에 병목이 아니었습니다. 시중에서 팔리는 최적화 기법은 통제 조건에서 재현했을 때 대체로 작동하지 않았습니다. 그리고 뷰티 카테고리에 한정하면, AI 엔진이 실제로 읽는 것 중 브랜드 자사 사이트는 2.4%에 불과합니다.

2026년, 어떤 AI 엔진이 실제로 중요한가?

어떤 AI 엔진이 중요하냐고 물으면 대부분 ChatGPT, Gemini, Claude, Perplexity를 꼽습니다. 2026년 2월 Pew Research가 미국 성인 5,119명에게 물은 결과는 그 순서가 아닙니다.

미국 성인의 AI 챗봇 사용 경험 비율 막대그래프. ChatGPT 44%, Gemini 24%, Copilot 17%, Meta AI 14%, Grok 8%, Claude 6%, Character.ai 3%

Meta AI는 오픈웨이트 모델인 Llama 기반이고, Grok과 Claude를 합친 것보다 더 많은 미국 성인에게 닿아 있습니다.

순위보다 중요한 것은 오픈웨이트 진영이 자체 검색을 짓고 있다는 사실입니다. Mistral은 공식 문서에 크롤러를 두 종으로 나눠 두었습니다. 실시간 답변용과 자체 검색 인덱스용입니다. Meta의 크롤러 문서에는 Meta-WebIndexer가 올라와 있고, 설명이 "Meta AI 검색 결과 품질 향상을 위해 웹을 크롤하고 인용·링크한다"입니다. Alibaba는 Qwen용 TongyiBot을 돌립니다. Anthropic은 Claude-SearchBot을, OpenAI는 광고 랜딩 검증용 봇을 새로 추가했습니다.

그래서 직접 물어봤습니다. 각 사업자가 공개한 user-agent 문자열로 저희 홈페이지를 그대로 요청해 봤습니다.

AI 크롤러 6종이 bazzaal.com을 요청해 전부 HTTP 200과 본문 2,357단어를 받아간 결과 표

케이스 스터디 내부 페이지도 결과가 같았습니다. robots.txt는 전체 허용 한 줄이라 따로 설정할 것이 없었습니다.

다만 짚어야 할 구조가 하나 있습니다. Llama·Qwen·DeepSeek 가중치를 받아 자체 호스팅하면 그 모델은 웹을 아예 보지 못합니다. 무엇을 인용할지는 거기에 붙이는 검색 계층(주로 Brave, Exa, Tavily, Serper, Bing)이 결정합니다. 즉 "Llama에 최적화한다"는 개념은 존재하지 않습니다. 까다로운 쪽은 Brave입니다. 자사 문서에 "차별을 피하기 위해 크롤러가 식별 가능한 user-agent를 광고하지 않는다"고 명시돼 있어서, 서버 로그만으로는 그 인덱스에 들어가 있는지 확인할 방법이 없습니다.

AI 엔진들은 같은 출처를 인용할까?

어려운 부분은 접근이 아니라 선택입니다. 그리고 엔진들은 누구를 고를지에 대해 거의 합의하지 않습니다.

AI 엔진 쌍별 인용 도메인 겹침 지표. Jaccard 0.119~0.237, 네 엔진이 모두 합의한 출처는 3.8%

Writesonic이 프롬프트 161,286개를 네 엔진에 동시에 돌렸고, 그중 70,879개가 네 엔진 모두에서 인용을 반환해 비교군이 됐습니다.

왼쪽과 오른쪽을 같이 봐야 합니다. 가장 가까운 쌍인 Perplexity와 Google AI 개요조차 인용 도메인의 4분의 1이 안 되는 범위만 공유합니다. ChatGPT와 Gemini는 12%입니다. 어디든 인용된 도메인의 약 4분의 3은 단 하나의 엔진에만 등장합니다. 여러 엔진을 뭉뚱그린 단일 "AI 가시성 점수"는 사실상 의미가 없고, 한 엔진에 맞춘 최적화가 다른 엔진으로 옮겨가리라는 기대도 근거가 없습니다. 그 기대의 상한이 3.8%입니다.

llms.txt는 효과가 있을까? 스키마는 AI 인용을 늘릴까?

여기가 불편한 대목입니다. 저희도 그중 일부를 막 도입하려던 참이었기 때문입니다.

GEO 원논문은 인용되는 것과 다른 말을 하고 있습니다. Aggarwal 외(KDD 2024)가 보고한 "최대 40% 개선"은 지금 국내 제안서마다 등장합니다. 그런데 그 숫자는 트래픽이 아닙니다. 이미 상위 5개 후보로 검색된 출처들끼리 나눠 갖는 가시성 점유율입니다. 같은 논문에서 키워드 스터핑은 19.3에서 17.7로 오히려 떨어졌고, "권위 있는 어조"는 저자들이 직접 유의미한 개선이 없다고 기각했습니다. 널리 인용되는 115%는 전통 검색결과 5위 사이트의 값이고, 1위 사이트는 같은 표에서 30.3% 하락입니다.

통제 조건에서 재현하자 효과는 대부분 사라졌습니다. C-SEO Bench(NeurIPS 2025 Datasets & Benchmarks)는 공개된 기법들을 여러 도메인에서 평가해 54개 사례 중 3개만 통계적으로 유의했고, 질의응답 과제에서는 0개였다고 보고합니다. 일부 기법은 오히려 순위를 유의하게 떨어뜨렸습니다. 논문의 결론은 이것이 혼잡한 제로섬 게임으로 작동하며, 전통 SEO의 대체가 아니라 보완이라는 것입니다.

본문만 손대면 오히려 나빠집니다. SAGEO Arena(KDD 2026)는 질의 2,700개와 웹문서 171,003건으로 코퍼스를 만들어 단계별로 측정했습니다. 본문 텍스트만 최적화한 경우 검색 단계가 평균 9% 하락했습니다. 구조 정보는 검색에 크게 도움이 됐지만(HitRate 22% 상승) 재순위 단계가 병목으로 남았고, 구조가 인용으로 이어지지는 않았습니다.

llms.txt는 읽히지 않습니다. 구글의 생성형 AI 최적화 가이드는 "잘못된 통념" 절에서 llms.txt 같은 기계가독 파일은 필요 없으며 구글 검색은 이를 사용하지 않는다고 못박았습니다. Ahrefs가 도메인 137,210곳을 조사한 결과, 파일을 올린 28% 중 97%가 2026년 5월 한 달간 요청을 단 한 건도 받지 못했습니다. 도착한 요청 중 96%가 봇이었고, 그 봇의 77%는 AI 도구조차 아니었습니다. 저희도 파일을 이미 만들어 뒀다가 폐기했습니다.

FAQ 리치 결과는 사라졌습니다. 구글이 2026년 5월 8일 정식 폐기했고 6월 15일 문서를 삭제했습니다. 한편 Bing은 명확한 제목·표·FAQ 섹션이 정확한 인용에 도움이 된다고 밝혔는데, 이는 마크업이 아니라 페이지에 실제로 보이는 질문·답변 문장을 말합니다.

한국 상세페이지는 정말 AI가 못 읽을까?

절반은 맞고, 사람들이 생각하는 자리에서는 아닙니다. 널리 공유되는 버전은 한국 상세페이지가 긴 이미지 한 장이라 기계가 못 읽는다는 주장입니다. Openads에 실린 한 업계 조사는 국내 D2C 사이트 370곳을 크롤한 결과 65.5%가 고객 질문 50개 중 단 하나도 답할 문장이 없었고, 뷰티가 86.2%로 가장 나빴다고 밝혔습니다. 이는 해당 조사팀의 주장과 방법론이며 저희 측정이 아닙니다.

저희가 직접 확인할 수 있었던 것은 미국 쪽입니다. 미국 소비자에게 실제로 노출되는 면이기도 합니다. K-뷰티 미국 자사몰 다섯 곳에서 제품 페이지를 세 개씩 뽑아, AI 크롤러가 하는 방식 그대로 자바스크립트 실행 없이 HTTP로 받아봤습니다.

K-뷰티 미국 제품 페이지 15개 측정표. Product 구조화 데이터 15/15 존재, 본문 중앙값 1,904단어, 이미지 1,264장 중 421장이 alt 텍스트 공란 또는 누락

COSRX와 TIRTIR은 이미지의 절반을 훌쩍 넘는 분량에 alt 텍스트가 없습니다. Beauty of Joseon은 3%입니다.

Product 구조화 데이터는 15개 페이지 전부에 있었습니다. 텍스트도 있었습니다. 빠진 것은 실제로 파는 부분이고, 저희가 매일 들여다보는 페이지에서 그 손실이 얼마인지 그대로 보여줄 수 있습니다.

네이처리퍼블릭 미국몰 알로에 수딩젤 페이지에서, 같은 상세 구간을 사람은 8,517픽셀 이미지로 보고 AI 크롤러는 alt 공란 이미지 태그 한 줄로만 받는 대조 도해

네이처리퍼블릭 미국몰(Nature Republic USA)의 알로에 92% 수딩젤 페이지입니다. 상세 구간 전체가 8,517픽셀 높이의 JPEG 한 장이고 alt 텍스트가 없습니다. 이미지 안의 문장을 읽어낸 뒤 크롤러가 받은 HTML에서 같은 문장을 찾아봤고, 사용법과 핵심 함량 문구는 없었습니다.

Axis-Y의 다크스팟 세럼 페이지에서는 설득을 담당하는 세 장면이 각각 별개 이미지이고 셋 다 alt가 비어 있습니다. "나이아신아마이드 5%"는 소비자가 보는 그림 안에는 있고, 크롤러가 받는 1,477단어 안에는 없습니다. 임상 결과 패널도, 사용 순서 안내도 마찬가지입니다. 사용 순서는 사람들이 AI에게 가장 많이 묻는 형태의 질문인데도 그렇습니다.

Axis-Y의 Benefits·Clinical results·How to use 상세 카드 3종에 각각 alt 공란 표시, 그 아래 Axis-Y·Nature Republic USA·SKIN1004의 alt 공란 비율 차트

Axis-Y, Nature Republic USA, SKIN1004 모두 저희가 함께 일하는 브랜드입니다. 실명을 밝히는 이유는 이것이 한 브랜드의 실수가 아니라 카테고리의 평균 상태이기 때문입니다. 아홉 페이지 모두 Product 구조화 데이터가 정상이고 테스트한 모든 AI 크롤러에 200을 반환합니다.

이 구분이 기술적 논점의 전부이고, 근거도 기계적입니다. Vercel과 MERJ가 자사 네트워크 트래픽을 실측한 결과 주요 AI 크롤러는 자바스크립트를 실행하지 않습니다. GPTBot, OAI-SearchBot, ClaudeBot, PerplexityBot, CCBot은 HTML을 받아 파싱만 합니다. 렌더링하는 것은 Gemini와 AppleBot뿐이고, 둘 다 기존 검색 인프라를 타기 때문입니다. 따라서 스크립트 실행 후에만 나타나는 정보는 보이지 않고, JPEG 안에만 있는 주장도 보이지 않습니다.

반대편에 숫자가 공개된 국내 사례도 하나 있습니다. 풀무원은 2026년 9월, 공식몰을 생성형 엔진에 맞게 재정비하면서 AI 전용 상품 카탈로그를 별도로 구축했고, 4월 1일 기준 전후 4개월을 비교했을 때 방문자 수가 2.3배, 구매 건수가 7.4배 늘었다고 밝혔습니다. 회사가 발표하고 업계지가 보도한 수치이며 독립 감사는 아닙니다.

AI 인용 중 브랜드 자사 사이트 비중은 얼마일까?

저희 계획을 바꾼 숫자가 이것입니다.

뷰티 카테고리 AI 인용 출처 구성. 브랜드 자사 사이트 2.4%, 제3자 매체·리테일·소셜·크리에이터 콘텐츠 97.6%

Aivo가 5개 엔진에서 답변 750건을 표본으로 잡았습니다. 카테고리 프롬프트 50개를 각 3회 반복, 공개 뷰티 브랜드 18곳 대상입니다.

610개 도메인에서 나온 인용 3,814건 중 브랜드 자사 사이트는 2.4%였습니다. 나머지는 Reddit, YouTube, Ulta, Allure, Sephora, TikTok, 그리고 긴 에디토리얼 꼬리였습니다.

같은 조사에서 엔진별 편차는 잡음이 아니었습니다. La Roche-Posay는 Claude 답변의 9.3%, ChatGPT 답변의 22.0%에 등장하고 두 신뢰구간이 겹치지 않습니다. Revlon은 엔진 전체로는 약 4%인데 Google AI 개요에서는 0.7%입니다. 한 엔진은 Dr. Bronner's가 B Corp 인증을 유지하고 있다고 3회 모두 자신 있게 답했는데, 브랜드가 그 인증을 반납한 지 1년이 넘은 시점이었습니다.

무엇이 증명됐고 무엇이 아닌지는 분명히 해두겠습니다. 크리에이터 시딩이 AI 인용을 늘린다는 통제 실험은 아직 아무도 발표하지 않았습니다. 측정된 것은 엔진이 어디를 읽는가이고, 그 답은 압도적으로 제3자 면입니다. AI 검색 예산 전부를 자사 도메인에 쓰고 있다면, 입력값의 2.4%를 최적화하고 있는 셈입니다.

AI 검색 시대에도 전통 SEO는 여전히 중요할까?

전통 검색 순위는 여전히 중요하고, 연구가 직접 그렇게 말합니다. C-SEO Bench에서 상위 두 자리에 있는 것은 전 도메인에서 유의하게 남았습니다. AI 경험에 대한 구글의 공식 권고도 대부분 예전 권고 그대로입니다. 페이지가 200을 반환하고, 크롤 가능하고, 색인 가능한 콘텐츠를 담을 것.

AI 유입 트래픽을 전제로 사업을 다시 짜지는 마십시오. SparkToro와 Similarweb은 2026년 1~4월 미국 구글 검색의 68.01%가 무클릭으로 끝났다고 집계했습니다(2024년 60.45%). 다만 같은 분석은 AI 도구가 전체 유입 트래픽의 1% 미만을 내보낸다고 봅니다. 주목이 트래픽보다 빨리 움직이고 있는 국면입니다.

그리고 단일 측정치를 믿지 마십시오. 2026년 4월 arXiv 논문 한 편은 답변이 실행·프롬프트·시점에 따라 달라지므로 가시성을 단일 값이 아니라 분포로 다뤄야 한다고 주장합니다. 5월의 또 다른 논문은 2,000회 실행을 감사해, 프롬프트 앞에 페르소나를 붙이기만 해도 추천셋 유사도가 0.12~0.20 떨어진다고 보고했습니다. 카테고리 리더는 약 80% 일관성으로 버텼고, 중견 브랜드는 모델이 누가 묻는다고 판단하느냐에 따라 추천셋의 최대 75%가 교체됐습니다. 미국에 진입하는 K-뷰티 브랜드 대부분이 중견 구간입니다.

뷰티 브랜드는 AI 검색에 어떻게 대응해야 할까?

최적화 전에 스위치부터 확인하십시오. 2026년 8월 31일부로 모든 서치 콘솔 속성의 설정에 Search generative AI control이 들어갔습니다. 기본값은 포함이지만, 제외로 잡혀 있으면 다른 무엇을 하든 AI 개요와 AI 모드 노출이 0입니다.

상업적으로 중요한 정보는 최초 HTML 응답에 넣으십시오. 가격, 성분, 효능 주장, 재고 여부. 자바스크립트 실행 후에만 존재한다면 Gemini와 AppleBot 외의 AI 크롤러는 영영 보지 못한다고 가정하는 편이 안전합니다.

alt 텍스트를 쓰고, 그림에 넣은 주장을 텍스트로도 한 번 더 쓰십시오. K-뷰티에 한정하면 이것이 투입 대비 회수가 가장 큰 조치입니다. 효능 서사가 스스로를 아무것도 아니라고 설명하는 이미지 파일 안에 들어 있기 때문입니다.

엔진별로 측정하되, 아직 유료 트래커는 사지 마십시오. Bing Webmaster Tools는 2026년 2월 AI Performance를 열어 인용 횟수와 AI 답변이 우리 페이지를 근거로 삼은 질의까지 보여줍니다. 구글도 8월 31일까지 생성형 AI 성과 리포트를 전 사이트에 배포했습니다. 둘 다 무료이고 둘 다 1차 데이터입니다.

나머지는 우리 소유가 아닌 면에 쓰십시오. 크리에이터 영상, 리뷰 스레드, 리테일러 페이지, 에디토리얼 기사가 이 카테고리에서 엔진이 읽는 것의 97.6%입니다. 이것은 AI 기법이 아닙니다. 독자가 이제 기계인 상황에서 하는, 같은 언드미디어 작업입니다.

llms.txt는 건너뛰십시오. FAQ 스키마 확장도 마찬가지입니다.

미국 크리에이터 시딩 문의하기 →

출처(본문 등장 순): Pew Research Center, "Americans and AI 2026", 2026-06-17. Mistral·Meta·Alibaba·Anthropic·OpenAI 크롤러 문서, 2026-09-23 조회. Brave Search API 문서. Writesonic 인용 겹침 조사, 2026-07-22. Aggarwal 외, "GEO: Generative Engine Optimization", KDD 2024. "C-SEO Bench", NeurIPS 2025 Datasets & Benchmarks. SAGEO Arena, KDD 2026. Google Search Central AI 기능 가이드 및 2026-07-14 갱신 크롤러 문서. Ahrefs llms.txt 조사, 2026-06-15. Openads 리포트, 2026년 8월. Vercel·MERJ, "The rise of the AI crawler". 더피알 풀무원 보도, 2026-09-22. Aivo, "Beauty Representation Report", 2026-07-17. SparkToro·Similarweb 무클릭 조사, 2026년 6월. arXiv 2604.07585, arXiv 2605.30207. 제품 페이지 측정·크롤러 요청 테스트·상세 구간 감사는 저희가 2026년 9월에 직접 수행했습니다. 제품 이미지는 각 브랜드 자사몰 이미지입니다.

함께 읽기: 원산지가 아니라 카테고리 · 크리에이터 시딩 스케일업 · 미국 틱톡샵에서 K-뷰티 팔기

Yong Suk Choi, Chief Business Officer, BAZZAAL

작성자

최용석

CBO

BAZZAAL CBO. 한국과 미국 시장에서 15년 넘게 제로투원 실행을 맡아 왔고, 지금은 로스앤젤레스와 서울에서 미국에 진출하는 K-뷰티 브랜드의 성장을 이끕니다.

링크드인 프로필 보기

미국 진출을 준비 중이십니까?

BAZZAAL은 미국에 진출하는 K-뷰티 브랜드의 크리에이터 시딩과 틱톡샵, 페이드 캠페인을 로스앤젤레스에서 운영합니다. 일하는 방식은 한국 회사 그대로입니다.

STATESIDE 구독하기

LA 현지 팀이 매주 보내는 미국 K-뷰티 인텔리전스.

뷰티 시장의 다음 주인공이 준비, 되셨나요?

이제 브랜드를 다음 무대로 데려갈 시간입니다.

Beauty creators posing together for a group photo

뷰티 시장의 다음 주인공이 준비, 되셨나요?

이제 브랜드를 다음 무대로 데려갈 시간입니다.

Beauty creators posing together for a group photo

뷰티 시장의 다음 주인공이 준비, 되셨나요?

이제 브랜드를 다음 무대로 데려갈 시간입니다.

Beauty creators posing together for a group photo
>