AI가 우리 사이트
못 읽으면 인용도 없다
llms.txt란 AI에게 우리 사이트의 핵심이 어디에 있는지 알려주는 마크다운 파일이에요. robots.txt가 가지 말라는 곳을 알린다면, llms.txt는 금맥이 어디인지 알려주는 안내판이에요. 여기에 질문과 답변을 또렷이 정리한 FAQ 구조를 더하면, AI 검색이 우리 사이트를 인용하기 훨씬 쉬워져요.
다만 미리 말해둘게요. 마법 스위치는 없어요. 정보를 또렷하게 정리하면 AI가 뽑아 쓰기 쉬워지는 것뿐이에요. 그 원리와 실전 세팅을 하나씩 풀어볼게요.
llms.txt가 정확히 뭔가요?
AI에게 사이트의 핵심 정보 위치를 알려주는 마크다운 파일이에요. 맨 위에 사이트 이름을 H1으로 두고, 그 아래 한두 문장 요약, 이어서 회사 소개나 서비스, 가격 같은 핵심 링크 목록을 적어서 /llms.txt 주소에 올리면 돼요. 한 시간이면 만드는 가장 값싼 세팅이에요.
llms.txt는 지금 표준인가요?
아직 공식 표준은 아니에요. Mintlify, Anthropic, Cursor, GitBook 같은 곳이 먼저 채택했고, SE Ranking이 30만 도메인을 분석한 2026년 자료를 보면 전 세계 사이트 중 약 10%만 이 파일을 가지고 있어요. 아직은 소수인 셈이에요.
llms.txt를 만들면 AI 검색에 바로 노출되나요?
냉정하게 말하면 아니에요. GPTBot, ClaudeBot, PerplexityBot 같은 검색 크롤러는 이 파일을 거의 안 읽고 HTML을 바로 긁어요. 이게 아직은 실측 현실이에요. 다만 Cursor나 Copilot 같은 코딩 에이전트는 이 파일을 실제로 찾아 읽어요.
그런데도 llms.txt를 만들 이유가 있나요?
있어요. 값이 싸고, 만드는 과정에서 우리 사이트의 정보 구조를 스스로 정리하게 만들어요. 채택이 빨라지면 미리 해둔 쪽이 유리하고요. 안 할 이유가 없는 세팅이에요. 다만 기본기가 갖춰진 사이트에 광을 내는 마지막 손질이라고 보는 게 맞아요.
진짜 인용을 만드는 건 뭔가요?
FAQ 구조예요. FAQPage 스키마는 질문과 답변을 AI가 뽑기 좋은 조각으로 만들어줘요. 여러 스키마 중에서도 인용 확률이 높은 축에 속해요. 2026년 6월 Signals의 통제연구는 마크업만 붙인다고 인용이 오르는 게 아니라, Q&A 콘텐츠 자체가 인용을 만든다고 봤어요.
FAQ 답변은 얼마나 길게 써야 하나요?
답변 하나는 40~60단어로 쓰는 게 좋아요. Princeton GEO 연구에서 나온 기준인데, 너무 짧으면 알맹이가 없고 너무 길면 AI가 한 덩어리로 못 뽑아요. 그리고 각 답변은 페이지에서 떼어내도 그 자체로 완결돼야 해요. '위에서 말했듯이' 같은 표현은 인용을 망쳐요.
인용 확률을 더 높이는 방법이 있나요?
수치를 넣는 거예요. 구체적인 숫자, 날짜, 출처가 든 답변이 두루뭉술한 답변보다 훨씬 자주 인용돼요. Princeton과 조지아텍이 SIGKDD 2024에서 발표한 연구를 보면, 통계를 추가하는 것만으로 인용 가시성이 30~40% 올라갔어요.
오늘 바로 손볼 수 있는 순서가 있을까요?
네 단계로 정리했어요. 첫째, 회사 소개와 서비스, 가격, 문의 같은 핵심 페이지 5~10개를 골라요. 둘째, 이걸 뼈대로 llms.txt 한 장을 만들어 /llms.txt에 올려요. 셋째, 자주 받는 질문 5개를 골라 각 답을 40~60단어 자립형으로 써요. 넷째, 질문을 H3 제목으로 두고 FAQPage 스키마의 name과 화면 문구를 똑같이 맞춘 뒤 크롤러 로그로 확인해요.
자주 묻는 질문
Q. llms.txt만 만들면 AI 검색에 나오나요?
A. 아니에요. GPTBot이나 PerplexityBot 같은 검색 크롤러는 이 파일을 거의 안 읽어요. 인용을 만드는 건 자립형 FAQ 콘텐츠 자체예요. llms.txt는 값싼 준비물로 보는 게 맞아요.
Q. FAQ 답변에 꼭 넣어야 할 게 있나요?
A. 구체적인 숫자와 날짜, 출처예요. 통계를 넣은 구조화 콘텐츠는 인용 확률이 30~40% 올라간다는 연구가 있어요. 그리고 답변은 떼어내도 완결되게 40~60단어로 써야 해요.
Q. llms.txt와 FAQ 중 뭘 먼저 해야 하나요?
A. 콘텐츠 구조와 신뢰가 먼저예요. FAQ를 자립형으로 정리하는 게 우선이고, llms.txt는 기본기가 갖춰진 사이트에 광을 내는 마지막 손질이에요.
Q. 스키마 마크업만 붙이면 인용이 오르나요?
A. 그렇지 않아요. 2026년 6월 Signals 통제연구는 마크업보다 Q&A 콘텐츠 자체가 인용을 만든다고 봤어요. 마크업은 정리를 돕는 도구일 뿐이에요.
Q. 이 세팅이 사람 방문자에게도 도움이 되나요?
A. 네. AI가 읽기 쉬운 사이트는 곧 사람이 읽기 쉬운 사이트예요. 또렷하게 정리된 정보 구조는 방문자의 이해도 함께 높여줘요.