llms.txt란? 작성 예시와 공식 문서로 본 효과

llms.txt란? 작성 예시와 공식 문서로 본 효과

llms.txt는 AI 에이전트(AI agent, 사람 대신 웹 페이지를 찾아 읽고 일을 처리해 주는 AI 프로그램)와 대규모 언어 모델(LLM, ChatGPT 같은 AI의 바탕이 되는 모델)이 사이트를 읽고 활용할 때 참고하도록 사이트 개요와 주요 문서 링크를 마크다운(Markdown, #이나 - 같은 간단한 기호로 제목과 목록을 표시하는 글 형식) 파일 하나에 정리해 두자는 제안입니다. 웹 표준 기구가 정한 규격은 아닙니다.

2024년 9월 3일 Jeremy Howard가 llmstxt.org에 처음 제안했고, 2026년 8월 10일 2판으로 고쳤습니다. 구글은 구글 검색이 이 파일을 쓰지 않는다고 밝혔습니다.

한눈에 보기

  • llms.txt는 AI 에이전트에게 "우리 사이트는 이런 곳이고, 중요한 정보는 여기 있다"고 알려 주는 안내 파일입니다.
  • 구글 검색은 이 파일을 쓰지 않고, OpenAI·Anthropic·Perplexity의 크롤러(crawler, 웹 페이지를 돌아다니며 읽어 가는 프로그램) 안내 문서에도 이 파일을 검색이나 인용에 쓴다는 설명이 없습니다.
  • 만드는 데 품이 적게 드니 기본 항목을 갖춘 뒤 덧붙이면 되고, AI 검색 노출 효과를 기대하고 먼저 할 일로 삼을 파일은 아닙니다.

우리 같은 회사도 만들어야 할까요? 짧게 답하면 "기본 항목을 갖춘 다음에 덧붙이는 정도"입니다. 크롤러가 사이트에 들어올 수 있는지, 페이지 본문이 글자로 읽히는지, 회사 정보가 정확한지를 먼저 챙기고, llms.txt는 그 뒤에 만들어 두면 됩니다.

파일을 만드는 일은 어렵지 않습니다. H1 제목(마크다운에서 # 하나로 시작하는 가장 큰 제목) 한 줄만 있어도 형식에 맞습니다. 따져 볼 것은 효과입니다. llms.txt를 두면 AI 답변에 인용된다는 설명이 흔하지만, 공식 문서로 확인되는 범위는 그보다 좁습니다.

이런 상황을 떠올려 보세요

동네에서 꽃집을 하는 사장님이 있습니다. 손님이 ChatGPT에 "이 꽃집 당일 배송 되나요? 몇 시까지 주문해야 하나요?"라고 묻자, AI가 꽃집 홈페이지를 열어 봅니다. 그런데 첫 화면은 큰 사진과 팝업 광고뿐이고, 배송 마감 시각은 메뉴 세 번째 칸 아래 이미지 안에 적혀 있습니다. AI는 답을 못 찾거나, 1년 전 블로그 글에 적힌 옛 마감 시각을 대신 가져옵니다. llms.txt는 이럴 때를 위해 "우리 가게는 이런 곳이고, 배송 안내는 이 주소에 있다"고 적어 두는 파일입니다. 매장 입구에 둔 안내 브로슈어와 비슷합니다. 손님(AI 에이전트)이 브로슈어를 집어 들면 길을 덜 헤매지만, 브로슈어를 읽지 않고 곧장 매장 안으로 들어오는 손님도 많습니다. 구글 검색이 바로 그런 손님입니다. ChatGPT 같은 다른 AI 서비스가 이 브로슈어를 집어 드는지도 아직 공식 문서로 확인되지 않습니다(아래 효과 절 참고).

제안 배경

웹 페이지는 사람을 위해 만들어집니다. 제안 원문은 메뉴, 광고, 자바스크립트 사이에 섞인 정보를 깨끗한 글로 되돌리기가 어렵다는 점을 먼저 듭니다1. 언어 모델이 한 번에 읽을 수 있는 분량인 컨텍스트 창(context window)도 커지기는 했지만, 대부분의 사이트 전체를 담기에는 여전히 작습니다. 그래서 에이전트에게 필요한 정보를 한곳에 짧게 모아 두고, 자세한 내용은 링크로 따라가게 하자는 것이 제안의 요지입니다.

2판 문서에는 쓰임새도 나옵니다. 코딩 에이전트가 라이브러리 문서를 찾아 API(프로그램끼리 정해진 방식으로 주고받는 창구)를 올바르게 부르도록 돕는 경우와, 검색 기능이 있는 대화형 AI가 제품 정보를 읽는 경우입니다. 제안자는 처음에 llms.txt가 학습보다 답변 시점(추론, 이미 학습을 마친 AI가 질문을 받아 답을 만들어 내는 단계)에 주로 읽힐 것으로 예상했고, 2판에서는 그 예상대로 됐으며 소프트웨어 문서에서 가장 널리 퍼졌다고 적었습니다1.

AI 서비스 운영사의 개발 문서 사이트도 이 파일을 둡니다. OpenAI의 크롤러 안내 페이지는 문서 전체 목록을 llms.txt로 제공한다고 적었고, Perplexity 개발 문서도 같은 안내를 붙였습니다23. 자기 문서를 에이전트가 읽기 쉽게 내놓은 것입니다. 그 회사 크롤러가 다른 사이트의 llms.txt를 읽어 검색이나 인용에 쓴다는 설명은 두 회사의 크롤러 안내 문서에 없습니다.

파일 형식과 순서

제안 원문은 파일 안의 순서를 정했습니다1. 파일은 사람이 읽는 마크다운이면서, 순서만 지키면 일반 프로그램으로도 정확히 읽어 낼 수 있게 설계됐습니다. 브로슈어에 비유하면 맨 위에 가게 이름, 그 아래 한 줄 소개, 이어서 "메뉴는 몇 쪽, 오시는 길은 몇 쪽" 같은 목차가 오는 구성입니다.

  1. H1 제목. 프로젝트나 사이트 이름. 유일한 필수 요소입니다. 마크다운에서는 # 가게이름처럼 # 하나와 한 칸 띄고 씁니다.
  2. 인용 블록(>). 나머지 내용을 이해하는 데 필요한 핵심을 담은 짧은 요약. 인용 블록은 줄 앞에 >를 붙여 "이 부분은 요약"이라고 표시하는 마크다운 문법입니다.
  3. 제목이 아닌 문단이나 목록. 파일을 어떻게 해석할지 알려 주는 설명. 없어도 되고 여러 개여도 됩니다.
  4. H2 섹션. 자세한 내용이 있는 주소 목록. H2는 ##로 시작하는 두 번째 크기 제목으로, 브로슈어의 목차 항목에 해당합니다. 목록 항목은 [이름](주소)로 쓰고, 필요하면 : 뒤에 설명을 붙입니다.

## Optional이라는 이름의 섹션은 짧은 맥락만 필요할 때 건너뛰어도 되는 링크를 모으는 관례입니다. 1판에서는 llms.txt 내용을 AI에게 한꺼번에 넣어 주는 보조 도구(llms_txt2ctx)가 이 섹션을 뺄 수 있었습니다. 2판에서 그 도구가 제안에서 빠지면서 관례로만 남았습니다4.

llms.txt 한 파일의 구성 도식. 맨 위 H1 사이트 이름은 필수, 그 아래 인용 블록 요약, 제목이 아닌 설명 문단, H2 섹션의 링크 목록은 선택, 마지막 Optional 섹션은 관례
llms.txt의 구성 요소(llmstxt.org 제안 2판 기준). H1만 필수이고 나머지는 순서만 지키면 됩니다.

llms.txt는 어디에 두나?

제안 원문 2판은 파일을 두는 자리와 페이지 사본, 알리는 방법을 다음과 같이 정했습니다1. 1판과 달라진 점은 글 끝 '개발자를 위한 심화' 절에 적었습니다.

  • 위치. https://www.example.co.kr/llms.txt처럼 루트(root, 사이트 주소 바로 뒤 자리)에 두거나, /docs/llms.txt처럼 하위 경로(주소 뒤에 폴더 이름이 한 단계 더 붙은 자리)에 둡니다. 파일은 자기 경로 아래 페이지를 다루고, 여러 파일이 겹치면 가장 구체적인 파일을 씁니다. 공유 호스팅(shared hosting, 서버 한 대를 여러 사이트가 나눠 써서 자기 폴더만 고칠 수 있는 환경)에서 경로 하나만 관리하는 사이트도 참여할 수 있게 하려는 변경입니다.
  • 마크다운 사본. 에이전트가 읽을 만한 페이지는 같은 주소에 .md를 붙인 마크다운 사본(page.html.md)이나 확장자를 바꾼 사본(page.md)을 두자고 제안합니다. llms.txt의 링크는 이런 사본을 가리키는 편이 좋습니다. 사본이 없다면 일반 페이지 주소를 적어도 됩니다.
  • 찾기 쉽게 알리는 방법. 2판에서 새로 들어간 내용으로, 각 페이지가 "나를 설명하는 llms.txt는 여기 있다"고 알리는 표시를 붙이는 방법입니다. 설정 방법은 글 끝 '개발자를 위한 심화' 절에 옮겨 두었습니다.

파일을 두는 일은 둘로 나뉩니다.

  • 직접 할 수 있는 일: 파일 내용을 쓰는 것입니다. 아래 예시를 본떠 메모장에 적고 llms.txt라는 이름으로 저장하면 됩니다.
  • 개발 담당자나 호스팅 업체에 요청할 일: 그 파일을 사이트 루트에 올려 내사이트주소/llms.txt로 열리게 하는 것입니다. 홈페이지 제작 도구에 따라 루트에 파일을 올리는 기능이 없거나 제한될 수 있으니, 가능한지 업체에 먼저 물어보세요.

robots.txt나 sitemap.xml(사이트에 있는 페이지 주소를 모아 둔 목록 파일)과는 하는 일이 다릅니다. 제안 원문도 이 차이를 따로 설명합니다1. robots.txt가 들어와도 되는 곳을 알리는 파일이라면 llms.txt는 입구에 꽂아 둔 안내 브로슈어입니다. robots.txt 설정은 robots.txt로 AI 크롤러 설정하기에서 다룹니다.

파일 하는 일 누가 언제 읽나
robots.txt 자동 수집 도구가 어느 경로를 가져가도 되는지 알림 크롤러가 수집 전에 읽음
sitemap.xml 검색엔진이 수집해 목록에 올릴(색인할) 수 있는 페이지 전체 목록 검색엔진이 수집 범위를 정할 때 읽음
llms.txt 에이전트가 필요한 정보를 찾아가도록 고른 개요와 링크 에이전트가 사용자를 도우며 필요할 때 읽음

원문은 사이트맵이 llms.txt를 대신하지 못한다고 봅니다. 사이트맵에는 마크다운 사본이 없고 외부 참고 주소도 담지 않습니다. 모든 페이지를 담으니 언어 모델이 한 번에 읽기에는 너무 큽니다1.

작성 예시: 동네 가게형과 회사 소개형

동네 가게형

작은 가게라면 섹션 두세 개로 충분합니다. 아래는 가상의 동네 꽃집이 쓸 만한 llms.txt 전체입니다.

# 봄날꽃방

> 봄날꽃방은 서울 마포구 망원동에 있는 꽃집입니다. 꽃다발, 화환, 정기 꽃 구독을 판매하고 마포구 안에서 당일 배송합니다.

영업시간, 배송 마감 시각, 가격은 아래 링크한 페이지의 값이 가장 최신입니다.

## 가게 안내

- [영업시간과 오시는 길](https://www.example-flower.kr/about): 영업시간, 휴무일, 주소, 주차, 전화번호
- [배송 안내](https://www.example-flower.kr/delivery): 당일 배송 가능 지역, 주문 마감 시각, 배송비

## 상품

- [꽃다발](https://www.example-flower.kr/bouquet): 크기별 가격과 주문 방법
- [정기 꽃 구독](https://www.example-flower.kr/subscription): 주기, 가격, 해지 방법

## Optional

- [가게 소식](https://www.example-flower.kr/news): 계절 꽃 입고 소식

한 줄씩 보면 다음과 같습니다.

  • # 봄날꽃방: 가게 이름입니다. 파일에서 꼭 있어야 하는 유일한 줄입니다.
  • > 봄날꽃방은 …: 가게를 두 문장으로 소개합니다. AI가 이 줄만 읽고도 "어디에 있는 무슨 가게인지" 알 수 있게 씁니다.
  • 영업시간, 배송 마감 시각, …: 설명 문단입니다. 이 파일보다 링크한 페이지가 더 정확하다고 알려, 값이 바뀌었을 때 AI가 페이지를 확인하게 합니다.
  • ## 가게 안내, ## 상품: 목차 제목입니다. 손님이 자주 묻는 순서대로 둡니다.
  • - [배송 안내](주소): …: 페이지 이름, 주소, 그 페이지에 무엇이 있는지를 한 줄에 적습니다. 콜론 뒤 설명이 있으면 AI가 어느 링크를 열지 고르기 쉽습니다.
  • ## Optional: 급할 때는 건너뛰어도 되는 링크입니다.

가격이나 마감 시각 같은 숫자는 llms.txt에 직접 적지 않고 링크한 페이지에만 두는 편이 안전합니다. 파일에 숫자를 적어 두면 가게 페이지를 고칠 때 이 파일을 잊기 쉽습니다.

회사 소개형

회사 사이트라면 회사가 무엇을 하는지, 어떤 정보가 어디에 있는지를 적습니다. 사업자 정보나 서비스 제공 상태처럼 틀리면 곤란한 사실은 다른 페이지와 같은 값으로 씁니다. 아래는 가상의 제조 소프트웨어 회사가 쓸 만한 llms.txt 예시입니다.

# 예시테크

> 예시테크는 제조 현장의 설비 데이터를 모아 고장을 미리 알려 주는 예지 보전 소프트웨어 회사입니다. 서울에 본사가 있고 국내 제조 기업에 서비스를 제공합니다.

사업자 정보와 연락처는 회사 소개 페이지와 같습니다. 서비스 이름 앞의 [운영 중], [베타] 표시는 서비스 목록 페이지의 표기와 같습니다.

## 회사

- [회사 소개](https://www.example.co.kr/about.md): 설립 연도, 사업 분야, 사업자 정보, 연락처
- [고객 사례](https://www.example.co.kr/cases.md): 업종별 도입 사례와 도입 범위

## 서비스

- [설비 예지 보전](https://www.example.co.kr/products/predictive.md): [운영 중] 지원 설비, 도입 절차, 요금 문의 방법
- [설비 데이터 대시보드](https://www.example.co.kr/products/dashboard.md): [베타] 제공 범위와 신청 방법
- [자주 묻는 질문](https://www.example.co.kr/faq.md): 보안, 설치 방식, 계약 기간

## Optional

- [기술 블로그](https://www.example.co.kr/blog): 설비 데이터 분석 글
- [사이트맵](https://www.example.co.kr/sitemap.xml): 공개 페이지 전체 목록

API나 제품 매뉴얼이 있다면 문서 경로 아래에 따로 둡니다. 그 예시는 '개발자를 위한 심화' 절에 옮겨 두었습니다.

llms-full.txt와 .md 사본은 무엇인가?

llms-full.txt는 사이트의 본문 전체를 텍스트 파일 하나로 모아 두는 파일입니다. 제안 원문 1판과 2판 어디에도 이 이름은 없습니다14. 일부 사이트와 문서 도구가 llms.txt와 함께 만들어 두는 관례입니다. 크기가 커서 에이전트가 한 번에 다 읽기는 어렵습니다. 제안 원문이 권하는 쪽은 페이지마다 마크다운 사본을 두고 llms.txt에서 링크하는 방식입니다. 브로슈어로 치면 llms.txt는 얇은 안내장이고, llms-full.txt는 매장의 모든 설명서를 한 권으로 묶은 두꺼운 책입니다.

gensapps.com은 llms.txt와 llms-full.txt를 둘 다 둡니다. llms-full.txt는 사이트맵에 있는 공개 페이지의 본문을 모은 파일이고, llms.txt의 Optional 섹션에서 링크합니다. 페이지별 마크다운 사본과 Link 헤더(페이지가 응답할 때 함께 보내 "내 마크다운 사본은 여기"라고 알리는 표시)는 아직 두지 않았습니다.

llms.txt는 AI 검색에 효과가 있나?

2026년 9월 17일 기준으로 공식 문서에서 확인되는 내용을 주체별로 나누면 다음과 같습니다.

주체 공식 문서가 말하는 것 근거
제안자(llmstxt.org) 에이전트가 필요할 때 읽고 링크를 따라가도록 만든 파일. 주로 답변 시점에 쓰일 것으로 예상 1
구글 검색 구글 검색(생성형 AI 기능 포함)은 llms.txt를 쓰지 않음. 두어도 노출이나 순위에 도움도 손해도 되지 않음. 다른 서비스를 위해 두는 것은 괜찮음 56
OpenAI·Anthropic·Perplexity 크롤러 안내 크롤러가 llms.txt를 읽어 검색이나 인용에 쓴다는 설명 없음. robots.txt의 이름별 설정만 안내함 237

구글은 2026년 5월 새로 낸 생성형 AI 기능 최적화 안내에서 llms.txt 같은 "AI 텍스트 파일"을 무시해도 되는 항목으로 꼽았고, 6월 15일 문서 변경 기록에서 이 설명을 다시 분명히 했습니다56. 구글 AI 개요와 AI 모드에 나오려고 llms.txt를 만들 필요는 없습니다.

반대로 특정 AI 서비스가 답변의 출처를 고를 때 llms.txt를 참고한다는 공식 발표는 찾지 못했습니다. llms.txt를 둔 뒤 AI 답변 인용이 늘었다는 사례가 있더라도, 같은 시기에 바꾼 다른 조건과 떼어 보기 어렵습니다. llms.txt가 인용을 늘린다고 소개하는 글을 보면 근거부터 확인하세요.

llms.txt는 에이전트가 사이트를 빨리 이해하도록 돕는 안내문에 가깝습니다. 코딩 도구나 대화형 에이전트가 사용자 요청으로 사이트를 읽을 때는 쓸모가 있을 수 있습니다. 하지만 크롤러 접근, 서버가 보내는 HTML의 본문, 구조화 데이터(structured data, 페이지 내용을 기계가 읽기 좋게 정해진 틀로 덧붙인 정보)를 대신하지는 못합니다. 브로슈어가 아무리 좋아도 매장 문이 잠겨 있거나 진열대가 비어 있으면 소용이 없는 것과 같습니다.

GenAI AEO가 llms.txt를 점수에 넣지 않은 이유

GenAI AEO는 진단할 때 llms.txt와 llms-full.txt를 받아 제목과 섹션 수를 기록하지만, 다섯 영역 19개 항목의 점수에는 넣지 않습니다(진단 기준 2026.09.15-2 판)8.

  1. 점수는 효과가 문서로 확인된 조건만 담습니다. robots.txt 허용, 정상 응답, 구조화 데이터 문법처럼 운영사나 표준 문서가 역할을 밝힌 항목만 점수에 넣었습니다. llms.txt는 위 표처럼 검색이나 인용에 쓴다는 공식 설명이 없습니다.
  2. 점수에 넣으면 우선순위가 틀어집니다. 파일 하나를 추가하는 일이 제목 단계나 답 문단을 고치는 일보다 쉽습니다. 이 파일로 점수가 오르면, 실제로 AI가 페이지를 읽는 데 필요한 작업보다 이 파일부터 손대게 됩니다.
  3. 본문과 어긋날 위험이 있습니다. llms.txt는 사람이 자주 보지 않는 파일이라 서비스가 바뀌어도 그대로 남기 쉽습니다. 점수는 사이트가 실제로 보여 주는 내용을 기준으로 삼습니다.

같은 이유로 llms.txt가 없는 사이트도 감점하지 않습니다.

gensapps.com의 운영 원칙

젠아이랩스(GenAI Labs)는 2026년 9월 12일 gensapps.com에 llms.txt를 추가했고, 운영하면서 아래 원칙을 정했습니다.

손으로 쓰지 않습니다. 처음 손으로 쓴 llms.txt는 사이트 메뉴와 섹션 구조가 달랐습니다. 지금은 사이트를 빌드(build, 원고와 설정을 모아 실제로 올릴 사이트 파일을 만드는 단계)할 때 상단 메뉴 순서대로 섹션을 만들고, 각 페이지에서 표시해 둔 설명 문단을 가져와 파일을 생성합니다. 메뉴나 페이지 설명을 고치면 llms.txt도 함께 바뀝니다. 작은 가게라면 자동으로 만들 필요까지는 없고, 메뉴나 가격 페이지를 고칠 때 llms.txt도 함께 열어 보는 습관이면 됩니다.

서비스 상태를 페이지와 같게 적습니다. 서비스 항목마다 [운영 중], [베타], [출시 예정]을 붙이는데, 이 값은 서비스 목록 페이지가 쓰는 설정에서 가져옵니다. 에이전트가 아직 준비 중인 서비스를 운영 중이라고 소개하지 않게 하려는 것입니다.

사업자 정보는 한 곳에서 가져온 값만 씁니다. 머리말의 사업자등록번호, 대표자, 주소, 연락처는 사이트 꼬리말과 같은 값입니다. llms.txt만 따로 고치는 일이 없게 했습니다.

실제 파일은 gensapps.com/llms.txt에서 볼 수 있습니다. 아래는 그 파일의 머리말 부분입니다.

# GenAI Labs (젠아이랩스)

> 생성형 AI 전문 하이퍼 엔지니어링 스타트업입니다. LLM·RAG 기반 AI 챗봇, MCP Agent 업무 자동화, 보안 AI 게이트웨이, AI 에이전트 행위 통제(Agent XDR), 지식그래프 솔루션과 기업 AI 교육·컨설팅, AEO 진단을 제공합니다.

사업자등록번호 210-32-72757 · 대표 박수현 · 서울 강남구 테헤란로79길 6, JS타워 3층 601호
문의: contact@genailabs.kr

아래 섹션과 항목 순서는 사이트 상단 메뉴를 따릅니다. 항목 앞의 [운영 중], [베타], [출시 예정]은 서비스 카탈로그(https://gensapps.com/solutions)에 표시한 운영 상태입니다.

llms.txt를 둘 때 주의할 점

  • 본문과 다른 내용을 쓰지 않습니다. 페이지에 없는 주장이나 광고 문구를 llms.txt에만 적으면 에이전트가 그 문장을 사실로 옮길 수 있습니다.
  • 오래된 링크를 남기지 않습니다. 없어진 페이지로 가는 링크는 에이전트가 틀린 정보를 찾게 만듭니다. 사이트를 배포할 때 함께 만들거나, 링크 상태를 정기적으로 확인합니다.
  • robots.txt와 맞춥니다. robots.txt에서 막은 경로를 llms.txt에서 링크하면 파일끼리 모순됩니다.
  • 서버가 텍스트 형식으로 보내게 합니다. 서버는 파일을 보낼 때 "이것은 어떤 종류의 파일인지"를 알리는 표시(Content-Type)를 함께 보냅니다. 이 표시가 text/plain; charset=utf-8이나 text/markdown이어야 글자 파일로 제대로 읽히고 한글도 깨지지 않습니다. 이 설정은 개발 담당자나 호스팅 업체에 요청할 일입니다.
  • 효과를 약속하지 않습니다. 회사 안에서 llms.txt를 AI 검색 대책으로 보고한다면, 구글 검색은 쓰지 않는다는 공식 설명을 함께 적는 편이 정확합니다.

직접 확인하는 법

파일을 올렸다면 브라우저 주소창에 내사이트주소/llms.txt(예: www.example-flower.kr/llms.txt)를 넣어 봅니다. 아래 네 가지를 보면 됩니다.

  1. 파일 내용이 글자로 보이나요? 다운로드 창이 뜨거나 "페이지를 찾을 수 없음"이 나오면 업로드 위치나 설정을 업체에 확인합니다.
  2. 한글이 ë´„ë‚ 같은 이상한 글자로 깨지지 않나요? 깨지면 위의 텍스트 형식 설정을 요청합니다.
  3. 첫 줄이 # 가게이름으로 시작하나요?
  4. 파일 안의 링크를 몇 개 골라 주소창에 붙여 넣었을 때 모두 열리나요?

링크가 많아 하나씩 열기 어렵다면 개발 담당자에게 '개발자를 위한 심화' 절의 확인 명령을 돌려 달라고 하면 됩니다.

llms.txt보다 먼저 볼 것은 크롤러 접근과 본문 구조입니다. 우리 사이트의 이 두 가지가 궁금하다면 GenAI AEO 무료 진단에 사이트 주소를 넣어 보세요. 무료 진단 대상 18개 항목의 결과가 나오고(전체 19개 항목 가운데 자바스크립트 실행 전후 비교 1개는 무료 진단에서 뺍니다), 앞에서 설명한 대로 llms.txt 유무는 점수에 들어가지 않습니다. GenAI AEO 무료 진단 시작하기

점검 순서는 AI 검색 최적화 체크리스트에, 크롤러 이름별 설정은 robots.txt로 AI 크롤러 설정하기에 있습니다. GEO라는 말부터 낯설다면 생성형 AI 검색 최적화(GEO)란?을 먼저 읽어 보세요.

개발자를 위한 심화

이 부분은 직접 구현하는 개발자를 위한 내용입니다.

1판과 2판의 하위 경로 규칙

1판도 /docs/llms.txt처럼 하위 경로에 파일을 두는 것을 허용했지만, 그 파일이 어느 페이지를 다루는지는 정하지 않았습니다. 2판은 파일이 자기 경로 아래 페이지를 다루고, 여러 파일이 같은 페이지에 걸리면 가장 구체적인 경로의 파일을 쓴다고 정했습니다4.

마크다운 사본과 llms.txt를 페이지에서 알리기

2판에서 새로 들어간 방법으로, 페이지의 HTML <link> 요소나 HTTP Link 헤더에 rel="alternate" type="text/markdown"으로 마크다운 사본을, rel="describedby"로 그 페이지를 다루는 llms.txt를 알립니다1.

아래는 /docs/page.html 페이지가 응답할 때 함께 보낼 Link 헤더 예시입니다.

Link: </docs/page.html.md>; rel="alternate"; type="text/markdown", </docs/llms.txt>; rel="describedby"

문서·가이드형 예시

2판 규칙에 따라 /docs/llms.txt는 /docs/ 아래 페이지만 다룹니다. 에이전트가 자주 틀리는 부분을 설명 문단에 적어 두면 쓸모가 큽니다.

아래는 가상의 설비 데이터 REST API 문서용 llms.txt 예시입니다.

# 예시테크 설비 데이터 API

> 설비 센서 데이터를 조회하고 이상 알림을 받는 REST API 문서입니다. 모든 요청은 API 키 인증이 필요합니다.

주의할 점:

- 시각 값은 모두 한국 표준시(+09:00)의 ISO 8601 형식입니다.
- 목록 조회는 한 번에 최대 500건이며, 다음 쪽은 응답의 next_cursor 값으로 요청합니다.

## 시작하기

- [인증과 API 키 발급](https://www.example.co.kr/docs/auth.md): 키 발급 절차와 헤더 형식
- [첫 요청 보내기](https://www.example.co.kr/docs/quickstart.md): 설비 목록 조회 예제

## API 참조

- [설비](https://www.example.co.kr/docs/api/equipment.md): 설비 목록, 상세, 상태 필드
- [알림](https://www.example.co.kr/docs/api/alerts.md): 이상 알림 조건 설정과 수신 방법

## Optional

- [변경 이력](https://www.example.co.kr/docs/changelog.md): 버전별 변경 내용

명령으로 형식 확인하기

아래는 llms.txt를 내려받아 첫 줄이 H1인지, H2 섹션과 링크가 몇 개인지, 링크가 응답하는지 출력하는 셸 명령과 파이썬 스크립트입니다. 링크 확인에 HEAD 요청을 쓰므로, HEAD 요청을 받지 않는 서버의 링크는 멀쩡해도 "확인 필요"로 나올 수 있습니다.

curl -s https://www.example.co.kr/llms.txt | python3 -c '
import sys, re, urllib.request
text = sys.stdin.read()
first = next((l for l in text.splitlines() if l.strip()), "")
lines = text.splitlines()
print("H1 제목:", first if first.startswith("# ") else "없음(첫 줄이 H1이 아님)")
print("H2 섹션 수:", sum(1 for l in lines if l.startswith("## ")))
links = re.findall(r"\]\((https?://[^)\s]+)\)", text)
print("링크 수:", len(links))
for url in links:
    try:
        code = urllib.request.urlopen(urllib.request.Request(url, method="HEAD"), timeout=10).status
    except Exception as e:
        code = getattr(e, "code", "오류")
    if code != 200:
        print("확인 필요:", code, url)
'

응답 형식은 curl -sI https://www.example.co.kr/llms.txt로 헤더만 받아 Content-Type 줄을 보면 됩니다.

참고 자료

번호 자료 다루는 내용 발행처·날짜(확인일)
1 The /llms.txt file, v2 제안 배경, 형식, 위치, 마크다운 사본, 다른 파일과의 차이 Jeremy Howard, 2024-09-03 제안, 2026-08-10 수정(2026-09-17, 2026-09-27)
2 Overview of OpenAI Crawlers OpenAI 크롤러 설정, 문서 목록 llms.txt 제공 OpenAI(2026-09-17, 2026-09-27)
3 Perplexity Crawlers Perplexity 크롤러 설정, 문서 목록 llms.txt 제공 Perplexity(2026-09-17, 2026-09-27)
4 llms.txt Changes 1판과 2판의 차이 Jeremy Howard, 2026-08(2026-09-17, 2026-09-27)
5 Optimizing your website for generative AI features on Google Search llms.txt 같은 AI 텍스트 파일을 보는 구글 검색 입장 Google Search Central, 2026-07-10 갱신(2026-09-17, 2026-09-27)
6 Search Central documentation updates 2026-06-15 llms.txt 설명 보강 Google Search Central(2026-09-17, 2026-09-27)
7 Does Anthropic crawl data from the web Anthropic 크롤러 설정 Anthropic(2026-09-17, 2026-09-27)
8 GenAI AEO 진단 기준 5개 영역 19개 항목 GenAI Labs, 기준 2026.09.15-2 판(2026-09-17)

글쓴이 박수현(젠아이랩스 대표) with AI (Claude Opus 5). 컨텍스트 엔지니어링을 다룬 『바이브 코딩의 시대, 프롬프트를 넘어 컨텍스트 엔지니어링으로』 등 AI 실무서 네 권을 썼습니다.

보완 · 한눈에 보기와 "만들어야 하나" 답, 꽃집 장면과 안내 브로슈어 비유, 동네 가게형 예시와 줄별 풀이, 브라우저 확인법을 더하고 용어를 풀었으며 Link 헤더·API 문서 예시·확인 명령을 개발자 심화로 옮겼다.

출처

  1. The /llms.txt file, v2 · 2024-09-03
  2. Overview of OpenAI Crawlers
  3. Perplexity Crawlers
  4. llms.txt Changes
  5. Optimizing your website for generative AI features on Google Search · 2026-07-10
  6. Search Central documentation updates
  7. Does Anthropic crawl data from the web
  8. GenAI AEO 진단 기준
뉴스레터로 매주 받아보기 기술 블로그 목록