Як створити llms.txt і навіщо він потрібен сайту

Пояснюємо, що таке llms.txt, коли він справді корисний, як правильно його оформити за специфікацією і чому він не є магічною кнопкою для AI SEO.

Практика та методологія Як створити llms.txt і навіщо він потрібен сайту
Зміст статті 0%
Що таке llms.txt Чому про нього заговорили саме зараз Кому llms.txt справді корисний Що llms.txt не робить Чим llms.txt відрізняється від robots.txt і sitemap.xml Якою має бути правильна структура Core pages Documentation Optional Які сторінки варто додавати Markdown-версії сторінок і llms-full.txt Як створити llms.txt без хаосу Типові помилки Як перевірити, що llms.txt зроблений добре Висновок Що ще почитати
Зміст статті

Що таке llms.txt? Це запропонований Markdown-файл у корені сайту з короткою картою найважливішого контенту для LLM та AI-агентів. Команда може опублікувати його й чекати, що ChatGPT або AI Overviews почнуть частіше цитувати сайт, але підтвердженої гарантії ранжування немає. Правильна назва файлу - llms.txt, а не llm.txt.

Для документації, SaaS і великих інформаційних сайтів файл може бути зручним навігаційним шаром. У матеріалі є структура llms.txt, готовий приклад, відмінності від robots.txt і sitemap.xml, пояснення llms-full.txt та способи перевірки. Базову рамку про AI-пошук дає стаття що таке AI-видимість і чому бізнесу вже недостатньо SEO.

Що таке llms.txt

На llmstxt.org llms.txt описаний як пропозиція стандартизувати файл /llms.txt, який допомагає LLM використовувати сайт під час inference, тобто в момент, коли користувач уже ставить запит моделі. Специфікацію опублікував Jeremy Howard 3 вересня 2024 року.

Уявімо звичайний сайт продукту. Для людини там усе нормально: меню, блоки з перевагами, форми, футер, перелінковка. Для агента, який має за кілька секунд зрозуміти, де документація, а де сторінка тарифів, усе складніше. HTML шумить: навігація, службові елементи, JavaScript, повтори одних і тих самих шматків інтерфейсу. У специфікації саме це і проговорено: моделям потрібне коротке, зрозуміле джерело з фоном і посиланнями на важливі сторінки (llmstxt.org).

Тому llms.txt ближчий до curated index, ніж до ще одного sitemap. Це коротка карта сайту для AI-інструментів: Cursor, агента у браузері, чат-бота з вебпошуком або внутрішнього асистента, якому потрібно швидко зрозуміти структуру ресурсу.

Kozak перетворює шум сайту на коротку карту ключових сторінок для llms.txt
Kozak перетворює шум сайту на коротку карту ключових сторінок для llms.txt

Чому про нього заговорили саме зараз

Тема виросла не з теорії.

Файл уже потрапив у практику реальних документаційних сайтів. Наприклад, X Developer Docs публікує і llms.txt, і llms-full.txt, а також Markdown-версії окремих сторінок через суфікс .md.

Chrome Lighthouse уже має окремий audit для llms.txt. Але це не ознака "нового must-have". Навпаки: документація Chrome прямо каже, що якщо llms.txt повертає 404, аудит позначається як Not Applicable, бо на поточний момент файл опційний.

І ще одна причина вже ближча до бізнесу: ринок шукає простий спосіб зробити сайт зрозумілішим для AI. Саме тут і починаються перебільшення. llms.txt справді може зменшити хаос для агента, але він не замінює ні якісний контент, ні технічне SEO, ні зовнішні згадки про бренд.

Кому llms.txt справді корисний

Найкраще llms.txt працює там, де сайт має багато сторінок і де AI-інструменту легко збитися з маршруту вже на старті.

Тип сайтуДе є практична користь
Developer docs, API, SDKДає агенту короткий індекс документації та посилання на головні розділи
SaaS або сервісний сайтПоказує канонічні сторінки про продукт, тарифи, безпеку, FAQ, інтеграції
E-commerceДопомагає звести в один файл політики, категорії, довідку про доставку й повернення
Освітній або контентний проєктДає короткий шлях до ключових матеріалів без потреби сканувати весь архів
Корпоративний сайтДопомагає агенту швидко знайти сторінки про компанію, послуги, кейси й контакти

Якщо у вас docs-сайт або складний SaaS, користь майже пряма: агент швидше дістається до потрібних точок входу. Якщо це маленький сайт-візитка на 3-5 сторінок, ефект буде скромніший. Там і без окремого індексу часто все зрозуміло.

Що llms.txt не робить

Саме тут зазвичай і псуються очікування.

  • llms.txt не замінює robots.txt і не керує доступом ботів.
  • llms.txt не замінює sitemap.xml і не є повним списком індексованих URL.
  • llms.txt не гарантує, що ChatGPT, Gemini, Claude або Google AI Overviews почнуть цитувати сайт.
  • llms.txt не виправляє слабкий контент, погану інформаційну архітектуру або блокування краулерів.
  • llms.txt не є сигналом ранжування, який публічно підтвердили як обов'язковий Google чи OpenAI.

Це краще проговорити в команді до публікації файлу. Інакше від llms.txt починають чекати того, чого він технічно дати не може.

Позиція Google тут доволі пряма. У Google Search Central сказано, що для появи в AI Overviews і AI Mode немає додаткових технічних вимог, а також не потрібно створювати нові machine-readable AI text files або спеціальну schema.org-розмітку. Звідси і практичний висновок: llms.txt - корисне доповнення для discoverability та зручності агентів, але не обов'язкова умова для видимості в Google AI.

Чим llms.txt відрізняється від robots.txt і sitemap.xml

Їх часто згадують поруч, але задачі в них різні.

ФайлОсновна рольЧого від нього не варто очікувати
robots.txtПоказує, який доступ для автоматизованих систем вважається дозволеним або небажанимНе пояснює зміст сайту
sitemap.xmlДає пошуковикам список URL для обходу й індексаціїНе є curated guide для LLM
llms.txtДає LLM короткий контекст і список найважливіших сторінокНе є інструментом контролю crawl або повною картою всіх URL

На llmstxt.org це сформульовано прямо: llms.txt створений, щоб співіснувати з наявними стандартами, а не замінювати їх.

Kozak розкладає robots.txt, sitemap.xml і llms.txt за різними ролями
Kozak розкладає robots.txt, sitemap.xml і llms.txt за різними ролями

Якою має бути правильна структура

Тут усе простіше, ніж здається. Специфікація пропонує короткий Markdown-файл, і обов'язковою є лише одна частина - H1 з назвою сайту або проєкту.

Що має бути у файлі:

  1. # Назва сайту - єдина обов'язкова секція.
  2. Короткий blockquote з описом - рекомендовано.
  3. За потреби кілька абзаців без заголовків - щоб пояснити, як читати файл.
  4. Один або кілька H2-розділів.
  5. Усередині кожного H2 - список посилань у форматі Markdown з коротким описом.

У специфікації також є важливий нюанс: секція ## Optional має спеціальне значення. Посилання в ній можна пропустити, якщо агенту потрібен коротший контекст (llmstxt.org).

Kozak збирає рекомендовану Markdown-структуру llms.txt з summary, core pages і optional
Kozak збирає рекомендовану Markdown-структуру llms.txt з summary, core pages і optional

Мінімальний шаблон може виглядати так:

# Example Site

> Короткий опис сайту та того, для чого він існує.

Тут можна коротко пояснити, які сторінки є канонічними і де шукати головні відповіді.

## Core pages

- [About](https://example.com/about): Хто ми і що робимо.
- [Product](https://example.com/product): Опис продукту й основних сценаріїв.
- [Pricing](https://example.com/pricing): Тарифи, пакети та умови.

## Documentation

- [Quick start](https://example.com/docs/quick-start.md): Найкоротший шлях до старту.
- [API reference](https://example.com/docs/api.md): Технічна документація API.

## Optional

- [Blog](https://example.com/blog): Додаткові матеріали й аналітика.

Які сторінки варто додавати

Найчастіше помиляються в одному місці: намагаються перетворити llms.txt на звалище всіх URL сайту. У цей момент файл втрачає сенс.

Краще додавати лише ті сторінки, які справді відповідають на ключові запитання про бізнес або продукт:

  • сторінки продукту чи послуг;
  • документацію, quick start, API reference;
  • тарифи, умови оплати, SLA;
  • FAQ, підтримку, довідкові матеріали;
  • сторінки про компанію, контакти, безпеку, політики;
  • кілька справді сильних evergreen-матеріалів, якщо блог є частиною експертної репутації.

Для блогу теж потрібен відбір. Не тягніть у llms.txt увесь архів. Краще лишити 3-10 матеріалів, після яких агент справді краще розуміє тему. Наприклад, для теми AI-видимості доречними будуть статті як аналізувати джерела, на які спирається ШІ, як структуровані дані впливають на AI-видимість і які сторінки сайту найчастіше потрапляють у відповіді ШІ.

Markdown-версії сторінок і llms-full.txt

Це одна з найпрактичніших частин специфікації, про яку часто забувають. На llmstxt.org пропонується, щоб сторінки, корисні для LLM, мали чисту Markdown-версію на тому самому URL із суфіксом .md. Якщо URL закінчується не назвою файлу, а шляхом, специфікація пропонує варіант index.html.md.

На практиці це зручно: агенту простіше читати чистий Markdown, ніж пробиратися крізь повний HTML із меню, банерами й службовими елементами.

Окремо варто розрізняти llms.txt і llms-full.txt.

  • llms.txt - це короткий індекс і навігація.
  • llms-full.txt - це повний зведений контекст, якщо сайт справді хоче віддати агенту багато документації одним файлом.

У X Developer Docs це зроблено саме так: короткий llms.txt для навігації, окремі розділові llms.txt для піддерев документації і llms-full.txt для глибокого контексту. Для SaaS-документації це сильний патерн. Для невеликого корпоративного сайту він часто зайвий.

Як створити llms.txt без хаосу

Перший імпульс тут зазвичай такий: сісти й руками накидати 20-30 посилань. Краще не поспішати. Спочатку відбір, потім файл.

  1. Проведіть короткий аудит контенту. Визначте 10-30 сторінок, які реально пояснюють сайт.
  2. Вирішіть, які з них канонічні. Якщо є дві схожі сторінки, лишіть одну сильнішу.
  3. Напишіть короткий summary для початку файлу. Без маркетингової води, тільки суть.
  4. Розбийте посилання на зрозумілі секції: Core pages, Product, Docs, Policies, Optional.
  5. До кожного URL додайте короткий опис. Добрий опис підказує, навіщо відкривати саме цю сторінку.
  6. Якщо сайт має цінну документацію, підготуйте .md-версії сторінок.
  7. Опублікуйте файл у корені сайту за адресою https://domain.com/llms.txt і перевірте, що він віддає 200 OK.

Корисне правило: якщо опис сторінки не допомагає людині зрозуміти, навіщо цей URL, агенту він теж навряд чи допоможе.

Типові помилки

Сам файл простий. Проблеми майже завжди не технічні, а редакторські.

  • Публікують llm.txt, ai.txt або LLMS.txt замість llms.txt.
  • Додають усі URL сайту без відбору.
  • Пишуть рекламний текст замість конкретного summary.
  • Вставляють посилання на сторінки, які застаріли, дублюються або закриті для користувача.
  • Не оновлюють файл після змін у тарифах, документації чи структурі сайту.
  • Очікують миттєвого росту трафіку лише через факт наявності файлу.
  • Змішують призначення llms.txt із правилами доступу, які насправді мають жити в robots.txt.

Окрема помилка - не узгодити llms.txt з реальною архітектурою сайту. Якщо у файлі написано, що канонічна сторінка одна, а агент потрапляє на іншу через редиректи, noindex або блокування в CDN, користі буде мало.

Як перевірити, що llms.txt зроблений добре

Перший тест банальний, але багато файлів валяться вже тут: чи відкривається https://domain.com/llms.txt без авторизації і чи віддає він нормальний 200 OK. Далі вже має сенс дивитися на зміст.

Що перевіритиЩо вважається нормою
URL файлуhttps://domain.com/llms.txt відкривається без авторизації
HTTP-відповідь200 OK, без ланцюжка дивних редиректів
ФорматВалідний Markdown, зрозумілий порядок секцій, немає битих посилань
ЗмістУ файлі лише ключові сторінки, а не весь сайт
ОчікуванняКоманда розуміє, що це допоміжний discovery-файл, а не гарантований SEO-фактор

Як додаткова перевірка підійде Lighthouse audit для llms.txt. Але тут важливо не підмінити логіку чекбоксом. Chrome сам вважає файл опційним. Отже, сайт без llms.txt не є "зламаним", а сайт із llms.txt не стає автоматично видимим у всіх AI-відповідях.

Ще одна практична перевірка - відкрити llms.txt у реальному AI-інструменті й подивитися, чи зміг він коректно зорієнтуватися в структурі сайту. Якщо відповідь досі спирається на випадкові сторінки, проблема, швидше за все, не у відсутності файла, а у слабкій контентній архітектурі або зовнішніх сигналах.

Kozak перевіряє llms.txt за відповіддю 200 OK, Markdown, посиланнями й AI-тестом
Kozak перевіряє llms.txt за відповіддю 200 OK, Markdown, посиланнями й AI-тестом

Висновок

llms.txt варто робити не тому, що "так треба для AI SEO", а тому, що це недорогий спосіб дати агентам коротку, контрольовану карту сайту. Найбільше сенсу він має для документації, SaaS, knowledge base і сайтів, де без контексту легко піти не туди вже на першому кроці.

Чесна рамка проста: llms.txt не замінює SEO, не підміняє robots.txt, не скасовує потребу в хорошому контенті й не гарантує появу в AI Overviews чи ChatGPT Search. Він просто робить сайт зрозумілішим для тих інструментів, які цей файл читають. А далі вже працює вся решта: структура сайту, текстовий контент, відкритий crawl і зрозумілі джерела бренду в мережі.

Що ще почитати

Далі

Що варто прочитати далі

Усі матеріали
// Спробуйте на своїх запитах

Подивіться, як AI бачить ваш бренд у VYDAI

Створіть акаунт, додайте домен і перевірте реальні запити: у відповідях яких моделей є бренд, які джерела його підтримують і хто з конкурентів зʼявляється поруч.

Зареєструватися у VYDAI