Докази · дані замість думок

Чи працює llms.txt: що показують дані

Заяви компаній — це одне, серверні логи — інше. Нижче зібрані дослідження, які вимірювали не наміри, а реальні звернення до файлів llms.txt. Це найнеприємніша частина теми для тих, хто продає «впровадження llms.txt» як послугу, і найкорисніша для тих, хто вирішує, куди вкласти час.

Ahrefs: 137 210 доменів

137 210 доменів дані за травень 2026 опубліковано 15.06.2026

Найбільше з відомих нам вимірювань. Автори — Louise Linehan та Xibeijia Guan. Вибірка: домени, у яких llms.txt у корені повертав код 200. Джерело даних — трафік із Ahrefs Web Analytics і Bot Analytics.

«97% of those files received zero traffic in May 2026. Nothing fetched them at all.»

«97 % цих файлів у травні 2026 року не отримали жодного трафіку. Їх узагалі ніхто не завантажував.» Ahrefs

Решта висновків дослідження:

ПоказникЗначенняЩо це означає
Файлів без жодного запиту97 %Абсолютна більшість llms.txt просто лежить
Запитів від ботів (серед тих 3 %, що мали трафік)96 %Людей ці файли майже не цікавлять — і це нормально
Запитів від іменованих AI-інструментів
«of the 3% of files that weren’t ignored»
19,5 %Тобто чотири пʼятих звернень до цих файлів — не від AI
SEO-інструменти аудиту21,7 %Найбільша окрема категорія — сканери самих же вебмайстрів
Інші та невпізнані14,9 %
Загальні вебкраулери13,1 %
Запитів до неіснуючих llms.txt від AI-ботів0AI-боти не «промацують» наявність файлу навмання

Розподіл усередині «AI»: агенти та агентна інфраструктура — 10,5 %, тренувальні краулери — 5,3 %, AI-асистенти — 2,5 %, боти пошуку та витягування — 1,1 %. Розподіл за окремими ботами наводить PPC Land із посиланням на те саме дослідження: GPTBot — 4,51 % запитів, ClaudeBot — 0,80 %, DeepseekBot — 0,02 %. PPC Land

Otterly.ai: 90 днів логів на одному сайті

62 100+ візитів AI-ботів 90 днів поспіль опубліковано 05.02.2026

Контрольований експеримент Томаса Пехама на одному сайті. Вибірка менша й менш репрезентативна, ніж в Ahrefs, зате це прямі серверні логи з повним контролем над умовами.

  • Із понад 62 100 візитів AI-ботів на /llms.txt припало 84 — це 0,1 % усього AI-трафіку.
  • Файл отримував утричі менше звернень, ніж середня сторінка сайту.
  • Кореляції між наявністю llms.txt і зростанням активності AI-краулерів не виявлено.

«llms.txt is not a significant driver of AI crawl behavior. AI agents are overwhelmingly discovering and consuming content via standard web pages and existing site structure, not via llms.txt.»

«llms.txt не є істотним чинником поведінки AI-краулерів. AI-агенти переважно знаходять і споживають контент через звичайні вебсторінки й наявну структуру сайту, а не через llms.txt.» Otterly.ai

Поширення: зростає швидко, читається мало

Це і є головний парадокс теми. За даними Originality.ai, які наводить PPC Land, за рік із червня 2025 по травень 2026 року:

8,8×

зростання кількості сайтів із llms.txt: з 4 088 до 36 120

107×

зростання llms-full.txt: з 23 до 2 463 сайтів

97 %

файлів за той самий період не отримали жодного запиту

Пояснення цьому просте й не потребує теорії змови: більшість файлів створена не людьми. Платформи документації генерують їх автоматично для всіх клієнтів, плагіни SEO додають одним перемикачем. Зростання кількості файлів вимірює поширення інструментів, а не попит на них із боку агентів.

Як правильно читати ці цифри

Тому чесний підсумок звучить так:

Де користь підтверджена

Технічна документація, API, SDK. Кодові агенти й розробники справді користуються такими файлами — зокрема тому, що на них посилаються вручну. Саме тому їх публікують OpenAI, Anthropic, Cloudflare, Stripe.

Де користь не підтверджена

Комерційні сайти, блоги, лендинги. Обіцянки «llms.txt приведе трафік із ChatGPT» не спираються на жодні виміряні дані. Google прямо каже, що на його видачу файл не впливає ніяк.

Що з цим робити

  1. Не очікуйте трафіку. Наявність файлу не є каналом залучення. Це технічна зручність для агентів.
  2. Оцініть вартість. Якщо ваша CMS генерує файл автоматично — вмикайте, це нічого не коштує. Якщо доводиться вести руками — порахуйте, чи вартий він цього часу.
  3. Не плутайте з доступом. Якщо ваша мета — щоб AI-системи бачили контент, працює robots.txt, а не llms.txt. Перевірити можна нашим тестером.
  4. Слідкуйте за Lighthouse. Аудит Chrome — це єдиний на сьогодні механізм, який робить наявність файлу вимірюваною для великої аудиторії. Якщо він стане жорсткішим, розрахунок зміниться.