llms.txt: нужен ли он вашему сайту в 2026 году — что говорят данные, а не агентства

97% файлов llms.txt никто не читает — данные Ahrefs на 137 000 доменов. Google его не поддерживает. Что это за файл, кому он всё-таки нужен и что сделать вместо него, чтобы ChatGPT вас назвал.

Опубликовано: 15 сентября 2026 г. Обновлено: 15 сентября 2026 г.
GEOllms.txtChatGPTAI Search

Если вы искали «llms.txt что это», то уже видели десяток статей с одним и тем же выводом: «обязательно создайте, иначе ChatGPT вас не увидит». Я разберу, откуда взялся этот файл, что о нём говорят Google и логи серверов на 137 тысячах доменов, что показал наш собственный разбор 30 сайтов — и что делать вместо того, чтобы полагаться на один текстовый файл.

Коротко: файл безвреден, стоит десять минут и почти никем не читается. Если у вас нет разметки на страницах, начинать нужно не с него.

Коротко, если некогда читать целиком

  • llms.txt — текстовый файл в корне сайта с описанием и списком главных страниц. Предложен в сентябре 2024 года как «карта сайта для языковых моделей».
  • Google его не поддерживает и не планирует — сказано прямо в июле 2025 года. В 2026-м Google внёс llms.txt в список мифов о продвижении в ИИ-поиске.
  • По данным Ahrefs за май 2026 года (137 210 доменов), 97% файлов llms.txt не получили ни одного запроса. Среди тех, к кому запросы были, 96% пришлись на ботов — в основном не ИИ. На ботов ChatGPT и Perplexity пришёлся около 1%.
  • В нашем разборе 30 сайтов стоматологий Алматы llms.txt был у одного. При этом ChatGPT назвал 14 клиник из 30 — и назвал их не за файл, а за разметку и конкретные факты на страницах.
  • Делать файл можно. Делать его вместо разметки — ошибка, которая стоит клиентов.

Что это за файл и откуда он взялся

В сентябре 2024 года Джереми Ховард, сооснователь Answer.AI, предложил простой формат: положить в корень сайта файл llms.txt — обычный текст в разметке Markdown. Внутри: заголовок с названием, короткое описание в одну-две фразы и список ссылок на главные страницы с пояснением, что на каждой лежит.

Идея была в том, что языковой модели тяжело читать сайт целиком — навигация, скрипты, баннеры, повторяющиеся блоки. Файл должен был дать ей «выжимку»: вот кто мы, вот что важно, вот куда смотреть.

Формат оказался лёгким, и его быстро подхватили: генераторы, валидаторы, плагины для WordPress, десятки статей «как создать llms.txt за пять минут». К маю 2026 года, по оценке Ahrefs, файл публиковали около 28% из 137 тысяч исследованных доменов — и это доля среди клиентов SEO-сервиса, то есть среди более технически подготовленных сайтов. По всему интернету доля ниже.

Так выглядит наш собственный файл — infolady.online/llms.txt: название, абзац о том, чем занимается сервис, разделы со ссылками. Ничего сложного.

Что говорит Google

Здесь всё однозначно, и это важно, потому что русскоязычные статьи об этом обычно молчат.

В июле 2025 года на Search Central Live Гэри Илш из команды Google Search сказал, что Google не поддерживает llms.txt и не планирует. Джон Мюллер сравнил файл с мета-тегом keywords — тем самым, который поисковики перестали читать больше десяти лет назад. Логика простая: сигнал, который заполняет сам владелец сайта, ничего не стоит для того, кто сайт оценивает. Любой напишет о себе «лучшая клиника города».

Когда кто-то заметил, что у некоторых сервисов самого Google есть llms.txt, Мюллер пояснил: файл появился из-за внутренней системы публикации, которая добавила его автоматически, и команда поиска его не использует.

В 2026 году Google выпустил инструкцию для владельцев сайтов по ИИ-функциям поиска. В ней есть раздел «мифы» — и llms.txt назван там по имени как приём, который не помогает.

Это касается Google, Gemini и AI Overviews — то есть большей части поискового трафика. Для них файл — ноль.

Что показали логи 137 тысяч доменов

Утверждение «Google не читает» можно было бы уравновесить: «зато читают ChatGPT и Perplexity». Проверить это можно только по логам серверов — кто реально запрашивает файл. В июне 2026 года Ahrefs опубликовал такое исследование по 137 210 доменам, получавшим трафик в мае.

Результаты:

Что измерили Результат
Домены с файлом llms.txt около 28%
Файлы, получившие хотя бы один запрос за месяц 3% (97% — ни одного)
Из ~38 000 корректных файлов получили трафик около 1 100
Кто запрашивал файлы, у которых были запросы 96% боты
Доля запросов от ИИ-ботов ChatGPT и Perplexity около 1%
Крупнейшие источники запросов SEO-инструменты (21%), неопознанные боты (14%), обычные поисковые краулеры (13%), сервисы профилирования технологий (11%)

То есть файл читают в основном сервисы, которые проверяют, есть ли у вас файл. Замкнутый круг: SEO-аудиторы находят llms.txt, ставят галочку — и это почти весь его трафик.

Есть обзоры, где утверждается, что Anthropic и Perplexity поддерживают формат. Возможно, в каких-то сценариях — да. Но на объёме запросов к файлам это не видно: один процент от трёх процентов. Если ассистент и заглядывает в llms.txt, то редко и не там, где решается, кого он назовёт в ответе.

Что мы увидели на 30 сайтах

8 сентября мы разобрали 30 сайтов стоматологий Алматы нашим движком и дважды задали ChatGPT десять вопросов пациентов — полный разбор с таблицами здесь. Файл llms.txt нашёлся у одного сайта из тридцати.

При этом ChatGPT назвал хотя бы раз 14 клиник из 30. Клиника, которую он назвал чаще всех — 10 ответов из 19, — llms.txt не имеет. У неё есть другое: разметка Schema.org с типом «стоматология», размеченные цены по системам брекетов, адреса двух филиалов с телефонами, условия рассрочки текстом на странице. Ассистент цитирует именно это — дословно, со ссылкой на страницу.

А у 19 сайтов из 30 нет разметки вообще. Часы работы размечены у двух, рейтинг у трёх. Медианный сайт «читается» машиной на 23%: из одиннадцати фактов о бизнесе она уверенно знает два-три.

Вот где настоящая дыра. Не в отсутствии файла в корне — в том, что на самих страницах машине нечего взять.

Почему файл не заменяет разметку

Разница принципиальная, и её стоит понять один раз.

llms.txt — это то, что вы говорите о себе. Описание, список ссылок. Никакой проверки, никакой связи с содержимым страниц. Именно поэтому Google сравнил его с мета-тегом keywords.

Разметка Schema.org — это то, что машина проверяет на самой странице. Телефон в разметке telephone стоит рядом с телефоном в тексте. Часы работы openingHours совпадают с тем, что написано в подвале. Цена в Offer — с ценой в прайсе. Ассистент, читая страницу, получает факт и подтверждение факта одновременно.

Когда пациент спрашивает «какая стоматология открыта сейчас», ассистенту нужны часы работы конкретной клиники. Он идёт на страницу, а не в корень сайта за описанием. Если часов нет ни в разметке, ни текстом — клиники нет в ответе, сколько бы файлов ни лежало в корне.

Так делать или нет

Делать. Но в правильном порядке.

Сначала — то, что читают все.

  1. Разметка Schema.org на главной и на страницах услуг: тип организации (не «Organization», а конкретный — Dentist, LocalBusiness, Store), адрес, телефон, часы, цены, рейтинг, ссылки на соцсети.
  2. Открытый доступ ИИ-роботам в robots.txt: GPTBot, OAI-SearchBot, ClaudeBot, PerplexityBot, Google-Extended. Закрытый робот не может процитировать вас, что бы вы ни написали.
  3. Конкретика текстом там, где её ждут: адрес и часы одной строкой на главной, цены цифрами, а не «уточняйте у администратора». Одна из клиник в нашем разборе часы не размечала — но написала их рядом с адресом, и ассистент их прочитал и процитировал.
  4. Заголовки в форме вопросов клиента с коротким ответом под каждым: «Сколько стоит имплант?», «Есть ли рассрочка?». Это то, что ассистент цитирует в первую очередь.

Потом — llms.txt. Десять минут: название, два предложения о том, чем вы занимаетесь и для кого, десять ссылок на главные страницы. Вреда нет. Пользы, судя по логам, почти нет тоже — но если через год ситуация изменится, файл у вас уже будет.

💡 Что машина видит на вашем сайте прямо сейчас — покажет бесплатный разбор: есть ли llms.txt, robots.txt и карта сайта, пущены ли девять групп ИИ-роботов, и какие из одиннадцати фактов о бизнесе машина читает, а какие — нет. Без регистрации.

Частые ошибки

Файл есть, а разметки нет. Самый частый случай у тех, кто прочитал «создайте llms.txt» и остановился. Галочка в аудите стоит, ассистент по-прежнему называет конкурента.

Файл на английском у русскоязычного сайта. Модели многоязычны, но зачем усложнять. Пишите на языке клиентов.

Файл-простыня. Сотни ссылок на все страницы подряд. Смысл формата — выжимка. Десять-двадцать главных страниц, не больше.

Ссылки на страницы, закрытые в robots.txt. Файл зовёт робота туда, куда его не пускают.

Ожидание результата от файла. Проверять «назвал ли меня ChatGPT» нужно после разметки, а не после llms.txt. И проверять вопросами клиентов, а не «расскажи о компании такой-то» — на прямой вопрос ассистент ответит про кого угодно.

Заключение

llms.txt — хорошая идея, которую пока никто из крупных игроков не подхватил. Google отказался прямо. По логам 137 тысяч доменов файл почти не читают, а ИИ-боты — тем более. В нашем разборе 30 сайтов он был у одного, и не у того, кого ассистент называл чаще всех.

Что действительно решает, кого назовёт ChatGPT, — разметка и конкретные факты на страницах. Это дольше десяти минут, но это то, что машина читает и проверяет. Сделайте это первым. Файл — вторым, если останется желание.


Источники: исследование Ahrefs «We Analyzed 137K Sites: 97% of llms.txt Files Never Get Read» (июнь 2026, 137 210 доменов, данные за май 2026); заявления Гэри Илша и Джона Мюллера (Google), Search Central Live, июль 2025; инструкция Google по ИИ-функциям поиска, 2026; разбор 30 сайтов стоматологий Алматы движком InfoLady, 8 сентября 2026. Все числа о сайтах Алматы посчитаны на наших данных; прогнозов и оценок «на глаз» в статье нет.

Частые вопросы

Что такое llms.txt простыми словами?
Текстовый файл в корне сайта (например, site.kz/llms.txt), в котором владелец коротко описывает, что это за сайт, и даёт список главных страниц со ссылками. Формат — Markdown. Предложен в сентябре 2024 года Джереми Ховардом из Answer.AI как «robots.txt для языковых моделей».
Читает ли Google файл llms.txt?
Нет. В июле 2025 года Гэри Илш из Google сказал, что Google не поддерживает llms.txt и не планирует. Джон Мюллер сравнил его с мета-тегом keywords — сигналом, который заполняет сам владелец сайта и который поэтому никто не читает. В инструкции Google по ИИ-функциям поиска за 2026 год llms.txt назван прямо в списке того, что не помогает.
А ChatGPT и Perplexity читают llms.txt?
По логам Ahrefs (137 210 доменов, май 2026) на ИИ-ботов ChatGPT и Perplexity пришёлся около 1% запросов к этим файлам. Отдельные сервисы заявляют о поддержке формата, но на объёме трафика это пока не видно.
Значит, llms.txt делать не нужно?
Сделать можно — это десять минут и ноль риска. Но не вместо разметки, а после неё. Если у сайта нет Schema.org, не размечены адрес, телефон, часы и цены, файл llms.txt ничего не изменит: ассистент берёт факты со страниц, а не из описания в корне.
Как проверить, есть ли llms.txt у моего сайта и что на самом деле читает машина?
Бесплатный разбор на infolady.online проверяет наличие llms.txt, robots.txt и карты сайта, доступ девяти групп ИИ-роботов и одиннадцать фактов о бизнесе, которые машина должна уметь прочитать. Без регистрации.

Ещё статьи по теме