Если вы искали «llms.txt что это», то уже видели десяток статей с одним и тем же выводом: «обязательно создайте, иначе ChatGPT вас не увидит». Я разберу, откуда взялся этот файл, что о нём говорят Google и логи серверов на 137 тысячах доменов, что показал наш собственный разбор 30 сайтов — и что делать вместо того, чтобы полагаться на один текстовый файл.
Коротко: файл безвреден, стоит десять минут и почти никем не читается. Если у вас нет разметки на страницах, начинать нужно не с него.
Коротко, если некогда читать целиком
- llms.txt — текстовый файл в корне сайта с описанием и списком главных страниц. Предложен в сентябре 2024 года как «карта сайта для языковых моделей».
- Google его не поддерживает и не планирует — сказано прямо в июле 2025 года. В 2026-м Google внёс llms.txt в список мифов о продвижении в ИИ-поиске.
- По данным Ahrefs за май 2026 года (137 210 доменов), 97% файлов llms.txt не получили ни одного запроса. Среди тех, к кому запросы были, 96% пришлись на ботов — в основном не ИИ. На ботов ChatGPT и Perplexity пришёлся около 1%.
- В нашем разборе 30 сайтов стоматологий Алматы llms.txt был у одного. При этом ChatGPT назвал 14 клиник из 30 — и назвал их не за файл, а за разметку и конкретные факты на страницах.
- Делать файл можно. Делать его вместо разметки — ошибка, которая стоит клиентов.
Что это за файл и откуда он взялся
В сентябре 2024 года Джереми Ховард, сооснователь Answer.AI, предложил простой формат: положить в корень сайта файл llms.txt — обычный текст в разметке Markdown. Внутри: заголовок с названием, короткое описание в одну-две фразы и список ссылок на главные страницы с пояснением, что на каждой лежит.
Идея была в том, что языковой модели тяжело читать сайт целиком — навигация, скрипты, баннеры, повторяющиеся блоки. Файл должен был дать ей «выжимку»: вот кто мы, вот что важно, вот куда смотреть.
Формат оказался лёгким, и его быстро подхватили: генераторы, валидаторы, плагины для WordPress, десятки статей «как создать llms.txt за пять минут». К маю 2026 года, по оценке Ahrefs, файл публиковали около 28% из 137 тысяч исследованных доменов — и это доля среди клиентов SEO-сервиса, то есть среди более технически подготовленных сайтов. По всему интернету доля ниже.
Так выглядит наш собственный файл — infolady.online/llms.txt: название, абзац о том, чем занимается сервис, разделы со ссылками. Ничего сложного.
Что говорит Google
Здесь всё однозначно, и это важно, потому что русскоязычные статьи об этом обычно молчат.
В июле 2025 года на Search Central Live Гэри Илш из команды Google Search сказал, что Google не поддерживает llms.txt и не планирует. Джон Мюллер сравнил файл с мета-тегом keywords — тем самым, который поисковики перестали читать больше десяти лет назад. Логика простая: сигнал, который заполняет сам владелец сайта, ничего не стоит для того, кто сайт оценивает. Любой напишет о себе «лучшая клиника города».
Когда кто-то заметил, что у некоторых сервисов самого Google есть llms.txt, Мюллер пояснил: файл появился из-за внутренней системы публикации, которая добавила его автоматически, и команда поиска его не использует.
В 2026 году Google выпустил инструкцию для владельцев сайтов по ИИ-функциям поиска. В ней есть раздел «мифы» — и llms.txt назван там по имени как приём, который не помогает.
Это касается Google, Gemini и AI Overviews — то есть большей части поискового трафика. Для них файл — ноль.
Что показали логи 137 тысяч доменов
Утверждение «Google не читает» можно было бы уравновесить: «зато читают ChatGPT и Perplexity». Проверить это можно только по логам серверов — кто реально запрашивает файл. В июне 2026 года Ahrefs опубликовал такое исследование по 137 210 доменам, получавшим трафик в мае.
Результаты:
| Что измерили | Результат |
|---|---|
| Домены с файлом llms.txt | около 28% |
| Файлы, получившие хотя бы один запрос за месяц | 3% (97% — ни одного) |
| Из ~38 000 корректных файлов получили трафик | около 1 100 |
| Кто запрашивал файлы, у которых были запросы | 96% боты |
| Доля запросов от ИИ-ботов ChatGPT и Perplexity | около 1% |
| Крупнейшие источники запросов | SEO-инструменты (21%), неопознанные боты (14%), обычные поисковые краулеры (13%), сервисы профилирования технологий (11%) |
То есть файл читают в основном сервисы, которые проверяют, есть ли у вас файл. Замкнутый круг: SEO-аудиторы находят llms.txt, ставят галочку — и это почти весь его трафик.
Есть обзоры, где утверждается, что Anthropic и Perplexity поддерживают формат. Возможно, в каких-то сценариях — да. Но на объёме запросов к файлам это не видно: один процент от трёх процентов. Если ассистент и заглядывает в llms.txt, то редко и не там, где решается, кого он назовёт в ответе.
Что мы увидели на 30 сайтах
8 сентября мы разобрали 30 сайтов стоматологий Алматы нашим движком и дважды задали ChatGPT десять вопросов пациентов — полный разбор с таблицами здесь. Файл llms.txt нашёлся у одного сайта из тридцати.
При этом ChatGPT назвал хотя бы раз 14 клиник из 30. Клиника, которую он назвал чаще всех — 10 ответов из 19, — llms.txt не имеет. У неё есть другое: разметка Schema.org с типом «стоматология», размеченные цены по системам брекетов, адреса двух филиалов с телефонами, условия рассрочки текстом на странице. Ассистент цитирует именно это — дословно, со ссылкой на страницу.
А у 19 сайтов из 30 нет разметки вообще. Часы работы размечены у двух, рейтинг у трёх. Медианный сайт «читается» машиной на 23%: из одиннадцати фактов о бизнесе она уверенно знает два-три.
Вот где настоящая дыра. Не в отсутствии файла в корне — в том, что на самих страницах машине нечего взять.
Почему файл не заменяет разметку
Разница принципиальная, и её стоит понять один раз.
llms.txt — это то, что вы говорите о себе. Описание, список ссылок. Никакой проверки, никакой связи с содержимым страниц. Именно поэтому Google сравнил его с мета-тегом keywords.
Разметка Schema.org — это то, что машина проверяет на самой странице. Телефон в разметке telephone стоит рядом с телефоном в тексте. Часы работы openingHours совпадают с тем, что написано в подвале. Цена в Offer — с ценой в прайсе. Ассистент, читая страницу, получает факт и подтверждение факта одновременно.
Когда пациент спрашивает «какая стоматология открыта сейчас», ассистенту нужны часы работы конкретной клиники. Он идёт на страницу, а не в корень сайта за описанием. Если часов нет ни в разметке, ни текстом — клиники нет в ответе, сколько бы файлов ни лежало в корне.
Так делать или нет
Делать. Но в правильном порядке.
Сначала — то, что читают все.
- Разметка Schema.org на главной и на страницах услуг: тип организации (не «Organization», а конкретный —
Dentist,LocalBusiness,Store), адрес, телефон, часы, цены, рейтинг, ссылки на соцсети. - Открытый доступ ИИ-роботам в robots.txt: GPTBot, OAI-SearchBot, ClaudeBot, PerplexityBot, Google-Extended. Закрытый робот не может процитировать вас, что бы вы ни написали.
- Конкретика текстом там, где её ждут: адрес и часы одной строкой на главной, цены цифрами, а не «уточняйте у администратора». Одна из клиник в нашем разборе часы не размечала — но написала их рядом с адресом, и ассистент их прочитал и процитировал.
- Заголовки в форме вопросов клиента с коротким ответом под каждым: «Сколько стоит имплант?», «Есть ли рассрочка?». Это то, что ассистент цитирует в первую очередь.
Потом — llms.txt. Десять минут: название, два предложения о том, чем вы занимаетесь и для кого, десять ссылок на главные страницы. Вреда нет. Пользы, судя по логам, почти нет тоже — но если через год ситуация изменится, файл у вас уже будет.
💡 Что машина видит на вашем сайте прямо сейчас — покажет бесплатный разбор: есть ли llms.txt, robots.txt и карта сайта, пущены ли девять групп ИИ-роботов, и какие из одиннадцати фактов о бизнесе машина читает, а какие — нет. Без регистрации.
Частые ошибки
Файл есть, а разметки нет. Самый частый случай у тех, кто прочитал «создайте llms.txt» и остановился. Галочка в аудите стоит, ассистент по-прежнему называет конкурента.
Файл на английском у русскоязычного сайта. Модели многоязычны, но зачем усложнять. Пишите на языке клиентов.
Файл-простыня. Сотни ссылок на все страницы подряд. Смысл формата — выжимка. Десять-двадцать главных страниц, не больше.
Ссылки на страницы, закрытые в robots.txt. Файл зовёт робота туда, куда его не пускают.
Ожидание результата от файла. Проверять «назвал ли меня ChatGPT» нужно после разметки, а не после llms.txt. И проверять вопросами клиентов, а не «расскажи о компании такой-то» — на прямой вопрос ассистент ответит про кого угодно.
Заключение
llms.txt — хорошая идея, которую пока никто из крупных игроков не подхватил. Google отказался прямо. По логам 137 тысяч доменов файл почти не читают, а ИИ-боты — тем более. В нашем разборе 30 сайтов он был у одного, и не у того, кого ассистент называл чаще всех.
Что действительно решает, кого назовёт ChatGPT, — разметка и конкретные факты на страницах. Это дольше десяти минут, но это то, что машина читает и проверяет. Сделайте это первым. Файл — вторым, если останется желание.
Источники: исследование Ahrefs «We Analyzed 137K Sites: 97% of llms.txt Files Never Get Read» (июнь 2026, 137 210 доменов, данные за май 2026); заявления Гэри Илша и Джона Мюллера (Google), Search Central Live, июль 2025; инструкция Google по ИИ-функциям поиска, 2026; разбор 30 сайтов стоматологий Алматы движком InfoLady, 8 сентября 2026. Все числа о сайтах Алматы посчитаны на наших данных; прогнозов и оценок «на глаз» в статье нет.