Разработка

llms.txt: нужен ли сайту файл для нейросетей

llms.txt — текстовый файл в корне сайта, который в формате Markdown описывает, что это за проект и какие страницы считать основными. Его предложил Джереми Ховард из fast.ai в сентябре 2024 года как неформальную спецификацию; ни W3C, ни IETF её не утверждали. Google в документации Search Central прямо пишет, что специальные машиночитаемые файлы для появления в AI Overviews и AI Mode не нужны, а независимые замеры показывают, что ИИ-краулеры обращаются к файлу редко. При этом собрать llms.txt автоматически стоит примерно ничего. Разбираем, что внутри файла, кто его читает, как сгенерировать его из данных сайта и в каких случаях он действительно оправдан.

17 августа 2026 г.11 мин чтенияРедакция Юнкис

Коротко о главном

  • llms.txt — неформальная спецификация 2024 года от Джереми Ховарда, ни одной организацией по стандартизации не утверждённая.
  • Google прямо пишет, что специальные машиночитаемые файлы для попадания в AI Overviews и AI Mode не нужны; отдельного статуса у llms.txt нет.
  • По логам обращения ИИ-краулеров к файлу единичны — как канал доставки контента он сегодня почти не работает.
  • Делать имеет смысл только автоматическую генерацию из данных сайта: написанный руками файл устаревает и начинает вредить.
  • Файл оправдан для документации, крупных сайтов и собственных ИИ-агентов; как отдельная платная услуга с ручной поддержкой — нет.

1Что это за файл и откуда он взялся

llms.txt лежит по адресу /llms.txt и написан обычным Markdown. Структура простая: заголовок первого уровня с названием проекта, короткое описание в одну-две фразы, затем разделы со списками ссылок, у каждой — пояснение, что там находится. По задумке автора это курируемое оглавление для языковых моделей: не «весь сайт», как в sitemap.xml, а десятки самых важных страниц с человеческими подписями.

Формат предложил Джереми Ховард, сооснователь fast.ai, в сентябре 2024 года. Важная деталь, которую обычно опускают в рекламных статьях: это неформальная спецификация одного человека, а не стандарт. Её не принимала ни одна организация по стандартизации, и обязательств у ИИ-компаний по ней нет. Отсюда и разброс в ожиданиях: одни называют llms.txt «новым robots.txt», другие — новым meta keywords, тегом, который когда-то забили спамом и перестали учитывать.

  • Расположение: /llms.txt в корне домена, формат — Markdown.
  • Содержимое: название, описание проекта, разделы со ссылками и пояснениями.
  • Отличие от sitemap.xml: не полный список URL, а курируемая выборка главного.
  • Статус: неформальная спецификация с сентября 2024 года, стандартом не утверждена.

2Кто его реально читает

Честный ответ: точно — меньше, чем обещают. Google высказался определённо: в документации Search Central сказано, что для появления в AI Overviews и AI Mode не нужно создавать новые машиночитаемые файлы, «AI text files» или дополнительную разметку, — достаточно, чтобы страница была проиндексирована и могла показываться со сниппетом. Ещё в июле 2025 года представитель Google Гэри Иллиес говорил, что компания llms.txt не поддерживает и не планирует.

На стороне ИИ-сервисов картина мягче: часть систем файл читает или тестирует чтение, но официальных обязательств не берёт никто. Независимые замеры по логам показывают единичные обращения на фоне сотен миллионов заходов ботов — то есть как канал доставки контента файл сегодня практически не работает. Это не делает его вредным, но снимает вопрос «а не потеряем ли мы трафик без него»: не потеряете.

  • Google: специальные файлы для ИИ не требуются, отдельного статуса у llms.txt нет.
  • Часть ИИ-сервисов файл читает, но официальной поддержки формата никто не декларирует.
  • По логам обращения краулеров к llms.txt единичны на фоне общего трафика ботов.
  • Отсутствие файла не мешает попадать в ИИ-ответы — туда попадают обычные проиндексированные страницы.

3Как собрать его правильно

Единственный разумный способ — генерировать файл из тех же данных, которыми живёт сайт: списка статей, каталога услуг, разделов документации. Написанный руками llms.txt устаревает через месяц, и тогда он начинает приносить вред: показывает ИИ-системам страницы, которых уже нет, и умалчивает про новые. Автоматическая генерация снимает вопрос поддержки полностью — файл обновляется вместе с контентом.

По содержанию работает то же правило, что и в остальном AEO: краткость и однозначность. Один-два абзаца о том, чем занимается компания, затем разделы — услуги, статьи, документация, контакты — и в каждом ссылки с короткими пояснениями. Не нужно вываливать туда весь сайт: смысл файла в отборе. И не нужно писать в нём то, чего нет на страницах: расхождение между обещанием в оглавлении и реальным содержимым читается как шум.

  • Генерируйте из данных сайта, а не пишите руками — иначе файл протухнет.
  • Структура: название и описание проекта, затем тематические разделы со ссылками.
  • У каждой ссылки — короткое пояснение, что именно на странице.
  • Отбирайте: десятки ключевых страниц, а не полный список URL.
  • Абсолютные адреса и актуальные ссылки: битые URL обесценивают файл целиком.

4Когда файл действительно оправдан

Есть класс проектов, где llms.txt приносит пользу независимо от того, читают его краулеры или нет. Первый — техническая документация и API: там оглавление в Markdown полезно людям и удобно подставляется в контекст модели при работе с вашим продуктом. Второй — большие сайты со сложной структурой, где по одному sitemap.xml непонятно, что главное. Третий — компании, у которых есть собственные ИИ-агенты или интеграции: файл становится точкой входа для своих же систем.

И есть случай, когда он не нужен: небольшой сайт услуг на десяток страниц, где структура и так очевидна. Там время лучше вложить в скорость, индексацию и прямые ответы на страницах — эффект будет и в обычном поиске, и в ИИ-ответах. Отдельно стоит сказать про подрядчиков: если вам продают «внедрение llms.txt» как самостоятельную услугу с ощутимым бюджетом и ручной поддержкой, это повод задать вопрос, на чём основана оценка эффекта.

  • Оправдан: документация и API, крупные сайты со сложной структурой, свои ИИ-агенты.
  • Не оправдан как отдельный платный проект с ручной поддержкой.
  • Небольшому сайту услуг полезнее вложиться в скорость, индексацию и структуру ответов.
  • Стоимость автоматической генерации — часы работы разработчика, дальше поддержки не требует.

5Что делать вместо магии: рабочий минимум

Если цель — попадать в ИИ-ответы, набор действий известен и он скучнее, чем новый файл. Страница должна быть проиндексирована и отдавать текст в исходном HTML. Ответ на главный вопрос страницы должен стоять в первых предложениях под соответствующим заголовком. Данные, которые можно выразить машиночитаемо — цена, наличие, адрес, часы работы, вопросы и ответы, — стоит разметить через Schema.org, генерируя разметку из тех же данных, что рендерят страницу.

Дальше — доступ роботов. У ИИ-систем свои user-agent, и решение пускать их или нет принимается в robots.txt осознанно, а не по умолчанию. Полезно понимать, что robots.txt — это просьба, а не барьер: если нужен реальный запрет, он ставится на сетевом уровне. И наконец, каналы доставки, которые работают давно и надёжно: sitemap.xml, RSS-лента и корректные даты публикации и обновления. Всё это приносит больше, чем любой новый файл в корне.

  • Индексируемость и текст в исходном HTML — обязательное условие.
  • Прямой ответ в первых предложениях под вопросом-заголовком.
  • Schema.org из данных страницы: цена, наличие, адрес, FAQ.
  • Осознанные правила для ИИ-краулеров в robots.txt плюс сетевой уровень, если нужен реальный запрет.
  • Рабочие каналы доставки: sitemap.xml, RSS, честные даты обновления.

6Как проверить, что файл вообще работает

Проверка занимает пять минут. Откройте /llms.txt в браузере: он должен отдаваться с кодом 200 и как обычный текст, а не скачиваться файлом и не превращаться в HTML-страницу. Пробегите ссылки — среди них не должно быть битых и адресов со старой структурой. Убедитесь, что файл не закрыт в robots.txt: закрытый файл-оглавление — довольно бессмысленная конструкция.

Дальше смотрите логи веб-сервера: фильтр по имени файла покажет, кто и как часто его запрашивает. Именно этот отчёт, а не статьи в блогах, даст ответ, работает ли файл конкретно у вас. Если за квартал обращений единицы — это нормальная сегодняшняя картина, и это ровно та причина, по которой llms.txt стоит держать автоматическим и дешёвым, а усилия вкладывать в содержание страниц.

  • Файл отдаётся с кодом 200 как текст, не скачивается и не рендерится в HTML.
  • Все ссылки живые и абсолютные, старой структуры адресов нет.
  • Файл открыт для роботов в robots.txt.
  • Логи веб-сервера показывают, кто и как часто его запрашивает, — это единственная честная метрика.

Частые вопросы

Нужен ли llms.txt моему сайту?+
Если он генерируется автоматически из уже имеющихся данных — сделайте, это стоит несколько часов работы и дальше не требует поддержки. Если под него предлагают отдельный проект с ручным ведением — откажитесь: Google официально заявляет, что такие файлы для попадания в ИИ-ответы не требуются, а обращения краулеров к ним единичны.
Чем llms.txt отличается от robots.txt и sitemap.xml?+
robots.txt задаёт правила доступа: кому какие разделы можно обходить. sitemap.xml перечисляет все адреса сайта для полного обхода. llms.txt — курируемое оглавление в Markdown: не все страницы, а выборка главных с пояснениями, зачем они. Первые два формата поддерживаются поисковиками официально, третий — нет.
Поможет ли llms.txt попасть в ответы ChatGPT или Алисы?+
Прямой зависимости нет и гарантий никто не даёт. В ответы попадают обычные проиндексированные страницы, которые система считает качественными источниками. Гораздо сильнее влияют доступность страницы роботу, прямой ответ в первых предложениях, разметка Schema.org и уникальная фактура, которой нет у конкурентов.
Как проверить, что файл сделан правильно?+
Откройте /llms.txt: код ответа 200, отдаётся как текст, ссылки абсолютные и живые, файл не закрыт в robots.txt. Затем посмотрите логи веб-сервера с фильтром по имени файла — там видно, какие боты его запрашивают и как часто. Это единственная честная метрика полезности конкретно для вашего сайта.
llms.txtии-краулерыgeoтехническое seoии-поиск

Соберём llms.txt автоматически — и всё остальное тоже

Студия Юнкис генерирует служебные файлы из данных сайта: llms.txt, sitemap.xml, RSS и разметку Schema.org обновляются вместе с контентом, без ручной поддержки. Оставьте заявку — посмотрим, что у вас отдаётся роботам сейчас.

Обсудить SEO-задачу