Что такое llms-full.txt и когда он нужен

Чем llms-full.txt отличается от llms.txt, как собрать полную Markdown-версию сайта, ограничить размер и проверить актуальность ссылок и текста.

Что такое llms-full.txt и когда он нужен

llms-full.txt — распространённое имя для единого текстового файла с содержимым выбранных страниц сайта. Короткий llms.txt подсказывает, куда идти, а полный файл отдаёт подготовленный корпус сразу. Это соглашение экосистемы, а не утверждённый веб-стандарт.

Название и статус формата

В исходном предложении llmstxt.org для собранного контекста встречаются имена llms-ctx.txt и llms-ctx-full.txt. В инструментах и генераторах распространилось имя llms-full.txt. Его следует описывать именно как практическую конвенцию: общего реестра обязательных полей, максимального размера и гарантированной поддержки нет.

Размещать файл принято в корне сайта. Потребитель должен понимать, из каких страниц он собран, когда обновлён и какую версию продукта описывает. Если эти данные нельзя поддерживать, короткая карта ссылок надёжнее устаревшей полной копии.

Когда полный файл оправдан

Хороший кандидат — документация с однозначными каноническими страницами, стабильной структурой и задачей получить связный офлайн-контекст. Единая выгрузка также удобна для внутреннего RAG-прототипа, если в неё попадает только разрешённая публичная информация и известен предел контекстного окна.

Для магазина с миллионами карточек, новостного сайта или форума выгода сомнительна. Файл быстро разрастается, дублирует шаблонный текст, содержит устаревшие цены и затрудняет обновление отдельных материалов. В таких случаях карта разделов, API или выборочная выгрузка полезнее полного снимка.

СценарийРешениеПричина
Документация APIЧасто даСвязный и версионируемый корпус
Небольшая база знанийДа, после очисткиМало дублей и понятные границы
Интернет-магазинОбычно нетРазмер и быстро меняющиеся данные
Новости или форумНет для всего сайтаПостоянное обновление и пользовательский контент
llms.txt и llms-full.txt
Карта помогает выбрать источник, полная версия приносит подготовленный корпус

Как собрать llms-full.txt

Источником должен быть список канонических страниц из отредактированного llms.txt, а не слепой обход всего домена. Для каждой страницы извлеките заголовок, основной текст, таблицы и код. Уберите меню, повторяющийся футер, cookie-баннеры, карточки рекомендаций и элементы интерфейса. Между документами оставьте явный заголовок и исходный URL.

Сборку делайте воспроизводимой: храните список источников, дату и версию генератора. При ошибке одного URL лучше закончить сборку с отчётом, чем молча включить страницу авторизации или HTML ошибки. Перед публикацией проверьте, что файл не содержит персональных данных, внутренних адресов и токенов.

  1. Отобрать канонические страницы в llms.txt.
  2. Извлечь только основной контент и сохранить структуру заголовков.
  3. Добавить исходный URL и границу каждого документа.
  4. Удалить повторы, служебные блоки и закрытые данные.
  5. Проверить размер, ссылки и дату сборки.
  6. Пересобирать файл при изменении источников.

Как организовать содержимое

Начните с краткого паспорта: название проекта, версия, время сборки, язык и область. Затем расположите материалы по порядку использования — обзор, установка, авторизация, основные операции, ошибки, справочник. Не сортируйте документы только по URL: алфавитный порядок редко совпадает с задачей читателя.

Крупные документы разбивайте заголовками и сохраняйте уникальные якоря. Кодовые блоки не сокращайте так, чтобы пример перестал запускаться. Если таблица превращается в нечитаемый поток, переведите её в Markdown или список пар «поле — значение». Содержимое полного файла не должно противоречить канонической странице.

# Product Docs — full context
Built: 2026-07-21
Scope: public API documentation

---
Source: https://example.com/docs/auth
# Авторизация
...

---
Source: https://example.com/docs/errors
# Ошибки API
...
Конвейер полной выгрузки
Список источников контролируется до публикации

Проверка файла и сервисы

Первым запустите аудитор llms-full.txt Index-Now.ru. Он проверит доступность, структуру и типовые дефекты выгрузки. Затем сравните случайную выборку блоков с исходными страницами и убедитесь, что ссылки, версии, команды и ограничения совпадают.

Для сборки основы можно использовать генератор llms-full.txt. Машинная сборка не определяет, какие материалы разрешены и где проходит граница продукта. Эту часть принимает владелец документации. Если файл слишком велик для целевого потребителя, разделите его по версиям или продуктам и оставьте ссылки на части в llms.txt.

  • Файл отвечает 200 и имеет текстовый тип содержимого.
  • В начале указаны область и дата сборки.
  • Каждый документ связан с исходным URL.
  • Нет навигационного мусора и повторов.
  • Размер соответствует реальному сценарию использования.
  • Обновление происходит вместе с документацией.

Когда лучше отказаться от полной версии

Не публикуйте файл «для галочки», если никто не отвечает за пересборку. Устаревшая выгрузка опаснее отсутствующей: она даёт старые команды и условия единым удобным пакетом. Откажитесь также от полной версии, если значимая часть документации доступна только после входа или имеет разные права для клиентов.

Рабочая минимальная схема — отредактированный llms.txt, доступный HTML и корректные канонические URL. Права AI-краулеров на обход настраиваются отдельно в robots.txt и документации провайдеров; ai.txt остаётся экспериментальным сигналом, а не заменой этих правил.

Частые вопросы

Есть ли официальный стандарт llms-full.txt?

Нет. Это распространённое имя и соглашение инструментов. Исходное предложение llmstxt.org описывало близкие файлы llms-ctx и llms-ctx-full.

Нужно ли включать в файл весь сайт?

Нет. Полнота относится к выбранной области, например к документации одной версии. Каталог, новости и служебные страницы можно исключить.

Как часто пересобирать файл?

После изменения любого включённого источника. Если сборка не автоматизирована, назначьте регулярную проверку и укажите дату, чтобы потребитель видел возраст выгрузки.

Что читать дальше