llms-full.txt — распространённое имя для единого текстового файла с содержимым выбранных страниц сайта. Короткий llms.txt подсказывает, куда идти, а полный файл отдаёт подготовленный корпус сразу. Это соглашение экосистемы, а не утверждённый веб-стандарт.
Название и статус формата
В исходном предложении llmstxt.org для собранного контекста встречаются имена llms-ctx.txt и llms-ctx-full.txt. В инструментах и генераторах распространилось имя llms-full.txt. Его следует описывать именно как практическую конвенцию: общего реестра обязательных полей, максимального размера и гарантированной поддержки нет.
Размещать файл принято в корне сайта. Потребитель должен понимать, из каких страниц он собран, когда обновлён и какую версию продукта описывает. Если эти данные нельзя поддерживать, короткая карта ссылок надёжнее устаревшей полной копии.
Когда полный файл оправдан
Хороший кандидат — документация с однозначными каноническими страницами, стабильной структурой и задачей получить связный офлайн-контекст. Единая выгрузка также удобна для внутреннего RAG-прототипа, если в неё попадает только разрешённая публичная информация и известен предел контекстного окна.
Для магазина с миллионами карточек, новостного сайта или форума выгода сомнительна. Файл быстро разрастается, дублирует шаблонный текст, содержит устаревшие цены и затрудняет обновление отдельных материалов. В таких случаях карта разделов, API или выборочная выгрузка полезнее полного снимка.
| Сценарий | Решение | Причина |
|---|---|---|
| Документация API | Часто да | Связный и версионируемый корпус |
| Небольшая база знаний | Да, после очистки | Мало дублей и понятные границы |
| Интернет-магазин | Обычно нет | Размер и быстро меняющиеся данные |
| Новости или форум | Нет для всего сайта | Постоянное обновление и пользовательский контент |

Как собрать llms-full.txt
Источником должен быть список канонических страниц из отредактированного llms.txt, а не слепой обход всего домена. Для каждой страницы извлеките заголовок, основной текст, таблицы и код. Уберите меню, повторяющийся футер, cookie-баннеры, карточки рекомендаций и элементы интерфейса. Между документами оставьте явный заголовок и исходный URL.
Сборку делайте воспроизводимой: храните список источников, дату и версию генератора. При ошибке одного URL лучше закончить сборку с отчётом, чем молча включить страницу авторизации или HTML ошибки. Перед публикацией проверьте, что файл не содержит персональных данных, внутренних адресов и токенов.
- Отобрать канонические страницы в llms.txt.
- Извлечь только основной контент и сохранить структуру заголовков.
- Добавить исходный URL и границу каждого документа.
- Удалить повторы, служебные блоки и закрытые данные.
- Проверить размер, ссылки и дату сборки.
- Пересобирать файл при изменении источников.
Как организовать содержимое
Начните с краткого паспорта: название проекта, версия, время сборки, язык и область. Затем расположите материалы по порядку использования — обзор, установка, авторизация, основные операции, ошибки, справочник. Не сортируйте документы только по URL: алфавитный порядок редко совпадает с задачей читателя.
Крупные документы разбивайте заголовками и сохраняйте уникальные якоря. Кодовые блоки не сокращайте так, чтобы пример перестал запускаться. Если таблица превращается в нечитаемый поток, переведите её в Markdown или список пар «поле — значение». Содержимое полного файла не должно противоречить канонической странице.
# Product Docs — full context
Built: 2026-07-21
Scope: public API documentation
---
Source: https://example.com/docs/auth
# Авторизация
...
---
Source: https://example.com/docs/errors
# Ошибки API
...

Проверка файла и сервисы
Первым запустите аудитор llms-full.txt Index-Now.ru. Он проверит доступность, структуру и типовые дефекты выгрузки. Затем сравните случайную выборку блоков с исходными страницами и убедитесь, что ссылки, версии, команды и ограничения совпадают.
Для сборки основы можно использовать генератор llms-full.txt. Машинная сборка не определяет, какие материалы разрешены и где проходит граница продукта. Эту часть принимает владелец документации. Если файл слишком велик для целевого потребителя, разделите его по версиям или продуктам и оставьте ссылки на части в llms.txt.
- Файл отвечает 200 и имеет текстовый тип содержимого.
- В начале указаны область и дата сборки.
- Каждый документ связан с исходным URL.
- Нет навигационного мусора и повторов.
- Размер соответствует реальному сценарию использования.
- Обновление происходит вместе с документацией.
Когда лучше отказаться от полной версии
Не публикуйте файл «для галочки», если никто не отвечает за пересборку. Устаревшая выгрузка опаснее отсутствующей: она даёт старые команды и условия единым удобным пакетом. Откажитесь также от полной версии, если значимая часть документации доступна только после входа или имеет разные права для клиентов.
Рабочая минимальная схема — отредактированный llms.txt, доступный HTML и корректные канонические URL. Права AI-краулеров на обход настраиваются отдельно в robots.txt и документации провайдеров; ai.txt остаётся экспериментальным сигналом, а не заменой этих правил.
Частые вопросы
Есть ли официальный стандарт llms-full.txt?
Нет. Это распространённое имя и соглашение инструментов. Исходное предложение llmstxt.org описывало близкие файлы llms-ctx и llms-ctx-full.
Нужно ли включать в файл весь сайт?
Нет. Полнота относится к выбранной области, например к документации одной версии. Каталог, новости и служебные страницы можно исключить.
Как часто пересобирать файл?
После изменения любого включённого источника. Если сборка не автоматизирована, назначьте регулярную проверку и укажите дату, чтобы потребитель видел возраст выгрузки.
