Этот гайд помогает сделать сайт «видимым» для больших языковых моделей (LLM — программ вроде ChatGPT, которые формируют ответы на основе текстов). Вы настроите три простые вещи: файл `llms.txt`, Markdown-версии страниц и разметку JSON-LD. Подходит для любого сайта: статического HTML, WordPress, GitHub Pages. Для настройки не нужен API-ключ — только доступ к файлам сайта.

Если вы хотите потом проверить, как модель на самом деле читает ваши файлы, полезно уметь запускать ИИ-модель локально — для этого есть гайд по локальному запуску ИИ-моделей. А для оценки качества ответов подойдёт гайд по QA для ИИ-моделей.

1. Создайте файл `llms.txt` в корне сайта.
`llms.txt` — это обычный текстовый файл, который подсказывает LLM-ассистентам, какие страницы на вашем сайте самые полезные. По сути, это «оглавление для искусственного интеллекта».
Пример:создайте файл `llms.txt` в папке `public_html` или рядом с `index.html`.
# Example.com
> Короткое описание сайта: чем он полезен и о чём рассказывает.
## Основные страницы

- Как установить программу
- Частые вопросы
- О компании
Ожидаемый результат:по адресу `https://example.com/llms.txt` открывается этот текст.
Почему это работает: ассистенту не нужно обходить весь сайт — он читает один файл и сразу понимает структуру.
2. Сделайте Markdown-версии ключевых страниц.
Большие языковые модели лучше понимают простой текст, чем сложный HTML. Поэтому для главных страниц сделайте отдельные файлы `.md`. Внутри используйте короткие заголовки, списки и факты.
Пример:файл `/how-to-install.md`:
# Как установить программу
1. Скачайте установочный файл с официального сайта.
2. Запустите файл и следуйте подсказкам мастера.
3. Нажмите «Готово», когда установка завершится.
## Системные требования

- Windows 10 или новее
- 4 ГБ оперативной памяти
Ожидаемый результат:ссылка из `llms.txt` ведёт на этот файл, и он открывается как обычный текст без дизайна.
Почему это работает: модель извлекает факты из простых маркированных списков точнее, чем из длинных HTML-разметок.
3. Добавьте JSON-LD на HTML-страницы.
JSON-LD — это фрагмент кода в HTML, который описывает тип контента: статья, инструкция, вопрос-ответ, организация. Поисковые боты и некоторые ИИ-ассистенты используют его, чтобы понять смысл страницы.
Пример:вставьте этот блок между `<head>` и `</head>`:
<script type="application/ld+json">
{
"@context": "https://schema.org",
"@type": "Article",
"headline": "Как установить программу",
"author": {
"@type": "Organization",
"name": "Example"
}
}
</script>
Ожидаемый результат:страница не меняет внешний вид, а валидатор JSON показывает «Valid JSON».
Почему это работает: бот видит не только текст, но и подсказку, что это статья с заголовком и автором.
4. Проверьте доступность файлов.
Откройте адрес `https://example.com/llms.txt` в браузере или выполните команду:
curl -I https://example.com/llms.txt
Ожидаемый результат:в ответе браузера — текст, а `curl` показывает код `HTTP/1.1 200 OK`.
Почему это работает: если файл недоступен или отдаётся с ошибкой, ассистент не сможет его прочитать.
5. Обновляйте файлы при изменении контента.
Добавили новую статью — добавьте ссылку в `llms.txt`. Удалили раздел — уберите ссылку. Держите файл актуальным.
Ожидаемый результат:через месяц структура в `llms.txt` совпадает с реальными страницами сайта.
Почему это работает: искусственный интеллект учится на актуальных данных, а устаревшие ссылки снижают доверие к сайту.
Проблема 1: `llms.txt` отдаёт ошибку 404.
Симптом: при открытии `https://example.com/llms.txt` браузер показывает «404 Not Found».
Решение:
1. Проверьте, что файл лежит в корне сайта, а не во вложенной папке.
2. Убедитесь, что имя файла написано строчными буквами: `llms.txt`.
3. Очистите кеш хостинга или CDN.
4. Если сайт на WordPress, возможно, файл блокирует плагин кеширования — отключите его на минуту.
Почему помогает: большинство 404 возникают из-за неверного пути или кеша.
Проблема 2: JSON-LD не распознаётся.
Симптом: в консоли браузера ошибка вида `Uncaught SyntaxError: Unexpected token`.
Решение:
1. Скопируйте код в [JSON-валидатор] — если код внутри валиден, JSON-LD тоже корректен.
2. Проверьте, нет ли лишней запятой после последнего поля.
3. Убедитесь, что между фигурными скобками нет переносов строк, которые были добавлены редактором.
Почему помогает: JSON не допускает «висячих» запятых и пропущенных кавычек.
Проблема 3: Markdown-файл показывается как HTML-страница с дизайном.
Симптом: `.md`-файл открывается в шаблоне сайта, а не как чистый текст.
Решение:
1. Используйте расширение `.txt` или `.md` в статической папке, где нет обработки CMS.
2. Если сайт на WordPress, создайте отдельную папку без шаблонов и положите туда файл.
3. Убедитесь, что у файла нет расширений `.php` и `.html`.
Почему помогает: CMS обрабатывают файлы только в своих маршрутах, а чистый `.md` в статической папке отдаётся как есть.
Что такое `llms.txt`?
Это текстовый файл в корне сайта, в котором перечислены полезные страницы для LLM. Ассистент читает его и решает, какой контент использовать в ответе. Это как сокращённая карта сайта для нейросетей.
Чем `llms.txt` отличается от `robots.txt` и `sitemap.xml`?
`robots.txt` запрещает или разрешает обход, а `sitemap.xml` перечисляет все страницы для поисковых ботов. `llms.txt` показывает именно те страницы, которые лучше всего подходят для ответов LLM.
Нужно ли делать все три инструмента: `llms.txt`, `.md` и JSON-LD?
Достаточно начать с `llms.txt` и Markdown-версий. JSON-LD усиливает эффект для обычного поиска, но для LLM он не обязателен. Начните с малого, потом добавляйте остальное.
Поможет ли это попасть в ответы Google?
Google официально не заявляет, что использует `llms.txt`. Но другие поисковые системы и ИИ-ассистенты могут его учитывать. Для классического поиска лучше дополнительно использовать JSON-LD и качественный контент.