llms.txt
Что такое llms.txt и зачем он появился
llms.txt — это инициатива, предложенная в 2024 году разработчиком Джереми Ховардом (создателем fast.ai) как простой способ адаптировать веб для больших языковых моделей. С ростом популярности AI-поисковиков и чат-ботов, которые генерируют ответы на основе веб-контента, встала проблема: LLM часто «не видят» структуру сайта так, как её видят поисковые роботы. HTML перегружен тегами, скриптами и навигацией, что затрудняет извлечение чистых фактов. llms.txt решает эту задачу, предлагая владельцам сайтов разместить в корне (например, example.com/llms.txt) обычный текстовый файл с перечнем важных материалов и их кратким описанием.
Формат файла предельно прост: это обычный текст с разделами и ссылками. Внутри можно указать заголовок, описание сайта, а затем список URL с пометками, что находится по каждой ссылке. Например:
- H1: Название компании
- Описание: Чем занимается сайт, для кого предназначен.
- Ссылки: /about — «О нас», /services — «Услуги веб-разработки», /blog — «Статьи по SEO».
Файл не требует специального синтаксиса — это просто структурированный текст, который легко парсится. Главное — давать краткие, точные описания, чтобы модель могла быстро понять контекст.
Как llms.txt влияет на SEO и разработку
Для SEO это новый инструмент оптимизации под генеративный поиск. Когда пользователь задаёт вопрос в AI-ассистенте, модель собирает информацию из разных источников. Если у вашего сайта есть llms.txt, модель может использовать его как «карту»: она видит, какие страницы релевантны запросу, и берёт из них данные. Это повышает шанс, что ваш контент будет процитирован в ответе, а не просто проигнорирован. Кроме того, llms.txt помогает избежать искажения фактов: вы сами задаёте приоритетные материалы и их описания, снижая риск того, что модель «перепутает» страницы.
Для разработчиков внедрение файла занимает минимум времени: нужно создать текстовый файл и добавить его в корневую папку, а также при необходимости обновлять его при добавлении новых страниц. Это не заменяет robots.txt или sitemap.xml, а дополняет их. Важно помнить: llms.txt — это рекомендация, а не стандарт, поэтому его поддержка зависит от конкретных AI-систем. Но уже сейчас многие поисковые инструменты, включая Perplexity и Bing AI, учитывают подобные файлы.
Практический пример: как выглядит llms.txt
Допустим, у нас есть сайт веб-студии. Файл llms.txt может выглядеть так:
# Веб-студия oWeb Solutions
Создание сайтов под ключ и SEO-продвижение. Работаем в Москве и Туле.
Основные разделы
- /services/website-development — Разработка корпоративных сайтов и интернет-магазинов
- /services/seo — Продвижение в поисковых системах, включая AI-поиск
- /portfolio — Примеры наших работ
- /blog/llms-txt-guide — Подробный гайд по созданию llms.txt
Таким образом, AI-модель, получив запрос «заказать сайт в Туле», сразу видит релевантную страницу и может использовать её описание для ответа. Это работает как ускоренный доступ к сути сайта.
Типичная ошибка и заблуждение
Главное заблуждение — считать, что llms.txt нужно наполнять всем содержимым сайта. Наоборот, файл должен быть кратким и содержать только ключевую информацию: перечень важных страниц и их назначение. Не нужно копировать туда тексты статей или описания товаров — это перегружает файл и делает его бесполезным. Также частая ошибка — не обновлять llms.txt после изменения структуры сайта. Если вы добавили новый раздел или удалили старый, но забыли обновить файл, модель будет ссылаться на несуществующие страницы — это хуже, чем отсутствие файла. Наконец, не путайте llms.txt с robots.txt: robots.txt управляет доступом поисковых ботов, а llms.txt — это подсказка для LLM, которая не ограничивает, а наоборот, помогает. Пока это экспериментальная технология, но уже сейчас она может дать конкурентное преимущество в выдаче AI-поисковиков.