У поисковых роботов давно есть свой язык описания сайта: robots.txt говорит, что можно сканировать, sitemap.xml — где лежат все страницы. У языковых моделей такого стандарта долго не было — предполагалось, что они просто читают HTML, как обычный браузер. Осенью 2024 года появилось предложение закрыть этот пробел: файл llms.txt в корне сайта, адресованный напрямую моделям, а не поисковым краулерам.
Что такое llms.txt
Это обычный markdown-файл по адресу /llms.txt: заголовок с названием сайта, короткое описание в одну строку и списки ссылок на ключевые страницы с краткими аннотациями, сгруппированные по разделам. Никакого XML, никакой сложной разметки — просто структурированный текст, который языковая модель может прочитать за секунды и сразу понять, что за сайт перед ней и куда идти за нужной информацией.
А что такое llms-full.txt
Это расширенная версия того же принципа: не индекс со ссылками, а единый файл с полным содержимым всех ключевых страниц сайта целиком. Модели не нужно переходить по ссылкам и заново парсить HTML каждой страницы — весь текстовый контент уже лежит в одном месте, очищенный от навигации, футера и вёрстки. Для небольших и средних сайтов это особенно удобно: весь смысловой контент помещается в один файл разумного размера.
Чем это отличается от sitemap.xml
Sitemap.xml решает техническую задачу — перечисляет URL для краулера, чтобы тот ничего не пропустил при сканировании. Это машинный формат без единого слова описания: адрес, дата обновления, приоритет — и всё. llms.txt решает другую задачу: не «вот список страниц», а «вот что это за сайт и зачем сюда идти» — с описаниями на естественном языке, которые сразу дают модели контекст, а не просто адрес.
Зачем это вообще нужно
У языковых моделей ограниченный контекст и ограниченное время на анализ каждого источника. Полный HTML страницы — это навигация, футер, скрипты, инлайн-стили и лишь небольшая доля полезного текста среди всего этого шума. llms.txt и llms-full.txt отдают именно суть, без верстки — это снижает шанс, что важная информация потеряется среди технического мусора, и увеличивает вероятность, что модель корректно процитирует именно то, что нужно.
Как правильно оформить llms.txt
- Заголовок H1 с названием компании или продукта.
- Однострочное описание сразу после заголовка — блочная цитата с сутью бизнеса.
- Разделы по H2 — например, «Услуги», «Портфолио», «Блог» — каждый со списком ссылок.
- Короткая аннотация к каждой ссылке — не просто «Контакты», а что конкретно на этой странице и зачем туда идти.
- Актуальность. Файл нужно обновлять при структурных изменениях сайта — модель не должна натыкаться на ссылки на удалённые страницы.
Стоит ли делать llms-full.txt каждому сайту
Для сайта из пяти страниц — почти наверняка да, это несложно и не требует поддержки отдельной инфраструктуры. Для крупного сайта с тысячами страниц полный дамп контента в одном файле теряет смысл — там важнее качественный llms.txt как курируемый индекс с точными описаниями, а не попытка уместить весь сайт в один текстовый файл.
Как мы применили это на своём сайте
На сайте ПОС МАСТЕР оба файла уже подключены: llms.txt с описанием студии и ссылками на услуги, кейсы и статьи блога, и llms-full.txt с полным текстом всех этих страниц в одном файле. Это тот самый случай, когда студия, которая продаёт GEO-продвижение, применяет собственные рекомендации на практике, а не только советует их клиентам.
Стандарт пока не официальный и не гарантирует особого отношения от всех моделей — но затраты на его внедрение минимальны, а downside отсутствует: в худшем случае файл просто останется незамеченным.