Техническая база

llms.txt и техническая база GEO

Самая частая причина невидимости в нейросетях — не тексты, а техника. Модель просто не доходит до вашего контента или не понимает, что перед ней.

Что такое llms.txt и зачем он нужен?

llms.txt — текстовый файл в корне сайта, который в понятном для языковых моделей виде описывает, что это за ресурс, чем занимается компания и какие страницы главные. По смыслу это карта сайта, только не для поисковых роботов, а для ИИ. Расширенная версия — llms-full.txt — содержит ещё и готовые к цитированию факты и ответы на частые вопросы. Стандарт пока не обязателен и поддерживается не всеми системами, но его внедрение недорого, а вместе с корректным robots.txt, разметкой Schema.org и отдачей контента в HTML он образует базу, без которой остальная GEO-работа не даёт результата.

Обновлено: 29 июля 2026 · источник данных: панели Яндекс.Метрики клиентских проектов

Состав

Что входит в техническую базу

Шесть элементов. Первые три обязательны всегда, остальные — по результатам аудита.

Обязательно

Доступ ИИ-краулерам

Правила в robots.txt для полутора десятков агентов и проверка, что защита от ботов не отдаёт им отказ. Проверяем реальными запросами, а не по документации.

Обязательно

Контент в HTML

Текст должен быть в исходном коде страницы. Если он появляется только после выполнения скриптов, часть систем видит пустую страницу.

Обязательно

Разметка Schema.org

Связный граф: Organization, Service, FAQPage, BreadcrumbList, HowTo. Не набор разрозненных блоков, а согласованная структура сущностей.

Рекомендуем

llms.txt

Короткая машиночитаемая карта: кто вы, чем занимаетесь, какие разделы главные, где искать факты.

Рекомендуем

llms-full.txt

Расширенная выжимка: прямые ответы по каждой ключевой странице и блоки вопросов-ответов в чистом тексте.

Рекомендуем

Дата обновления

Корректные datePublished и dateModified. Системы с живым веб-поиском заметно предпочитают свежие материалы.

Проверка

Каких агентов мы проверяем

Мы проверяем доступ не по списку из документации, а реальными запросами: отправляем обращение от имени каждого агента и смотрим, какой код отдаёт сервер. Часто оказывается, что формально всё разрешено, а фактически защита от ботов возвращает отказ.

Базовый список — около шестнадцати агентов основных систем: поисковые и обучающие боты OpenAI, Anthropic, Perplexity, Google, Apple, Microsoft, Meta, Amazon, Яндекса и других.

  • OpenAI: GPTBot, OAI-SearchBot, ChatGPT-User
  • Anthropic: ClaudeBot, Claude-User, Claude-SearchBot
  • Perplexity: PerplexityBot, Perplexity-User
  • Google: Google-Extended (директива генеративных продуктов)
  • Прочие: Applebot-Extended, Bingbot, meta-externalagent, Amazonbot, YandexBot и другие
Разметка

Какие типы Schema.org мы ставим и зачем

ТипЧто описываетЧто даёт
OrganizationКомпанию: название, контакты, профилиМодель понимает, кто вы, и не путает с тёзками
Service / OfferУслуги и условияПоявляется в ответах на вопросы «кто оказывает услугу X»
FAQPageБлоки вопрос-ответГотовые к цитированию фрагменты
HowToПошаговые процессыИзвлекается в ответах на вопросы «как сделать»
BreadcrumbListПоложение страницы в структуреПомогает понять иерархию и тематику раздела
speakableФрагменты для озвучиванияИспользуется голосовыми ассистентами
Article / PersonМатериалы и авторовПодтверждает экспертность и авторство

Проверять доступ нужно именно запросами, а не по конфигурации. На одном из аудитов мы обнаружили, что сайт за системой защиты от DDoS формально не запрещает ничего, но реально часть агентов получала отказ. При этом на другом проекте все 16 проверенных ИИ-краулеров проходили без проблем — а видимости всё равно не было, потому что на 57 страницах не оказалось ни одного блока структурированных данных.

Бесплатно

Рассчитаем работу под вашу задачу

Опишите нишу и цель — вернёмся с разбором спроса, планом и вилкой бюджета. Разбор бесплатный, обязательств никаких.

  • Разберём спрос в вашей нише по Wordstat и увидим, что реально ищут клиенты
  • Покажем, кто из конкурентов уже забирает органику и на чём
  • Предложим формат: Дзен, нейросети, видео, Pinterest или связка
  • Дадим ориентир по срокам и бюджету — без обязательств
Отвечаем в течение рабочего дня
FAQ

Частые вопросы

llms.txt действительно работает или это мода?

Честный ответ: стандарт молодой, официальной поддержки со стороны всех систем пока нет, и говорить о гарантированном эффекте рано. Мы внедряем его потому, что это дёшево, не вредит и потенциально полезно. Но мы никогда не подаём llms.txt как главную причину роста — основную работу делают доступ краулеров, структура контента и разметка.

Можно ли сделать это своими силами?

Часть — да. Проверить robots.txt, посмотреть, отдаётся ли текст без JavaScript, и добавить базовую разметку способен любой грамотный разработчик. Сложнее с проверкой реального доступа агентов и с построением связного графа сущностей — здесь чаще всего и находятся ошибки.

Сколько времени занимает внедрение?

Обычно 2–4 недели на сайт среднего размера: неделя на аудит и проверку доступа, остальное — на разметку, файлы и правки на ключевых страницах. Дальше нужно время на переиндексацию.

Это разовая работа или постоянная?

Техническая база ставится один раз и дальше только поддерживается: при добавлении разделов обновляются llms.txt и разметка. Постоянной является содержательная часть — обновление фактов и замеры упоминаний.

Смотрите также

Смежные услуги направления

Бесплатный разбор ниши

Покажем, сколько клиентов вы теряете без контента

Разберём вашу нишу, спрос и конкурентов. Покажем реалистичный прогноз и предложим формат работы. Без воды и обязательств.