Почему нейросеть не находит ваш контент, даже если вы в топе Google
Нейросеть не находит ваш контент по трём техническим причинам: боты вроде GPTBot заблокированы в robots.txt, важный текст спрятан за JavaScript или в PDF, а внутренние ссылки не ведут к нужной странице. Даже если сайт стоит в топе Google, это не гарантирует видимость в ChatGPT или Perplexity – эти системы читают страницу по-другому: им нужен явный текст, четкая иерархия заголовков и структурированные данные, синхронизированные с тем, что видит пользователь.
Чтобы это исправить, нужно разбить длинные абзацы на блоки по 3–5 предложений с одной мыслью в каждом, выстроить заголовки так, чтобы каждый H2 закрывал один вопрос, добавить schema.org для FAQ и статей, открыть доступ ботам и завести файл llms.txt с описанием структуры сайта. Здесь работает система: выпадет один слой – техника, разметка или свежесть контента – и нейросеть выберет для ответа конкурента, у которого все слои на месте.
Топ в Google – это не видимость в нейросетях
Владелец клиники или юрфирмы обычно проверяет позиции в Google и Яндексе, видит себя на первой странице и успокаивается. Но ChatGPT, Perplexity и Google AI Overview читают страницу иначе, чем человек в браузере: они разбирают код, ищут явный текст, смотрят иерархию заголовков и структурированные данные. Если сайт не подготовлен для такого разбора, нейросеть просто не берёт его в ответ – даже если Google ставит сайт на первое место.
Это отдельная задача, и она называется <a href="/blog/geo">GEO</a> – оптимизация под ответы нейросетей. Структура сайта в ней играет ключевую роль: она либо открывает контент для ИИ, либо закрывает его.
Что конкретно ломает видимость: три технические причины
Google в своих рекомендациях для AI-функций прямо называет базовые условия: разрешить сканирование в robots.txt, не блокировать хостинг и CDN, упростить обнаружение контента через внутренние ссылки и отдавать важный текст прямо в html-коде страницы. Разберём, где бизнес чаще всего теряет видимость.
1. Боты заблокированы или не могут дойти до страницы
Частая ошибка – в robots.txt заблокирован GPTBot, ClaudeBot или другой ИИ-бот, потому что когда-то разработчик закрыл «всё лишнее» по умолчанию. Также встречаются nosnippet и noindex на страницах услуг – это прямой сигнал не показывать контент, и нейросеть его соблюдает.
2. Контент спрятан от текстового разбора
Если описание услуги или цены подгружаются через JavaScript после клика, или лежат в PDF-прайсе, ИИ-бот их часто не увидит. Ему нужен текст, который отдаётся сразу в html-коде страницы.
3. Внутренние ссылки не ведут к нужному контенту
Google отдельно указывает: контент должен быть легко обнаружим через внутренние ссылки. Если страница услуги висит «сиротой» без ссылок с главной, блога или других разделов, боту сложнее понять, что она важна и связана с остальным сайтом.
Иерархия заголовков: почему H2 должен закрывать один вопрос
На практике оптимизация под LLM держится на одном принципе: заголовки H1–H6 строятся как логическая иерархия, где каждый H2 закрывает один интент читателя, а H3–H6 раскрывают детали внутри этого интента. Нейросети извлекают смысл постранично блоками, и чёткая иерархия помогает им находить именно тот кусок, который отвечает на вопрос пользователя.
| Проблема | Как выглядит у большинства | Как должно быть |
|---|---|---|
| Заголовки | H2 и H3 вперемешку, без логики | Каждый H2 = один вопрос, H3 внутри раскрывает подтемы |
| Абзацы | 10–15 строк текста подряд | 3–5 предложений, одна мысль на блок |
| Разметка | Нет schema.org или не совпадает с текстом | FAQ, Article, HowTo синхронизированы с видимым текстом |
| Боты | GPTBot закрыт в robots.txt по умолчанию | Явно разрешён доступ ключевым ИИ-ботам |
| Файл для ИИ | Отсутствует | Есть llms.txt с описанием структуры сайта |
Длина абзаца решает, процитируют вас или нет
По опыту GEO-специалистов, абзац для AI-поиска работает лучше, если укладывается в 3–5 предложений или 3–4 строки – единого официального стандарта тут нет, но эта практика повторяется в большинстве разборов. Логика простая: нейросеть цитирует законченный смысловой блок целиком. Ей нужен цельный фрагмент – короткий, самостоятельный, понятный без остального текста. Если у вас абзац на 12 строк с тремя разными мыслями, ИИ либо процитирует его с искажением смысла, либо вообще пропустит в пользу конкурента с более чистой структурой.
- Один абзац – одна законченная мысль, без «и кстати ещё...»
- Первое предложение абзаца отвечает на вопрос сразу, без разгона
- Списки вместо перечисления через запятую в тексте
- Таблицы там, где нужно сравнить 2–3 варианта
Зачем сайту llms.txt и что туда писать
llms.txt – это файл в корне сайта, который описывает структуру контента специально для языковых моделей: что есть на сайте, где искать ключевые страницы, какие разделы главные. Это дополнение к sitemap.xml. Sitemap помогает боту найти страницы, llms.txt помогает нейросети понять, как эти страницы связаны по смыслу.
Формат пока не стандартизирован жёстко, но практика уже сложилась: короткое описание бизнеса, список ключевых разделов с прямыми ссылками и отдельно – ссылки на страницы с ответами на частые вопросы. У клиники это список услуг с прямыми ссылками, у юрфирмы – список практик.
Структурированные данные: разметка должна совпадать с текстом
Schema.org для FAQ, Article, HowTo помогает нейросети связать видимый текст со смысловой структурой страницы. Частая ошибка: разметку ставят «для галочки», и она не совпадает с тем, что реально написано на странице. Например, в FAQ-разметке один вопрос, а в видимом тексте – другой, или ответ короче. Google прямо указывает: structured data должна совпадать с видимым контентом. Несовпадение – риск, что источник не попадёт в AI-ответ.
Свежесть контента – отдельный слой, который часто забывают
Дата публикации, актуальность цен, свежие данные в профиле компании и Merchant Center – всё это влияет на то, какой источник выберет ИИ. Гайдлайны прямо связывают свежесть с попаданием в генеративную выдачу: устаревшая страница проигрывает даже при хорошей структуре, если рядом есть более новый источник с той же информацией.
Частые ошибки при попытке всё исправить сразу
- Переписывают тексты, но не трогают robots.txt – боты всё равно заблокированы
- Добавляют schema.org, но не проверяют совпадение с видимым текстом
- Делают один длинный лендинг вместо отдельных страниц под каждую услугу
- Обновляют дизайн, но забывают про внутренние ссылки между разделами
- Ставят разметку FAQ, но отвечают одной короткой фразой без сути
Проверьте, что сломано у вашего сайта
Ответьте на несколько вопросов – и узнаете, что мешает нейросетям находить и цитировать ваш сайт.
Чек-лист: структура сайта под ИИ-поиск
18 пунктов, которые проверяют боты нейросетей на вашем сайте прямо сейчас
«После правки заголовков и разбивки абзацев нас стал цитировать Perplexity по запросам о наших услугах – раньше в ответах были только конкуренты с блогами.»
Управляющий партнёр · юридическая компания, Москва
Узнайте, видит ли вас ИИ-поиск
Структура сайта решает, увидят ли вас нейросети. Пройдите проверку и узнайте, что конкретно мешает вашему сайту попадать в ответы ChatGPT и Perplexity.
Частые вопросы
Чем видимость в ИИ-поиске отличается от позиций в Google?
Google ранжирует страницу по ссылкам и релевантности запросу, а нейросеть должна сначала разобрать страницу по тексту и структуре, чтобы взять её как источник для ответа. Топ в Google не гарантирует, что ИИ сможет вас процитировать.
Обязательно ли делать llms.txt, если уже есть sitemap.xml?
Sitemap помогает боту найти страницы, llms.txt помогает нейросети понять смысловую структуру сайта. Это разные файлы, они решают разные задачи.
Как быстро проверить, не блокирует ли сайт ИИ-ботов?
Откройте файл robots.txt на своём домене (адрес вида site.ru/robots.txt) и поищите строки с User-agent: GPTBot, ClaudeBot, PerplexityBot. Если рядом стоит Disallow: /, бот заблокирован.
Нужно ли переписывать весь сайт под ИИ-поиск?
Нет, начните с ключевых страниц услуг и блога – тех, что должны попадать в ответы нейросетей. Остальной сайт можно донастраивать поэтапно.
Как понять, что нейросеть уже цитирует мой сайт?
Задайте в ChatGPT или Perplexity вопрос, на который отвечает ваша страница, и посмотрите, появляется ли ваш сайт в источниках. Проверяйте это регулярно.