Гайд · HTML-экспорт

Как посмотреть, что реально видит поисковик на странице

Браузер показывает страницу вам, но робот видит её иначе. Инструмент «HTML-экспорт» рендерит страницу как Googlebot — то есть исполняет JavaScript и отдаёт итоговый HTML. Сравнив его с исходным кодом, вы найдёте контент и ссылки, которые видит человек, но не видит поисковик.

Цель: увидеть страницу глазами поисковика и понять, весь ли важный контент до него доходит. Что нужно: адрес страницы и пара минут. Когда вы открываете страницу в браузере, весь текст и ссылки дорисовывает JavaScript. Робот работает иначе: сначала получает исходный HTML, а потом отдельно рендерит страницу, исполняя тот же JavaScript. Если что-то подгружается только по клику или с задержкой, робот может этого не увидеть. «HTML-экспорт» показывает оба состояния — исходный HTML (что отдал сервер) и отрендеренный HTML (итог после исполнения скриптов, как его получает Googlebot).

Шаг 1. Вставьте адрес страницы

1

Откройте раздел HTML-экспорт и вставьте адрес страницы, которую хотите проверить. Можно указать один URL или сразу список — тогда инструмент обработает все адреса пачкой. Берите те страницы, где важно, чтобы поисковик увидел весь контент: карточки товаров, категории, статьи.

tools.seoxl.ru/next · html-export
Сравнение отрендеренного и исходного HTML страницы

Начните с одной важной страницы, а потом добавьте список — сравнивать удобнее по группе однотипных URL.

Шаг 2. Запустите рендер как Googlebot

2

Нажмите «Запустить». Инструмент запрашивает страницу от имени поискового робота и исполняет её JavaScript — так же, как это делает Googlebot. На выходе вы получаете реальный HTML страницы после рендеринга, а не то, что просто отдал сервер. Рядом видно код ответа и размер каждого URL — сразу заметны страницы, которые отвечают ошибкой.

💡
Совет. Контент, который подгружается только после действия пользователя — по клику «показать ещё», при прокрутке или с задержкой, — часто не попадает в отрендеренный HTML. Ленивая подгрузка (lazy load) удобна для скорости, но её легко сделать так, что робот не увидит ни текста, ни ссылок.

Шаг 3. Сравните отрендеренный HTML с исходным

3

Сравните отрендеренный HTML с исходным и с тем, что видите в браузере. Проверьте, на месте ли главное:

  • Основной текст. Есть ли в отрендеренном HTML описания, характеристики, статьи — или там пусто, а текст появляется только в браузере.
  • Внутренние ссылки. Видны ли ссылки на другие страницы обычными тегами <a href>. Если переходы работают только через скрипт, робот не пройдёт по ним и не найдёт эти страницы.
  • Заголовки и разметка. На месте ли <title>, заголовки, микроразметка — то, по чему поисковик понимает, о чём страница.

Готовый результат можно скачать архивом, чтобы сохранить срез страниц для отчёта или показать разработчикам, что именно теряется.

Шаг 4. Найдите контент, невидимый боту

4

Всё, что есть в браузере, но отсутствует в отрендеренном HTML, — это контент, невидимый поисковику. Именно его и нужно исправлять: выводить в HTML сразу, а не подгружать скриптом после загрузки.

  • Текста нет в HTML. Попросите разработчиков отдавать основной контент в исходном коде (SSR или пре-рендер), а не дорисовывать его в браузере.
  • Ссылки не видны роботу. Замените переходы на скриптах обычными <a href>, чтобы поисковик мог обойти каталог целиком.
  • Всё на месте. Отлично — можно проверить остальные типы страниц и убедиться, что проблема не локальная.
⚠️
То, что контент попал в отрендеренный HTML, ещё не гарантирует индексацию — робот должен успеть отрендерить страницу и не быть ограничен в ресурсах. Но если контента нет и в рендере, шанса попасть в индекс у него нет совсем.