Браузер показывает страницу вам, но робот видит её иначе. Инструмент «HTML-экспорт» рендерит страницу как Googlebot — то есть исполняет JavaScript и отдаёт итоговый HTML. Сравнив его с исходным кодом, вы найдёте контент и ссылки, которые видит человек, но не видит поисковик.
Цель: увидеть страницу глазами поисковика и понять, весь ли важный контент до него доходит. Что нужно: адрес страницы и пара минут. Когда вы открываете страницу в браузере, весь текст и ссылки дорисовывает JavaScript. Робот работает иначе: сначала получает исходный HTML, а потом отдельно рендерит страницу, исполняя тот же JavaScript. Если что-то подгружается только по клику или с задержкой, робот может этого не увидеть. «HTML-экспорт» показывает оба состояния — исходный HTML (что отдал сервер) и отрендеренный HTML (итог после исполнения скриптов, как его получает Googlebot).
Откройте раздел HTML-экспорт и вставьте адрес страницы, которую хотите проверить. Можно указать один URL или сразу список — тогда инструмент обработает все адреса пачкой. Берите те страницы, где важно, чтобы поисковик увидел весь контент: карточки товаров, категории, статьи.
Начните с одной важной страницы, а потом добавьте список — сравнивать удобнее по группе однотипных URL.
Нажмите «Запустить». Инструмент запрашивает страницу от имени поискового робота и исполняет её JavaScript — так же, как это делает Googlebot. На выходе вы получаете реальный HTML страницы после рендеринга, а не то, что просто отдал сервер. Рядом видно код ответа и размер каждого URL — сразу заметны страницы, которые отвечают ошибкой.
Сравните отрендеренный HTML с исходным и с тем, что видите в браузере. Проверьте, на месте ли главное:
<a href>. Если переходы работают только через скрипт, робот не пройдёт по ним и не найдёт эти страницы.<title>, заголовки, микроразметка — то, по чему поисковик понимает, о чём страница.Готовый результат можно скачать архивом, чтобы сохранить срез страниц для отчёта или показать разработчикам, что именно теряется.
Всё, что есть в браузере, но отсутствует в отрендеренном HTML, — это контент, невидимый поисковику. Именно его и нужно исправлять: выводить в HTML сразу, а не подгружать скриптом после загрузки.
<a href>, чтобы поисковик мог обойти каталог целиком.