Индексация сайта — это обработка найденных страниц поисковой системой и сохранение сведений о них в поисковой базе. Из этой базы Google и Яндекс выбирают документы, которые могут ответить на запрос пользователя.
Но между публикацией страницы и получением поискового трафика находится несколько разных этапов. URL может быть известен роботу, но ещё не просканирован. Страница может быть загружена, но не включена в индекс. Наконец, проиндексированный документ может не показываться по нужному запросу из-за недостаточной релевантности или конкуренции.
Короткий ответ: индексация не равна обходу и не гарантирует позиции. Для диагностики конкретного URL используйте проверку страницы в Google Search Console и Яндекс Вебмастере. Оператор
site:подходит только для быстрой ориентировочной проверки: он не показывает полный список проиндексированных страниц.
Как работает индексация сайта
Google описывает три основных этапа: сканирование, индексирование и показ результатов. Яндекс дополнительно выделяет формирование базы страниц, которые могут участвовать в поиске. Для практической работы удобно разделить путь URL на пять шагов.

1. Обнаружение URL
Сначала поисковой системе нужно узнать адрес страницы. Источниками становятся внутренние и внешние ссылки, XML Sitemap, ранее известные URL и сигналы из сервисов поисковой системы.
Если страница существует только после ввода формы, не связана с навигацией и отсутствует в Sitemap, робот может долго о ней не знать.
2. Сканирование
Робот запрашивает URL, получает HTTP-ответ и загружает доступные ресурсы. Частота обхода определяется алгоритмически. Она зависит от масштаба сайта, скорости ответа, частоты полезных обновлений, внутренней структуры и доступных ресурсов поисковой системы.
Код 200 OK означает, что сервер отдал страницу, но сам по себе не гарантирует её индексацию. Ответы 3xx, 4xx и 5xx обрабатываются иначе.
3. Рендеринг
Если содержимое создаётся JavaScript, поисковому роботу может потребоваться выполнить код и сформировать итоговую страницу. Google использует современный движок Chrome. В Яндекс Вебмастере доступно управление рендерингом JavaScript-страниц.
Критичный текст, ссылки и метаданные желательно отдавать в первоначальном HTML или с помощью серверного рендеринга. Так они доступны и роботам, и пользователям даже при ошибке скрипта.
4. Обработка и выбор канонической страницы
Поисковая система анализирует текст, изображения, заголовки, ссылки, метаданные и другие сигналы. Похожие URL объединяются в группу дублей, после чего выбирается каноническая версия — та, которая может участвовать в поиске.
Атрибут rel="canonical" является важной подсказкой, но поисковая система может выбрать другой URL, если внутренние ссылки, Sitemap, редиректы и содержимое противоречат указанному адресу.
5. Показ и ранжирование
Когда пользователь вводит запрос, поиск выбирает из индекса подходящие страницы и ранжирует их. Проиндексированный URL не обязан показываться по каждому запросу и тем более занимать высокую позицию.
Если страница есть в индексе, но не получает показов, проблема уже может относиться к спросу, релевантности, качеству, структуре или конкуренции. Такие ситуации разобраны в статье почему сайт не растёт в поиске.
Чем отличаются обнаружение, обход, индекс и позиции
| Состояние | Что оно означает | Что проверять |
|---|---|---|
| URL обнаружен | Поисковая система знает адрес, но могла ещё не загрузить страницу. | Внутренние ссылки, Sitemap, очередь обхода и доступность сервера. |
| URL просканирован | Робот запросил страницу и получил ответ. | HTTP-код, загруженный HTML, ресурсы, robots.txt и логи. |
| URL обработан | Содержимое проанализировано, но страница может быть признана дублем или исключена. | Canonical, `noindex`, качество, дубли и итоговый рендеринг. |
| URL проиндексирован | Сведения о выбранной странице сохранены в поисковой базе. | Выбранный канонический адрес и актуальность версии. |
| URL получает показы | Страница появляется в результатах по некоторым запросам. | Запросы, позиции, сниппет, CTR и соответствие интенту. |
Как поисковики находят новые страницы

Внутренние ссылки
Это основной управляемый способ показать структуру сайта. Важная страница должна быть доступна по обычной HTML-ссылке из меню, категории, тематического раздела или связанного материала.
Ссылки, которые появляются только после сложного взаимодействия, не имеют корректного href или ведут через ошибочный JavaScript, менее надёжны для обнаружения.
Внешние ссылки
Робот может найти новый домен или страницу по ссылке с другого ресурса. Но покупать ссылки только ради «загнать страницу в индекс» не нужно: на своём сайте обнаружение проще обеспечить архитектурой и Sitemap.
XML Sitemap
Карта сайта перечисляет канонические URL, которые вы хотите показать поисковым системам. Она особенно полезна крупным сайтам, проектам со слабой перелинковкой, новым ресурсам, интернет-магазинам и сайтам с часто обновляемыми страницами.
Минимальный пример:
<?xml version="1.0" encoding="UTF-8"?>
<urlset xmlns="http://www.sitemaps.org/schemas/sitemap/0.9">
<url>
<loc>https://example.com/page/</loc>
<lastmod>2026-08-13</lastmod>
</url>
</urlset>Указывайте в lastmod дату существенного изменения содержимого, а не момент каждого автоматического пересоздания файла. Добавление URL в Sitemap помогает обнаружению, но не гарантирует обход или индексацию.
Панели вебмастера
Google Search Console позволяет запросить проверку и повторный обход отдельных URL, а Яндекс Вебмастер — отправить важные страницы на переобход. Эти инструменты предназначены для ограниченного числа новых или заметно обновлённых адресов, а не для постоянной массовой отправки всего сайта.
IndexNow
Яндекс поддерживает IndexNow: сайт может автоматически сообщать о созданных, изменённых и удалённых URL через API или CMS-плагин. Уведомление не означает автоматического включения страницы в поиск. Передавать следует реальные изменения, а не весь список URL при каждом запуске.
Как проверить индексацию страницы в Google
Самый точный инструмент для URL, которым вы управляете, — «Проверка URL» в Google Search Console.
- Откройте подтверждённый ресурс.
- Вставьте полный адрес страницы в верхнюю строку.
- Изучите статус в индексе, дату последнего сканирования и выбранный canonical.
- При необходимости откройте проверку опубликованной версии.
- После исправления существенной проблемы запросите индексирование.

«URL есть в Google»
Это означает, что страница может участвовать в поиске. Проверьте, тот ли canonical выбран и соответствует ли проиндексированная версия текущему содержимому.
«Просканировано — пока не проиндексировано»
Google уже загрузил URL, но решил не включать его в индекс. Частые причины: слабая самостоятельная ценность, сходство с другими страницами, шаблонный контент, неясное назначение или недостаточно согласованные сигналы canonical.
Повторная отправка без изменения страницы обычно ничего не исправляет. Сначала улучшите содержание и роль URL в структуре.
«Обнаружено — пока не проиндексировано»
Адрес известен, но обход ещё не состоялся. Проверьте нагрузку и ошибки сервера, глубину страницы, внутренние ссылки, качество Sitemap и количество создаваемых сайтом служебных URL.
«Страница с переадресацией»
Редиректящий URL обычно не индексируется как самостоятельная страница. Проверьте, что перенаправление намеренное, ведёт одним переходом на актуальный адрес, а внутренние ссылки и Sitemap уже используют конечный URL.
«Дубликат» или выбран другой canonical
Google включил в индекс другую версию сходного содержания. Согласуйте rel="canonical", внутренние ссылки, редиректы, Sitemap, HTTPS и вариант домена с www или без него.
Как проверить индексацию в Яндексе
Добавьте сайт в Яндекс Вебмастер и подтвердите права. Подробная последовательность есть в руководстве как добавить сайт в Яндекс Вебмастер.
Для диагностики используйте несколько разделов:
- Индексирование → Страницы в поиске — список участвующих и исключённых страниц;
- Индексирование → Мониторинг важных страниц — история обхода, HTTP-ответ и статус выбранных URL;
- Инструменты → Проверка ответа сервера — доступность страницы для робота;
- Индексирование → Переобход страниц — отправка отдельных обновлённых адресов;
- Индексирование → Файлы Sitemap — состояние карты сайта;
- Индексирование → Рендеринг страниц JavaScript — управление обработкой JS-контента.
Статус исключения часто сразу указывает направление проверки: дубль, редирект, ошибка сервера, запрет индексирования или малоценная и маловостребованная страница.
Можно ли проверять индекс оператором site:
Для быстрой внешней проверки используйте запросы:
site:example.com
site:example.com/catalog/
site:example.com "точная фраза со страницы"Оператор помогает увидеть примеры страниц, странные поддомены, старые URL и примерные изменения. Но результаты не являются полным экспортом индекса и не подходят для точного подсчёта.
Если конкретный URL отсутствует по запросу site:, это ещё не доказывает, что он исключён. И наоборот, появление URL не говорит о хороших позициях или актуальной версии содержимого. Для собственного сайта доверяйте отчётам и проверке URL в панелях вебмастера.
Почему страница не индексируется

Робот не знает об URL
Страница не связана внутренними ссылками, отсутствует в Sitemap или доступна только после поиска и фильтра. Добавьте её в логичную структуру, если она действительно нужна пользователям.
Обход запрещён в robots.txt
Пример запрета раздела:
User-agent: *
Disallow: /private/robots.txt управляет сканированием, а не является надёжным способом удаления уже известного URL из поиска. Если робот не может загрузить страницу, он также не увидит размещённый на ней noindex.
Установлен noindex
Директива может находиться в HTML:
<meta name="robots" content="noindex, follow">или в HTTP-заголовке:
X-Robots-Tag: noindexДля индексируемой страницы удалите запрет и убедитесь, что робот может её просканировать. Практические сценарии управления доступом описаны в статье как закрыть сайт от индексации.
Сервер возвращает неправильный код
Целевая страница обычно должна стабильно отвечать 200 OK. Ошибки 5xx, тайм-ауты и защита CDN могут мешать обходу. Несуществующий URL должен возвращать настоящий 404 или 410, а не пустую страницу с кодом 200 — soft 404.
Страница является редиректом
URL с постоянным перенаправлением не предназначен для самостоятельной индексации. Исправляйте проблему только тогда, когда редирект установлен ошибочно.
Поисковик выбрал другой canonical
Дубли создают параметры фильтров, сортировка, версии печати, HTTP/HTTPS, www, слеши и повторяющиеся карточки. Укажите предпочтительный URL и согласуйте все сигналы.
<link rel="canonical" href="https://example.com/catalog/item/">Canonical должен вести на доступную индексируемую страницу с эквивалентным содержимым. Не отправляйте все разные товары или статьи на одну общую страницу.
Контент появляется только после JavaScript
Робот может загрузить пустой шаблон, столкнуться с ошибкой API или отложенным содержимым. Сравните исходный HTML и отрисованную версию, проверьте консоль, сетевые запросы и доступность ресурсов для робота.
Страница слишком похожа на другие
Города с заменой одного названия, пустые теги, комбинации фильтров и автоматически созданные тексты могут не иметь самостоятельной ценности. Объедините дубли, удалите лишние URL из внутренней структуры или существенно улучшите полезность целевых страниц.
Слабая внутренняя роль страницы
Если на URL почти нет ссылок, он расположен глубоко и не связан с тематическим разделом, поиску сложнее понять его важность. Перелинковка должна помогать посетителю находить материал, а не просто увеличивать число ссылок.
Сайт новый или недавно изменён
Обход и обработка занимают время. Google указывает диапазон от нескольких дней до нескольких недель для повторного сканирования. Отправка заявки не гарантирует немедленной индексации.
Как ускорить индексацию сайта
Ускорение — это не поиск секретной кнопки, а устранение препятствий и ясные сигналы о важных URL.

Создайте понятную структуру
Пользователь и робот должны добраться до важных страниц по обычным ссылкам за разумное число переходов. Используйте категории, хлебные крошки, тематические подборки и блоки связанных материалов.
Поддерживайте чистый Sitemap
Включайте только канонические URL с кодом 200, которые разрешено индексировать. Не добавляйте редиректы, ошибки, дубли и страницы с noindex. Разделяйте большие карты по типам или разделам и указывайте честный lastmod.
Обеспечьте стабильный сервер
Долгие ответы и ошибки уменьшают эффективность обхода. Контролируйте время ответа, пики 5xx, лимиты CDN, firewall и доступность с разных сетей. При переносе сайта на защищённый протокол используйте корректные редиректы; полный порядок приведён в статье об отличиях HTTP и HTTPS.
Сократите мусорное пространство URL
Фасетная навигация, параметры сортировки, внутренний поиск, календарь и бесконечные комбинации могут создавать огромное число малоценных адресов. Определите, какие страницы нужны в поиске, а остальные уберите из ссылочной структуры или обработайте подходящим способом.
Публикуйте содержательные страницы
Страница должна решать самостоятельную задачу. Одного уникального набора слов недостаточно: важны полнота ответа, точность, понятная структура, авторство и соответствие ожиданию пользователя.
Используйте отправку URL по назначению
Отправляйте новую или существенно обновлённую страницу один раз и следите за статусом. Многократное нажатие «Запросить индексирование» не ускоряет обход. Для массовых URL используйте Sitemap, а для актуальных изменений в Яндексе можно настроить IndexNow.
Как диагностировать проблему пошагово
- Проверьте точный URL в панели соответствующей поисковой системы.
- Убедитесь, что опубликованная версия отвечает
200 OK. - Проверьте доступ в
robots.txt. - Найдите
noindexв HTML и HTTP-заголовках. - Сравните указанный и выбранный canonical.
- Откройте отрисованную версию и проверьте основной контент.
- Убедитесь, что URL есть в чистом Sitemap.
- Найдите внутренние ссылки на страницу.
- Проверьте дубли, параметры и альтернативные версии.
- Оцените самостоятельную пользу содержимого.
- После исправления отправьте URL на переобход один раз.
- Наблюдайте за отчётами и логами, а не только за
site:.
Для сайта с тысячами URL нужна сегментация по типам страниц. Общая доля проиндексированных адресов мало что объясняет, если в одной цифре смешаны товары, категории, статьи, фильтры и технические URL.
Как контролировать индексацию постоянно

Раз в неделю или после крупных изменений проверяйте:
- рост и падение индексируемых страниц по разделам;
- новые причины исключения;
- важные URL, которые потеряли статус;
- ошибки
5xx,404и soft 404; - изменение выбранных canonical;
- состояние Sitemap;
- даты последнего обхода приоритетных страниц;
- попадание в индекс служебных и параметрических URL;
- поисковые показы после обновления контента.
Для крупного сайта сопоставляйте панели вебмастера с серверными логами и собственным списком канонических URL. Логи показывают фактические обращения робота, HTTP-коды и потраченный на разные разделы обход.
Главная метрика — не максимальное количество страниц в индексе. Цель состоит в том, чтобы значимые канонические страницы индексировались, а дубли, фильтры и служебные URL не расходовали внимание робота и не конкурировали с основным содержимым.
Частые ошибки
Считать все страницы обязательными для индекса
Корзина, авторизация, результаты внутреннего поиска, бесконечные фильтры и дубли обычно не нужны в поисковой выдаче.
Оценивать сайт только по оператору site:
Он показывает выборку и не заменяет отчёты владельца сайта.
Отправлять URL каждый день
Заявка сообщает о необходимости повторного обхода, но не заставляет алгоритм индексировать страницу.
Закрывать в robots.txt страницу с noindex
Робот может не загрузить документ и не увидеть noindex. Выбирайте способ управления в зависимости от задачи.
Включать в Sitemap все доступные URL
Карта сайта должна отражать желаемый канонический индекс, а не технический список всего, что генерирует CMS.
Ждать позиций сразу после индексации
Индексирование открывает возможность участия в выдаче. Ранжирование — отдельный этап.
Чек-лист индексируемой страницы
- URL доступен без авторизации.
- Сервер стабильно возвращает
200 OK. - Обход не запрещён в
robots.txt. - Нет
noindexв HTML илиX-Robots-Tag. - Основной контент виден в отрисованной версии.
- Страница указывает корректный canonical.
- Внутренние ссылки ведут на канонический URL.
- URL включён в актуальный Sitemap.
- Нет противоречия между HTTP/HTTPS,
www, слешами и параметрами. - Содержимое имеет самостоятельную ценность и не дублирует другой URL.
- Удалённые страницы отдают
404или410, перенесённые — корректный редирект. - Статус проверен в Search Console и Яндекс Вебмастере.
Частые вопросы
Сколько времени занимает индексация сайта?
Фиксированного срока нет. Новая или обновлённая страница может быть обработана за несколько дней, но процесс способен занять несколько недель. Скорость зависит от обнаружения, доступности, структуры, масштаба сайта и решений поисковой системы.
Можно ли гарантированно добавить страницу в индекс?
Нет. Google и Яндекс прямо указывают, что отправка URL или Sitemap не гарантирует включение в поиск. Владелец может обеспечить техническую доступность и качество, но окончательное решение принимает поисковая система.
Почему страница была в поиске, а потом исчезла?
Причиной может быть новый canonical, обнаруженный дубль, noindex, ошибка сервера, редирект, удаление, переоценка содержимого или нарушение безопасности. Смотрите историю статуса и последний обход.
Нужно ли индексировать теги и фильтры?
Только если они формируют самостоятельные востребованные посадочные страницы с уникальной ценностью. Пустые комбинации и массовые дубли лучше не включать в поисковую структуру.
Помогает ли обновление даты публикации?
Само изменение даты не делает страницу полезнее и не гарантирует повторную индексацию. Обновляйте содержание по существу и передавайте честный lastmod.
Влияет ли количество страниц в индексе на позиции?
Прямой цели «проиндексировать как можно больше» нет. Тысячи дублей и слабых страниц не улучшают видимость. Важнее качество и полнота индекса целевых URL.
Нужно ли отправлять каждую новую статью вручную?
На технически здоровом сайте робот обычно обнаруживает публикацию по внутренним ссылкам и Sitemap. Ручная отправка полезна для отдельных важных URL, но не должна заменять нормальную архитектуру.
Вывод
Индексация — это не одно действие и не кнопка в панели вебмастера. Страница должна быть обнаружена, доступна для обхода, корректно отрисована, обработана и выбрана канонической. Только после этого она получает возможность участвовать в результатах, где начинается отдельная задача ранжирования.
Проверяйте проблемный URL в инструментах владельца, ищите конкретный этап отказа и исправляйте причину. Для большого проекта полезен технический SEO-аудит: он позволяет сопоставить структуру сайта, Sitemap, директивы, логи роботов и реальный индекс по типам страниц.




