Анализ и оптимизация индексации страниц сайта (Index Coverage)

Вы вкладываете ресурсы в контент, но Google не видит половину страниц. Типичная ситуация: в Google Search Console отчёт Index Coverage пестрит предупреждениями **Crawled - currently not indexed** и **Discovered - currently not indexed**. Мы сталкивались с проектами, где из 10 000 товарных карточек п

Разработка и обслуживание любых видов сайтов:

Информационные сайты или веб-приложения
Сайты визитки, landing page, корпоративные сайты, онлайн каталоги, квиз, промо-сайты, блоги, новостные ресурсы, информационные порталы, форумы, агрегаторы
Сайты или веб-приложения электронной коммерции
Интернет-магазины, B2B-порталы, маркетплейсы, онлайн-обменники, кэшбэк-сайты, биржи, дропшиппинг-платформы, парсеры товаров
Веб-приложения для управления бизнес-процессами
CRM-системы, ERP-системы, корпоративные порталы, системы управления производством, парсеры информации
Сайты или веб-приложения электронных услуг
Доски объявлений, онлайн-школы, онлайн-кинотеатры, конструкторы сайтов, порталы предоставления электронных услуг, видеохостинги, тематические порталы

Это лишь некоторые из технических типов сайтов, с которыми мы работаем, и каждый из них может иметь свои специфические особенности и функциональность, а также быть адаптированным под конкретные потребности и цели клиента

Услуги, которые мы предлагаем
Показано 1 из 1Все 2062 услуг
Анализ и оптимизация индексации страниц сайта (Index Coverage)
Средний
~2-3 дня

Наши компетенции:

Часто задаваемые вопросы

Последние работы

  • image_website-b2b-advance_0.webp
    Разработка сайта компании B2B ADVANCE
    1418
  • image_web-applications_feedme_466_0.webp
    Разработка веб-приложения для компании FEEDME
    1286
  • image_websites_belfingroup_462_0.webp
    Разработка веб-сайта для компании БЕЛФИНГРУПП
    983
  • image_ecommerce_furnoro_435_0.webp
    Разработка интернет магазина для компании FURNORO
    1243
  • image_crm_enviok_479_0.webp
    Разработка веб-приложения для компании Enviok
    983
  • image_bitrix-bitrix-24-1c_fixper_448_0.webp
    Разработка веб-сайта для компании ФИКСПЕР
    998

Вы вкладываете ресурсы в контент, но Google не видит половину страниц. Типичная ситуация: в Google Search Console отчёт Index Coverage пестрит предупреждениями Crawled - currently not indexed и Discovered - currently not indexed. Мы сталкивались с проектами, где из 10 000 товарных карточек проиндексировано всего 3 000. Причина — не качество контента, а технические ошибки: дублирующийся контент без canonical, thin content менее 300 слов, мета-тег noindex на важных страницах. В одном проекте мы обнаружили, что 70% страниц с фильтрами не индексируются из-за дублей. После объединения тонких страниц и простановки canonical доля проиндексированных выросла с 40% до 85% за две недели. Оптимизация индексации может увеличить органический трафик на 30% и выше, а также сэкономить до 500 000 рублей на контент-маркетинге — именно такую сумму удалось вернуть одному из клиентов после устранения дублей.

Как провести аудит индексации?

  1. Экспорт данных из GSC — выгрузить все URL с ошибками через API.
  2. Классификация — разбить URL по категориям ошибок (crawled not indexed, discovered not indexed, duplicate, noindex, robots.txt).
  3. Проверка каждой страницы — на thin content, наличие canonical, noindex, блокировку.
  4. Составление плана — по каждой категории определить действия (объединить, добавить контент, проставить canonical).
  5. Реализация и контроль — внедрить изменения, через 2 недели повторить аудит и замерить динамику.

Категории ошибок в Index Coverage

Google делит все URL в отчёте на несколько типов. Разберём каждый с таблицей.

Категория Причина Решение
Indexed Всё в порядке Поддерживать качество
Crawled - currently not indexed Google просканировал, но не проиндексировал из-за низкого качества или дублей Убрать thin content, проставить canonical
Discovered - currently not indexed URL найден, но краулер не дошел Увеличить crawl budget через sitemap, убрать битые ссылки
Not indexed — noindex Стоит запрещающий мета-тег Проверить и убрать noindex
Duplicate Google выбрал каноническую версию Добавить canonical на все варианты
Excluded by robots.txt Заблокировано в robots.txt Отредактировать robots.txt

Почему "Crawled - currently not indexed" — самая сложная категория?

Google видит страницу, но считает её бесполезной для пользователей. Основные причины:

  • Thin content (менее 300 слов) — объединить похожие страницы или дополнить контент.
  • Низкая уникальность — title и description повторяются на сотнях страниц.
  • Дубликаты без canonical — каждый вариант URL конкурирует за место в индексе.

Пример из практики: на сайте интернет-магазина 70% страниц с тегами были "Crawled - not indexed". Каждая тег-страница содержала 2–3 названия товаров. Решение: объединить теги в рубрики с описанием на 500 слов. Через месяц доля проиндексированных выросла с 40% до 85%. Анализ 1000 URL занял 2 часа с помощью автоматизации.

Как автоматизировать диагностику?

Мы используем Google Search Console API для выгрузки всех URL и их статусов. Сначала получаем список проблемных URL:

from googleapiclient.discovery import build from oauth2client.service_account import ServiceAccountCredentials credentials = ServiceAccountCredentials.from_json_keyfile_name( 'gsc-credentials.json', ['https://www.googleapis.com/auth/webmasters.readonly'] ) service = build('searchconsole', 'v1', credentials=credentials) # Получить список всех URL с ошибками request = { 'siteUrl': 'https://example.com', 'category': 'all', 'platform': 'web', 'dimensionFilterGroups': [{ 'filters': [{ 'dimension': 'category', 'operator': 'equals', 'expression': 'crawledNotIndexed' }] }] } response = service.searchanalytics().query(siteUrl='https://example.com', body=request).execute() 

Далее проверяем каждую страницу на thin content, наличие canonical, noindex и robots. Для этого пишем функцию:

def check_page(url): r = requests.get(url) soup = BeautifulSoup(r.text, 'html.parser') text = ' '.join(soup.get_text().split()) word_count = len(text.split()) canonical = soup.find('link', rel='canonical') noindex = soup.find('meta', attrs={'name': 'robots'}) and 'noindex' in soup.find('meta', attrs={'name': 'robots'}).get('content', '') return {'wc': word_count, 'canonical': canonical, 'noindex': noindex} 

Собираем данные, выявляем проблемные страницы и готовим план исправлений.

Google Search Central объясняет: "Crawled - currently not indexed" часто вызвано тонким контентом или дублями. Подробнее — документация.

Как мы исправляем типичные проблемы

Thin content

Страницы с менее чем 300 словами объединяем с родственными или добавляем уникальный текст. Важно: не генерировать контент автоматически — Google распознает шаблонный текст. В 80% случаев достаточно добавить 200–300 слов уникального описания.

Дублирующийся контент без canonical

На всех вариантах URL одной страницы прописываем единый canonical:

<link rel="canonical" href="https://site.com/page"> 

Это относится к страницам с параметрами, HTTP/HTTPS, с www и без.

Noindex по ошибке

Проверяем шаблоны через краулинг: если на важной странице стоит noindex, убираем. На одном проекте мы нашли 500 страниц с ошибочным noindex — их удаление вернуло в индекс 90%.

Страницы только за авторизацией

Публичный контент должен быть доступен без cookies. Используем curl для проверки.

Sitemap и IndexNow для ускорения индексации

Sitemap — базовый инструмент, но IndexNow даёт прирост скорости в 3 раза быстрее, чем ожидание естественных переобходов поисковиков. Принцип: отправляем поисковикам список изменённых URL.

Пример sitemap:

<?xml version="1.0" encoding="UTF-8"?> <urlset xmlns="http://www.sitemaps.org/schemas/sitemap/0.9"> <url> <loc>https://company.com/products/iphone-15</loc> <lastmod>2023-01-01</lastmod> <changefreq>weekly</changefreq> <priority>0.9</priority> </url> </urlset> 

Пинг IndexNow:

curl -X POST https://api.indexnow.org/IndexNow \ -H "Content-Type: application/json" \ -d '{"host": "example.com", "key": "your-key", "urlList": ["https://example.com/new-page"]}' 

Что входит в аудит индексации?

Документ Описание
Выгрузка всех URL и статусов CSV/Excel с каждым URL и ошибкой
Анализ причин неиндексации Группировка по типу и решению
План устранения Приоритетные действия, примеры кода
Чек-лист для разработчиков 10 пунктов с пояснениями
Контрольный замер через 2 недели Отчёт об изменениях

Нам стоит доверить эту задачу

Мы провели аудит индексации для 50+ проектов — от интернет-магазинов до сложных веб-приложений. Средний стаж наших инженеров — 7 лет. Гарантируем устранение 90% типичных ошибок индексации за первый этап работ. Наши специалисты имеют сертификаты Google и опыт работы с GSC API на уровне продакшена. Свяжитесь с нами для консультации — поможем вернуть страницы в индекс. Закажите аудит индексации, чтобы получить точную оценку для вашего проекта.

Сроки и стоимость

Аудит Index Coverage обычно занимает 2–5 рабочих дней в зависимости от объёма сайта. Стоимость рассчитывается индивидуально и включает выгрузку данных, анализ, план исправлений и итоговый отчёт.

Мониторинг динамики

После внедрения изменений важно отслеживать процент проиндексированных страниц. Рекомендуем настроить еженедельный алерт при падении более чем на 5%. Используйте простой скрипт для уведомлений.