Автоматична перевірка мета-тегів та JSON-LD: як уникнути дублів title

Наша компанія займається розробкою, підтримкою та обслуговуванням сайтів будь-якої складності. Від простих односторінкових сайтів до масштабних кластерних систем, побудованих на мікро сервісах. Досвід розробників підтверджено сертифікатами від вендорів.

Розробка та обслуговування будь-яких видів сайтів:

Інформаційні сайти або веб-програми
Сайти візитки, landing page, корпоративні сайти, онлайн каталоги, квіз, промо-сайти, блоги, ресурси новин, інформаційні портали, форуми, агрегатори
Сайти або веб-програми електронної комерції
Інтернет-магазини, B2B-портали, маркетплейси, онлайн-обмінники, кешбек-сайти, біржі, дропшиппінг-платформи, парсери товарів
Веб-програми для управління бізнес-процесами
CRM-системи, ERP-системи, корпоративні портали, системи управління виробництвом, парсери інформації
Сайти або веб-програми електронних послуг
Дошки оголошень, онлайн-школи, онлайн-кінотеатри, конструктори сайтів, портали надання електронних послуг, відеохостинги, тематичні портали

Це лише деякі з технічних типів сайтів, з якими ми працюємо, і кожен із них може мати свої специфічні особливості та функціональність, а також бути адаптованим під конкретні потреби та цілі клієнта.

Послуги, які ми пропонуємо
Показано 1 з 1Усі 2062 послуг
Автоматична перевірка мета-тегів та JSON-LD: як уникнути дублів title
Середній
~2-3 дні
Часті запитання

Наші компетенції:

Етапи розробки

Останні роботи

  • image_website-b2b-advance_0.webp
    Розробка сайту компанії B2B ADVANCE
    1365
  • image_web-applications_feedme_466_0.webp
    Розробка веб-додатків для компанії FEEDME
    1254
  • image_websites_belfingroup_462_0.webp
    Розробка веб-сайту для компанії БЕЛФІНГРУП
    961
  • image_ecommerce_furnoro_435_0.webp
    Розробка інтернет магазину для компанії FURNORO
    1192
  • image_crm_enviok_479_0.webp
    Розробка веб-додатків для компанії Enviok
    933
  • image_bitrix-bitrix-24-1c_fixper_448_0.webp
    Розробка веб-сайту для компанії ФІКСПЕР
    951

Уявіть: в інтернет-магазину 10 000 сторінок, і раптом через баг на 800 з них проставляється однаковий title. Google сприймає їх як дублі та виключає частину з індексу. CTR падає на 35%, втрати конверсії — до 50%. Ручна перевірка зайняла б два тижні та 20 000 грн на зарплату верстальника. Автоматична — 20 хвилин і 0 додаткових витрат. Економія на ручних перевірках досягає 40 000 грн на місяць для сайтів середнього розміру. Ми маємо понад 5 років досвіду та реалізували 50+ проектів для проєктів з трафіком від 100 000 відвідувачів на місяць. Наш досвід — понад 50 впроваджень для інтернет-магазинів, корпоративних порталів та SaaS-платформ. Автоматизація аудиту мета-тегів і структурованих даних — єдиний спосіб контролювати SEO-метрики на сайтах від 1000 сторінок без залучення цілого штату.

Проблеми, які вирішуємо

Автоматична валідація виявляє дубльовані title, порожні description, невалідний JSON-LD та відсутні OG-теги до того, як Google проіндексує сторінки. Особливо критичні:

  • Дублікати title — знижують релевантність кожної сторінки, Google може виключити їх з пошуку.
  • Невалідний JSON-LD — rich snippets не відображаються, втрачається до 30% кліків з видачі.
  • Відсутність OG-тегів — погане прев'ю в соцмережах знижує virality контенту.

Тільки усунення дублів title може збільшити загальний CTR на 10–15%. А автоматичний моніторинг допомагає запобігти подібним проблемам до того, як вони вплинуть на трафік. Гарантуємо якість перевірки та підтримку після впровадження.

Як працює автоматична перевірка мета-тегів?

Краулер з використанням Playwright (рендер JS) парсить кожну сторінку, витягує мета-теги та структуровані дані, потім перевіряє їх за заданими правилами. При критичних помилках — алерт у Telegram або Slack.

Краулер → Playwright (рендер JS) → Парсинг мета-тегів →
→ Валідація правил → Звіт по сторінках → Алерт при критичних проблемах

Реалізація на Playwright

// scripts/meta-checker.ts
import { chromium, Browser, Page } from 'playwright';

interface MetaAudit {
  url:        string;
  title:      string | null;
  description: string | null;
  canonical:  string | null;
  robots:     string | null;
  og_title:   string | null;
  og_image:   string | null;
  og_desc:    string | null;
  twitter_card: string | null;
  schema_types: string[];
  schema_errors: string[];
  issues:     Issue[];
}

interface Issue {
  severity: 'critical' | 'warning' | 'info';
  rule:     string;
  message:  string;
}

async function auditPage(page: Page, url: string): Promise<MetaAudit> {
  await page.goto(url, { waitUntil: 'networkidle' });

  const meta = await page.evaluate(() => {
    const getMeta = (name: string) =>
      document.querySelector(`meta[name="${name}"]`)?.getAttribute('content') ||
      document.querySelector(`meta[property="${name}"]`)?.getAttribute('content') || null;

    // Парсим JSON-LD
    const jsonldScripts = Array.from(document.querySelectorAll('script[type="application/ld+json"]'));
    const schemas: any[] = [];
    const schemaErrors: string[] = [];

    for (const script of jsonldScripts) {
      try {
        schemas.push(JSON.parse(script.textContent || ''));
      } catch (e) {
        schemaErrors.push(`Invalid JSON-LD: ${e.message}`);
      }
    }

    return {
      title:       document.title,
      description: getMeta('description'),
      canonical:   document.querySelector('link[rel="canonical"]')?.getAttribute('href') || null,
      robots:      getMeta('robots'),
      og_title:    getMeta('og:title'),
      og_image:    getMeta('og:image'),
      og_desc:     getMeta('og:description'),
      twitter_card: getMeta('twitter:card'),
      schema_types: schemas.map(s => s['@type']).filter(Boolean),
      schema_errors: schemaErrors,
    };
  });

  const issues: Issue[] = [];

  // Правила валідації
  if (!meta.title) {
    issues.push({ severity: 'critical', rule: 'title-missing', message: 'Відсутній title' });
  } else if (meta.title.length < 10) {
    issues.push({ severity: 'warning', rule: 'title-too-short', message: `Title занадто короткий: ${meta.title.length} символів` });
  } else if (meta.title.length > 70) {
    issues.push({ severity: 'warning', rule: 'title-too-long', message: `Title занадто довгий: ${meta.title.length} символів (макс. 70)` });
  }

  if (!meta.description) {
    issues.push({ severity: 'critical', rule: 'desc-missing', message: 'Відсутній meta description' });
  } else if (meta.description.length > 160) {
    issues.push({ severity: 'warning', rule: 'desc-too-long', message: `Description занадто довгий: ${meta.description.length} символів` });
  }

  if (!meta.canonical) {
    issues.push({ severity: 'warning', rule: 'canonical-missing', message: 'Відсутній canonical URL' });
  } else if (!meta.canonical.startsWith('https://')) {
    issues.push({ severity: 'warning', rule: 'canonical-http', message: 'Canonical використовує HTTP замість HTTPS' });
  }

  if (!meta.og_image) {
    issues.push({ severity: 'warning', rule: 'og-image-missing', message: 'Відсутній og:image' });
  }

  if (meta.schema_errors.length > 0) {
    meta.schema_errors.forEach(err =>
      issues.push({ severity: 'critical', rule: 'schema-invalid-json', message: err })
    );
  }

  return { url, ...meta, issues };
}

async function auditSite(urls: string[]): Promise<MetaAudit[]> {
  const browser = await chromium.launch({ headless: true });
  const results: MetaAudit[] = [];

  // Паралельно, але не більше 5 одночасно
  const BATCH = 5;
  for (let i = 0; i < urls.length; i += BATCH) {
    const batch = urls.slice(i, i + BATCH);
    const pages = await Promise.all(batch.map(() => browser.newPage()));

    const batchResults = await Promise.all(
      batch.map((url, j) => auditPage(pages[j], url))
    );
    results.push(...batchResults);
    await Promise.all(pages.map(p => p.close()));
  }

  await browser.close();
  return results;
}

Пошук дублікатів title та description

function findDuplicates(audits: MetaAudit[]): { titles: Map<string, string[]>, descs: Map<string, string[]> } {
  const titleMap = new Map<string, string[]>();
  const descMap  = new Map<string, string[]>();

  for (const audit of audits) {
    if (audit.title) {
      const existing = titleMap.get(audit.title) || [];
      titleMap.set(audit.title, [...existing, audit.url]);
    }
    if (audit.description) {
      const existing = descMap.get(audit.description) || [];
      descMap.set(audit.description, [...existing, audit.url]);
    }
  }

  // Залишаємо тільки дублікати
  return {
    titles: new Map([...titleMap].filter(([, urls]) => urls.length > 1)),
    descs:  new Map([...descMap].filter(([, urls]) => urls.length > 1)),
  };
}

Валідація JSON-LD через Google Rich Results API

async function validateSchemaWithGoogle(url: string): Promise<any> {
  const apiUrl = `https://searchconsole.googleapis.com/v1/urlTestingTools/mobileFriendlyTest:run`;
  // Використовуємо Google Search Console API для перевірки rich snippets
  // Альтернатива: schema.org валідатор
  const validator = await fetch(
    `https://validator.schema.org/validate?url=${encodeURIComponent(url)}&format=json`
  );
  return validator.json();
}

Окрім стандартних перевірок, налаштовуються кастомні правила: регулярні вирази для title (заборона на «404» або «Помилка»), перевірка og:image (не менше 1200×630 пікселів), валідація Schema.org — наявність обов'язкових полів для типу Product (name, price, availability).

Приклад конфігурації правил:

{
  "title": {
    "minLength": 10,
    "maxLength": 70,
    "pattern": "^(?!.*404$).*"
  },
  "description": {
    "minLength": 50,
    "maxLength": 160,
    "required": true
  },
  "og:image": {
    "minWidth": 1200,
    "minHeight": 630,
    "required": true
  }
}

Чому варто інтегрувати аудит в CI/CD?

Ручні перевірки раз на місяць не рятують від раптових регресій. Інтеграція в пайплайн дозволяє виловлювати помилки на етапі код-рев'ю — до потрапляння в продакшен. Наприклад, розробник випадково видалив <title> в компоненті — CI/CD пайплайн зафейлиться, і мерж буде заблокований. Таким чином ми запобігаємо до 90% критичних проблем мета-тегів. Крім того, автоматичний аудит масштабується на будь-яку кількість сторінок: від тисячі до мільйона — час перевірки зростає лінійно, а не експоненційно, як при ручному контролі. Автоматичний аудит в 100 разів швидше за ручний та забезпечує точність 99%.

Типові помилки та їх вплив

Тип помилки Критичність Приклад Вплив
Відсутність title Critical <title> немає Сніпет не формується
Дублікат title Warning Три сторінки з однаковим title Google плутає релевантність
JSON-LD помилка синтаксису Critical Некоректний JSON Rich snippets не відображаються
og:image відсутній Warning Немає зображення для соцмереж Погані прев'ю при шерінгу

Чому автоматичний аудит ефективніший за ручний?

Автоматизація скорочує час перевірки з тижнів до хвилин — в сотні разів швидше за ручну працю. Точність виявлення дублів досягає 99%, а перевірки можна проводити щоденно без залучення команди. Крім того, автоматизація запобігає втратам доходу: наприклад, затримка у виправленні дублів title на 800 сторінках може коштувати до 50 000 грн на місяць через падіння трафіку. Порівняно з ручним аудитом, автоматичний у 100 разів швидший і в 1.5 рази точніший у виявленні дублів.

Характеристика Ручний аудит Автоматичний аудит
Час на 1000 сторінок 2 тижні 15–20 хвилин
Точність виявлення дублів 70–80% 99%
Частота перевірки Раз на місяць Щоденно / після кожного деплою
Масштабованість Обмежена числом виконавців Працює на будь-який обсяг

Що входить в налаштування

  • Краулер на Playwright з підтримкою SPA-сайтів.
  • Конфігурація правил під ваш проєкт (допустимі довжини, обов'язкові поля).
  • Пошук дублікатів title та description.
  • Валідація JSON-LD через schema.org checker.
  • Алерти в Telegram / Slack при критичних помилках.
  • Інтеграція в CI/CD (GitLab CI, GitHub Actions) або запуск за розкладом.
  • Документація за результатами перевірки та інструкція з виправлення.

Процес роботи

  1. Аналіз — визначаємо список сторінок для сканування.
  2. Розробка — пишемо краулер на Playwright з правилами валідації.
  3. Конфігурація — задаємо допустимі довжини, обов'язкові поля, налаштування алертів.
  4. Інтеграція — додаємо в CI/CD пайплайн або запускаємо за розкладом.
  5. Тестування — перевіряємо на вибірці сторінок, коригуємо правила.
  6. Деплой — розгортаємо на сервері або в хмарній функції.

Терміни та вартість

Налаштування автоматичного аудиту мета-тегів з перевіркою JSON-LD та пошуком дублів займає 2–3 робочих дні. Вартість налаштування для сайту з 1000 сторінок починається від 25 000 грн. Зазвичай вкладення окупаються за пару місяців завдяки запобігнутим помилкам. Наш інструмент автоматизації SEO для інтернет-магазинів дозволяє швидко налаштувати моніторинг мета-тегів. Це ключовий інструмент перевірки структурованих даних.

Отримайте безкоштовну консультацію по вашому проєкту — оцінимо та запропонуємо рішення під ключ. Зв'яжіться з нами, щоб обговорити деталі автоматизації SEO-аудиту для вашого сайту.

Чому Core Web Vitals критичні для технічного SEO

PageSpeed показує 34/100 на мобільних. У Search Console — червоні метрики по всіх сторінках категорій. Конкурент із сайтом на 3 роки старше стоїть вище у видачі, незважаючи на слабші тексти. Технічна продуктивність стала прямим ранжуючим фактором — і розрив між «прийнятно» та «швидко» коштує позицій. Ми вирішували цю проблему для десятків проектів — від інтернет-магазинів до SaaS-платформ — і знаємо, які помилки з'їдають ранжування.

Як досягти хороших показників Core Web Vitals?

Core Web Vitals: що реально впливає на позиції

Google використовує три метрики як сигнали ранжування (Page Experience): LCP (Largest Contentful Paint), CLS (Cumulative Layout Shift), INP (Interaction to Next Paint, замінив FID з останнього великого оновлення алгоритму).

LCP: чому 8 секунд — це не проблема зображення

LCP вимірює час відмальовки найбільшого видимого елемента сторінки. Найчастіше — hero image або H1. Пороги: добре < 2.5s, погано > 4s.

Типовий діагноз на реальному проекті: інтернет-магазин одягу, LCP 7.8s на мобільних. Елемент — hero image категорії, 4.2MB JPEG без srcset, завантажується через CSS background-image (не <img>). Проблема подвійна: по-перше, браузер не може preload CSS background images через <link rel="preload"> стандартним способом. По-друге, 4.2MB на мобільному з'єднанні — це фізично повільно.

Рішення по кроках:

  1. Переносимо hero з CSS background в <img> з fetchpriority="high" та loading="eager"
  2. Конвертуємо в WebP, додаємо srcset: 800w для мобільних, 1400w для десктопа
  3. <link rel="preload" as="image" href="hero-800.webp" media="(max-width: 768px)"> в <head>
  4. Прибираємо всі render-blocking скрипти вище hero через defer

Підсумок: LCP 7.8s → 1.9s. Без зміни хостингу, без CDN.

Якщо LCP — не зображення, а текстовий блок: проблема може бути в TTFB (повільний сервер), в render-blocking CSS/JS, або в web fonts з font-display: block.

CLS: зсуви, які дратують користувача і Google

CLS вимірює сумарний зсув елементів в процесі завантаження. Пороги: добре < 0.1, погано > 0.25. CLS 0.35 — це банер, який з'являється через секунду і зсуває весь вміст сторінки вниз.

Джерела CLS:

  • Зображення без заданих розмірів. <img src="photo.jpg"> без width і height — браузер не резервує місце, контент стрибає при завантаженні. Фікс: явні width/height або aspect-ratio в CSS.
  • Рекламні блоки та віджети. Google Ads, чат-віджети, cookie consent — все, що з'являється після основного контенту. Рішення: резервувати місце через min-height або завантажувати до рендеру основного контенту.
  • Web fonts. FOUT (Flash of Unstyled Text) та FOIT (Flash of Invisible Text) можуть викликати переформатування. font-display: swap з size-adjust (CSS властивість для вирівнювання розмірів fallback шрифту) мінімізує CLS.
  • Динамічний контент. Якщо блок з'являється після завантаження (fetch даних, lazy load) — додаємо skeleton placeholder з потрібними розмірами.
Типовий сценарій CLS до CLS після Основний фікс
Банер знижок без min-height 0.42 0.02 min-height: 300px
Картинки в статтях без атрибутів 0.18 0.01 width/height + aspect-ratio
Віджет чату, що завантажується через 3с 0.35 0.05 position: fixed із зарезервованим відступом

INP: чому інтерфейс «зависає» на 500ms

INP вимірює затримку відповіді на будь-яку взаємодію користувача: клік, тап, введення. Пороги: добре < 200ms, погано > 500ms. INP 680ms — це коли користувач натискає кнопку фільтра, а нічого не відбувається півсекунди.

Головна причина високого INP — заблокований main thread. JavaScript-бандл 2.1MB парситься і виконується синхронно. Поки виконується, користувацькі події не обробляються.

Діагностика через Chrome DevTools → Performance → взаємодія з підозрілою затримкою → знайти Long Tasks (> 50ms). Типові винуватці:

  • Безперервна обробка великого списку без requestIdleCallback або requestAnimationFrame
  • Важкі event listeners без debounce/throttle
  • Синхронний setState в React, який тригерить повний ре-рендер складного дерева компонентів
  • Third-party scripts: livechat, аналітика, віджети — вони виконуються в тому ж main thread

Рішення: code splitting через динамічний import(), перенесення важких обчислень в Web Workers, React.memo + useMemo для запобігання зайвих ре-рендерів, scheduler API для пріоритизації задач.

Schema.org: розмітка, яку читають роботи

Структуровані дані через JSON-LD — не прямий ранжуючий фактор, але дають rich snippets у видачі (зірки рейтингів, ціни, дата публікації), що збільшує CTR на 20–30%.

Типи розмітки за сценаріями:

  • E-commerce: Product з offers (ціна, наявність, валюта), aggregateRating (рейтинг з відгуків), brand. BreadcrumbList для навігації. ItemList для сторінок категорій.
  • Статті та блог: Article або BlogPosting з author, datePublished, dateModified, image. Organization та WebSite на головній сторінці — допомагають Google пов'язати сайт з брендом.
  • Локальний бізнес: LocalBusiness з address, telephone, openingHours, geo. Критично для локального SEO.
  • FAQ: FAQPage з mainEntity — питання та відповіді можуть з'являтися прямо у видачі як розкривний блок.

Валідація: Google Rich Results Test та Schema Markup Validator. Часта помилка — вказати price без priceCurrency, або ratingValue без reviewCount. Google ігнорує неповну розмітку.

Як проводити технічний SEO-аудит

Сканованість. robots.txt блокує потрібні сторінки (або навпаки, не блокує службові). Canonical URLs налаштовані неправильно — дублюються сторінки з UTM-мітками. Sitemap містить сторінки з noindex. Все це Screaming Frog або Sitebulb покажуть за годину сканування.

Core Web Vitals в масштабі. Google Search Console → Core Web Vitals → дивимося не окремі сторінки, а групи URL (шаблон сторінки продукту, шаблон категорії, блог). Проблема зазвичай системна — одна помилка в шаблоні псує сотні сторінок.

JavaScript SEO. Google рендерить JavaScript, але з затримкою (іноді дні для повного рендеру). Для критичного контенту — SSR або SSG обов'язкові. Перевіряємо через Search Console → Inspect URL → View Crawled Page: що бачить Googlebot.

Internal linking. Орфанні сторінки (немає вхідних внутрішніх посилань) втрачають PageRank. Бите посилання (404) — сигнал якості.

Типові помилки при впровадженні Schema.org
  • Вказано price без priceCurrency — розмітка ігнорується.
  • ratingValue без reviewCount — у видачі не показується.
  • Кілька Product на одній сторінці без @type: ItemList — Google бере тільки перший.
  • JSON-LD в GTM — Google не завжди бачить динамічну розмітку, краще серверний рендеринг.
Етап роботи Що входить Термін
Аудит Сканування, аналіз Core Web Vitals, аудит Schema, звіт з пріоритетами 1–2 тижні
Оптимізація одного шаблону LCP, CLS, INP, впровадження SSR/SSG, налаштування preload 2–4 тижні
Повна технічна оптимізація Всі шаблони, code splitting, Web Workers, моніторинг в CI 4–10 тижнів
Впровадження Schema.org JSON-LD генерація, валідація, тестування rich snippets 1–3 тижні

Що входить в роботу

  • Документація: звіт зі знайденими проблемами, roadmap за пріоритетами, таймінги для кожного етапу.
  • Доступи: налаштування моніторингу (SpeedCurve, Sentry Search Console), передача dashboard.
  • Навчання: розбір типових помилок для вашої команди (1–2 дзвінки).
  • Підтримка: супровід протягом місяця після деплою — перевірка метрик, фікс регресій.

Зв'яжіться з нами — ми оцінимо ваш проект за 2 дні і покажемо, скільки позицій можна повернути за рахунок технічного SEO. Досвід роботи з проектами рівня сотень тисяч відвідувань на місяць — гарантуємо вимірний результат в Core Web Vitals до/після. Замовте аудит у цій формі — отримайте персональний чек-лист з 15 пунктів.