Налаштування моніторингу та алертів Elasticsearch (Kibana)

Наша компанія займається розробкою, підтримкою та обслуговуванням сайтів будь-якої складності. Від простих односторінкових сайтів до масштабних кластерних систем, побудованих на мікро сервісах. Досвід розробників підтверджено сертифікатами від вендорів.

Розробка та обслуговування будь-яких видів сайтів:

Інформаційні сайти або веб-програми
Сайти візитки, landing page, корпоративні сайти, онлайн каталоги, квіз, промо-сайти, блоги, ресурси новин, інформаційні портали, форуми, агрегатори
Сайти або веб-програми електронної комерції
Інтернет-магазини, B2B-портали, маркетплейси, онлайн-обмінники, кешбек-сайти, біржі, дропшиппінг-платформи, парсери товарів
Веб-програми для управління бізнес-процесами
CRM-системи, ERP-системи, корпоративні портали, системи управління виробництвом, парсери інформації
Сайти або веб-програми електронних послуг
Дошки оголошень, онлайн-школи, онлайн-кінотеатри, конструктори сайтів, портали надання електронних послуг, відеохостинги, тематичні портали

Це лише деякі з технічних типів сайтів, з якими ми працюємо, і кожен із них може мати свої специфічні особливості та функціональність, а також бути адаптованим під конкретні потреби та цілі клієнта.

Послуги, які ми пропонуємо
Показано 1 з 1Усі 2062 послуг
Налаштування моніторингу та алертів Elasticsearch (Kibana)
Середній
~2-3 дні
Часті запитання

Наші компетенції:

Етапи розробки

Останні роботи

  • image_website-b2b-advance_0.webp
    Розробка сайту компанії B2B ADVANCE
    1360
  • image_web-applications_feedme_466_0.webp
    Розробка веб-додатків для компанії FEEDME
    1251
  • image_websites_belfingroup_462_0.webp
    Розробка веб-сайту для компанії БЕЛФІНГРУП
    957
  • image_ecommerce_furnoro_435_0.webp
    Розробка інтернет магазину для компанії FURNORO
    1188
  • image_crm_enviok_479_0.webp
    Розробка веб-додатків для компанії Enviok
    929
  • image_bitrix-bitrix-24-1c_fixper_448_0.webp
    Розробка веб-сайту для компанії ФІКСПЕР
    948

Налаштування моніторингу та алертів Elasticsearch (Kibana)

Ми часто стикаємося з ситуацією: Elasticsearch-кластер мовчки переходить у red, диск заповнюється до 95%, а команда дізнається про це від користувачів. Без алертів інцидент перетворюється на аварію. Наш досвід показує, що налаштування моніторингу — ключовий етап, який запобігає простоям і втраті даних. У цій статті розберемо, як через Kibana налаштувати повноцінний моніторинг та алерти, використовуючи Metricbeat, Watcher та Prometheus. Нижче — перевірені конфіги та поради для продакшену.

Чому моніторинг Elasticsearch критично важливий?

Elasticsearch — основа пошуку та аналітики в багатьох проектах. Якщо кластер падає, бізнес-процеси зупиняються. Моніторинг дозволяє помітити degradation заздалегідь: зростання JVM heap, заповнення диска, зростання latency пошуку. Без нього ви дізнаєтеся про проблему від користувачів. Ми пропонуємо готову схему моніторингу з алертами в Telegram/Slack, щоб ви завжди були в курсі стану кластера.

Який інструмент моніторингу обрати?

Інструмент Джерело метрик Складність Алерти Візуалізація
Stack Monitoring (Kibana) Metricbeat або вбудований колектор Низька Watcher Дашборди в Kibana
Metricbeat + Watcher Elasticsearch, системні метрики Середня Watcher (JSON/UI) Дашборди Kibana
Prometheus + Grafana elasticsearch_exporter Висока Alertmanager, Grafana Grafana дашборди
Elastic Cloud Вбудований Низька Вбудовані Kibana

Для продакшену рекомендуємо комбінацію Metricbeat + Stack Monitoring для базових метрик і Watcher для алертів. Якщо у вас уже є Prometheus, інтегруйте elasticsearch_exporter.

Як працює Stack Monitoring у Kibana?

Kibana Stack Monitoring — вбудований інструмент для збору метрик Elasticsearch, Logstash та Kibana. Дані можна збирати через Metricbeat (рекомендується) або вбудованим агентом (застарів). Краще надсилати метрики в окремий моніторинговий кластер — інакше при збої основного кластера втрачаєте й моніторинг. Ми використовуємо Metricbeat із X-Pack увімкненим.

Налаштування Metricbeat для збору метрик ES:

# metricbeat.yml
metricbeat.modules:
  - module: elasticsearch
    xpack.enabled: true
    period: 10s
    hosts: ["https://localhost:9200"]
    username: "remote_monitoring_user"
    password: "${ES_MONITOR_PASSWORD}"
    ssl.certificate_authorities: ["/etc/elasticsearch/certs/ca.crt"]
    scope: cluster
    metricsets:
      - ccr
      - cluster_stats
      - enrich
      - index
      - index_recovery
      - index_summary
      - ml_job
      - node
      - node_stats
      - pending_tasks
      - shard

output.elasticsearch:
  hosts: ["https://monitoring-es:9200"]
  username: "metricbeat_writer"
  password: "${MONITOR_WRITER_PASSWORD}"

Ключові метрики: на що дивитися

Метрика Норма Попередження Критично
Cluster health green yellow red
JVM heap used <75% 75-85% >85% (небезпечно), >95% (GC storm)
Disk usage <85% 85-90% >90% (перебалансування), >95% (read-only)
Search latency (p95) <50ms 50-200ms >200ms
Indexing rate стабільний падіння >20% різке падіння

Cluster health — перше, на що дивитися: green — усі шарди призначено, yellow — replica не призначено (нормально для одного вузла, проблема для продакшену), red — дані недоступні.

JVM heap usage — критичний показник: менше 75% нормально, 75–85% моніторити, >85% деградація, >95% JVM завмирає на GC і кластер перестає відповідати.

Disk usage per node — ES блокує індексацію при заповненні диска. Поріг flood_stage (95%) — індекс переходить у read-only; high_watermark (90%) — перебалансування шардів; low_watermark (85%) — норма.

Налаштування алертів через Watcher

Watcher — вбудована система сповіщень X-Pack. Налаштовується через API або Kibana UI. Наведемо приклад алерту на red статус кластера:

PUT _watcher/watch/cluster_status_red
{
  "trigger": {
    "schedule": {
      "interval": "1m"
    }
  },
  "input": {
    "http": {
      "request": {
        "host": "localhost",
        "port": 9200,
        "path": "/_cluster/health",
        "auth": {
          "basic": {
            "username": "elastic",
            "password": "{{ctx.metadata.es_password}}"
          }
        }
      }
    }
  },
  "condition": {
    "compare": {
      "ctx.payload.status": {
        "eq": "red"
      }
    }
  },
  "actions": {
    "send_telegram": {
      "webhook": {
        "scheme": "https",
        "host": "api.telegram.org",
        "port": 443,
        "method": "post",
        "path": "/bot{{ctx.metadata.telegram_token}}/sendMessage",
        "params": {
          "chat_id": "{{ctx.metadata.telegram_chat_id}}",
          "text": "ALERT: Elasticsearch cluster status is RED! Time: {{ctx.execution_time}}"
        }
      }
    }
  }
}

Алерт на заповнення диска >85%:

PUT _watcher/watch/disk_usage_high
{
  "trigger": {
    "schedule": { "interval": "5m" }
  },
  "input": {
    "http": {
      "request": {
        "path": "/_nodes/stats/fs",
        "auth": { "basic": { "username": "elastic", "password": "changeme" } }
      }
    }
  },
  "condition": {
    "script": {
      "source": """
        for (node in ctx.payload.nodes.values()) {
          def total = node.fs.total.total_in_bytes;
          def free = node.fs.total.free_in_bytes;
          def used_pct = (total - free) / total * 100;
          if (used_pct > 85) return true;
        }
        return false;
      """
    }
  },
  "actions": {
    "log": {
      "logging": {
        "level": "warn",
        "text": "High disk usage detected on Elasticsearch node"
      }
    }
  }
}

Як налаштувати алерти через Kibana UI?

У Kibana 8.x є розділ Alerts & Actions (Stack Management > Rules). Візуальний конструктор правил без написання JSON вручну. Готові шаблони: Elasticsearch cluster health, nodes changed, version mismatch, CPU usage, JVM memory. Канали сповіщень: Email, Slack, PagerDuty, Webhook (Telegram, Teams).

Моніторинг через Prometheus та Grafana

Якщо інфраструктура вже використовує Prometheus, підключіть elasticsearch_exporter:

docker run -d \
  --name elasticsearch_exporter \
  -p 9114:9114 \
  prometheuscommunity/elasticsearch-exporter:latest \
  --es.uri=https://elastic:changeme@localhost:9200 \
  --es.ssl-skip-verify \
  --es.all \
  --es.indices \
  --es.shards

Prometheus scrape_config:

- job_name: 'elasticsearch'
  static_configs:
    - targets: ['localhost:9114']
  scrape_interval: 30s

Імпорт Grafana дашборда ID 6483 (Elasticsearch Overview) — готовий дашборд з основними метриками. Як зазначено в документації Elasticsearch, це спрощує візуалізацію.

Що входить у нашу роботу

Ми надаємо: розгортання Metricbeat та налаштування дашбордів Stack Monitoring; налаштування алертів через Watcher або Kibana Rules з каналами Telegram/Slack/PagerDuty; інтеграція з Prometheus та Grafana (за наявності інфраструктури); документація та інструкція для вашої команди; 3 місяці підтримки та доналаштування порогів. Наш досвід — 5 років в адмініструванні Elasticsearch, понад 20 проектів. Гарантуємо SLA на час реакції. Наші інженери мають сертифікати Elastic Certified Engineer.

Терміни

Базовий моніторинг через Metricbeat та Stack Monitoring — 1 день. Алерти — 1 день. Просунутий моніторинг з Prometheus+Grafana — 1-2 дні. Разом від 2 до 4 днів. Вартість розраховується індивідуально.

Замовте консультацію — ми оцінимо ваш кластер і запропонуємо оптимальне рішення. Зв'яжіться з нами, щоб обговорити деталі.

Послуги бекенд-розробки: production-grade надійність

На production-сервері о 3:14 ночі черга Laravel Jobs перестала оброблятися — 40 000 необроблених завдань у Redis. Причина: worker упав через memory leak у статичній змінній Eloquent observer, supervisor не перезапустив через misconfigured stopwaitsecs. Ми розбирали такий інцидент на проекті з 500 RPS: діагностика 4 години, фікс — 20 хвилин. Щоб ви не втрачали гроші, пропонуємо послуги бекенд-розробки з акцентом на production-grade надійність — 10+ років досвіду, 50+ проектів, 5 років на ринку. Оцінимо ваш проект за 2 дні.

Які проблеми вирішуємо

N+1 запити: головний вбивця швидкості

N+1 — найпоширеніша причина повільних сторінок у Laravel-додатках. Стандартна історія: сторінка працювала нормально на dev з 10 записами, на production з 10 000 — 8-секундне завантаження.

Laravel Debugbar у dev-оточенні показує кількість запитів. Більше 20 — сигнал для audit.

Model::preventLazyLoading(! app()->isProduction());

Telescope для профілювання: логує всі запити, jobs, mail, notifications з деталізацією. Після впровадження eager loading час завантаження сторінки падає з 8 с до 0.3 с — у 27 разів.

Memory leak у статичних змінних

У Laravel Octane або Swoole додаток тримається в пам’яті між запитами. Статичні змінні не скидаються — призводять до неконтрольованого росту пам’яті. Використовуємо defer-функції та контейнерні біндинги для коректного скидання стану.

Неправильний connection pool

Rails, Laravel, Django відкривають нове з'єднання PostgreSQL на кожен PHP/Python процес. 100 воркерів — 100 з'єднань. PostgreSQL деградує від 200+ активних з'єднань через overhead на управління.

PgBouncer у transaction pooling: 1000 воркерів → 20–50 реальних з'єднань. Це знижує latency на 40% та зменшує витрати на хостинг на 30% — при середній вартості хостингу $2,000/міс економить $600/міс. GIN-індекс для JSONB до 100 разів швидший за B-tree при пошуку.

Як Octane справляється з високим навантаженням?

Laravel Octane (RoadRunner або Swoole) прибирає overhead bootstrap на кожен HTTP-запит. Приріст: 3–8x на синтетичних бенчмарках, 2–4x на реальних додатках. Важливо: не зберігати стан у статичних змінних — застосовуємо це на проектах >1000 RPS.

Як PostgreSQL допомагає уникнути повільних запитів?

Використовуємо composite indexes для WHERE + ORDER BY, partial indexes для фільтрів з високою селективністю, GIN-індекси для JSONB та full-text search. to_tsvector + GIN замість LIKE '%query%' — запобігає seq scan навіть на мільйонах записів. Аналізуємо плани через EXPLAIN ANALYZE та pg_stat_statements.

Як обрати стек для вашого проекту?

Стек Коли використовувати
Laravel + Octane CRUD, бізнес-логіка, REST/GraphQL API, адмінки
Node.js (Fastify) Realtime WebSocket, streaming, serverless, висока I/O concurrency
Go Високонавантажені мікросервіси (>10k RPS), gRPC, DevOps-інструменти
Django + DRF ML-пайплайни, інтеграція з AI, складна обробка даних
Ruby on Rails Швидкий MVP з багатим екосистемою гемів

Node.js виправданий для realtime: Laravel публікує події в Redis Pub/Sub, Node.js підписується та транслює клієнтам. Go — для goroutines (10k з'єднань на сервер — норма), але розробка повільніша, ніж Laravel.

Чому Redis критичний для продуктивності?

Redis виконує кілька ролей:

Роль Деталі
Кеш Кешування результатів важких запитів, фрагментів HTML
Черги Backend для Laravel Queue / Celery
Session store Distributed sessions в multi-instance оточенні
Pub/Sub Realtime події між сервісами
Rate limiting Sliding window counters для API throttling
Leaderboards Sorted Sets для рейтингів

Redis Cluster для горизонтального масштабування, Sentinel для автоматичного failover. Замовте консультацію щодо оптимізації Redis для вашого проекту.

Що входить в роботу під ключ

  • Архітектурне проектування (документація API, схема БД, діаграма сервісів)
  • Реалізація за узгодженим ТЗ з code review
  • Налаштування CI/CD (GitHub Actions, Docker), моніторингу (Sentry, Grafana), алертингу
  • Навантажувальне тестування (k6, wrk) зі звітом
  • Передача вихідних кодів, доступів, інструкція з деплою
  • Навчання команди замовника (2–3 сесії)
  • Гарантійна підтримка 1 місяць після здачі

Орієнтири по термінах

Задача Термін
REST API для мобільного/SPA (середня складність) 6–12 тижнів
Backend зі складною бізнес-логікою + інтеграції 12–20 тижнів
Високонавантажений сервіс на Go 8–16 тижнів
Міграція legacy PHP на Laravel 16–32 тижні

Вартість розраховується індивідуально після аналізу вимог до навантаження, інтеграцій та бізнес-логіки. Зв'яжіться з нами для безкоштовного аудиту вашого поточного backend — отримайте план оптимізації за 2 дні. Замовте консультацію та дізнайтеся, як знизити витрати на інфраструктуру на 30% без втрати продуктивності.