Рекомендации по мониторингу

Оповещения о мониторинге

Apigee Edge позволяет пересылать оповещения в системные журналы или внешние системы/инструменты мониторинга, когда возникает ошибка или сбой из-за отказа события. Это могут быть системные оповещения или оповещения/события на уровне приложений. Оповещения на уровне приложений в основном являются специальными оповещениями, созданными на основе сгенерированных событий. Настраивает специальные условия обычно администратор сети. Чтобы узнать больше об оповещениях, обратитесь в службу поддержки Apigee.

Как задать пороговые значения для уведомлений

Установите пороговое значение, после которого должно создаваться оповещение. Значение зависит от конфигурации оборудования. Порог должен быть установлен с учетом вашей пропускной способности. Например, Apigee Edge может не подойти, если у вас всего 6 ГБ. Пороговое значение можно задать с помощью критерия "равно (=)" или "больше (>)". Вы также можете указать временной интервал между двумя последовательными оповещениями. Вы можете использовать вариант "Часы/минуты/секунды".

Критерии для настройки системных оповещений

В таблице ниже описаны критерии.

Предупреждение об ошибке Рекомендуемый порог Описание

Недостаточно памяти

500 МБ

Недостаточно памяти для запуска компонента

Недостаточно места на диске (/var/log)

8 ГБ

На диске слишком мало места.

Высокая нагрузка

3+

Неожиданно увеличилось количество процессов, ожидающих выполнения

Процесс остановлен

Н/Д, логическое значение true или false

Процесс Apigee Java в системе остановлен

Проверка портов, используемых Apigee и сторонними сервисами

Отслеживайте следующие порты, чтобы убедиться, что они активны:

  • Порты 4526, 4527 и 4528 на сервере управления, маршрутизаторе и процессоре сообщений
  • Порты 1099, 1100 и 1101 на сервере управления, маршрутизаторе и процессоре сообщений
  • Порты 8081 и 15999 на маршрутизаторах
  • Порты 8082 и 8998 на процессорах сообщений
  • Порт 8080 на сервере управления

Проверьте, активны ли следующие сторонние порты:

  • Порт Qpid 5672
  • Порт Postgres 5432
  • Порты Cassandra: 7000, 7199, 9042, 9160
  • Порт ZooKeeper 2181
  • Порт OpenLDAP 10389

Чтобы определить, какой порт использует каждый компонент Apigee для прослушивания вызовов API, отправьте следующие вызовы API на сервер управления (обычно на порту 8080):

curl -v -u username:password http://host:port/v1/servers?pod=gateway&region=dc-1
curl -v -u username:password http://host:port/v1/servers?pod=central&region=dc-1
curl -v -u username:password http://host:port/v1/servers?pod=analytics&region=dc-1

Выходные данные этих команд будут содержать разделы, похожие на приведенные ниже. В разделе http.management.port указан номер порта для определенного компонента.

{
  "externalHostName" : "localhost",
  "externalIP" : "111.222.333.444",
  "internalHostName" : "localhost",
  "internalIP" : "111.222.333.444",
  "isUp" : true,
  "pod" : "gateway",
  "reachable" : true,
  "region" : "default",
  "tags" : {
    "property" : [ {
      "name" : "Profile",
      "value" : "Router"
    }, {
      "name" : "rpc.port",
      "value" : "4527"
    }, {
      "name" : "http.management.port",
      "value" : "8081"
    }, {
      "name" : "jmx.rmi.port",
      "value" : "1100"
    } ]
  },
  "type" : [ "router" ],
  "uUID" : "2d4ec885-e20a-4173-ae87-10be38b35750"
}

Просмотр журналов

В файлах журналов хранятся сообщения о событиях и операциях системы. Сообщения появляются в журнале, когда процессы запускаются и завершаются или когда возникает ошибка. Просматривая файлы журналов, вы можете получить информацию о системных компонентах, например ЦП, памяти, диске, нагрузке, процессах и т. д., до и после достижения состояния сбоя. Это также позволяет выявлять и диагностировать источники текущих проблем в системе или прогнозировать возможные проблемы.

Например, типичный системный журнал компонента содержит следующие записи:

TimeStamp = 25/01/13 19:25 ; NextDelay = 30
Memory
HeapMemoryUsage = {used = 29086176}{max = 64880640} ;
NonHeapMemoryUsage = {init = 24313856}{committed = 57278464} ;
Threading
PeakThreadCount = 53 ; ThreadCount = 53 ;
OperatingSystem
SystemLoadAverage = 0.25 ;

Вы можете изменить файл /opt/apigee/conf/logback.xml, чтобы управлять механизмом ведения журнала, не перезапуская сервер. Файл logback.xml содержит следующее свойство, которое задает частоту, с которой механизм ведения журнала проверяет файл logback.xml на наличие изменений конфигурации:

<configuration scan="true" scanPeriod="30 seconds" >

По умолчанию механизм регистрации проверяет наличие изменений каждую минуту. Если вы не укажете единицы времени в атрибуте scanPeriod, по умолчанию будут использоваться миллисекунды.

В таблице ниже указано, где хранятся файлы журналов компонентов Apigee Edge Private Cloud.

Компоненты Местоположение

Сервер управления

opt/apigee/var/log/edge-management-server

Маршрутизатор

opt/apigee/var/log/edge-router

Message Processor

opt/apigee/var/log/edge-message-processor

Сервер Qpid

opt/apigee/var/log/edge-qpid-server

Сервер Apigee Postgres

opt/apigee/var/log/edge-postgres-server

Интерфейс Edge

opt/apigee/var/log/edge-ui

ZooKeeper

opt/apigee/var/log/apigee-zookeeper

OpenLDAP

opt/apigee/var/log/apigee-openldap

Cassandra

opt/apigee/var/log/apigee-cassandra

Qpidd

opt/apigee/var/log/apigee-qpidd

База данных PostgreSQL

opt/apigee/var/log/apigee-postgresql

Как включить журналы отладки для процессора сообщений и интерфейса Edge

Чтобы включить журналы отладки для Message Processor:

  1. На узле Message Processor измените файл /opt/apigee/customer/application/messsage-processor.properties. Если такого файла нет, создайте его.
  2. Добавьте в файл следующее свойство:
    conf_system_log.level=DEBUG
  3. Перезапустите Message Processor:
    /opt/apigee/apigee-service/bin/apigee-service edge-message-processor restart

Чтобы включить журналы отладки для интерфейса Edge:

  1. В узле Edge UI измените /opt/apigee/customer/application/ui.properties. Если такого файла нет, создайте его.
  2. Добавьте в файл следующее свойство:
    conf_application_logger.application=DEBUG
  3. Перезапустите интерфейс Edge:
    /opt/apigee/apigee-service/bin/apigee-service edge-ui restart

Рекомендации по использованию apigee-monit

При использовании apigee-monit Apigee рекомендует:

Инструменты мониторинга

Инструменты мониторинга, такие как Nagios, Collectd, Graphite, Splunk, Sumologic и Monit, помогут вам отслеживать всю корпоративную среду и бизнес-процессы.

Компонент Nagios Collectd Splunk

Системные проверки

Загрузка ЦП

Свободная/используемая память

Использование дискового пространства

Статистика сети

Процессы

Проверки API

JMX

Java

Файлы журналов

Критические события

Превышено ограничение на частоту запросов

Не удается подключиться к внутреннему серверу (Hybris или SharePoint)

Не удается подключиться к FaaS (STS)

События с предупреждениями

Не удается подключиться к SMTP-серверу

Нарушения SLA