Оповещения о мониторинге
Apigee Edge позволяет пересылать оповещения в системные журналы или внешние системы/инструменты мониторинга, когда возникает ошибка или сбой из-за отказа события. Это могут быть системные оповещения или оповещения/события на уровне приложений. Оповещения на уровне приложений в основном являются специальными оповещениями, созданными на основе сгенерированных событий. Настраивает специальные условия обычно администратор сети. Чтобы узнать больше об оповещениях, обратитесь в службу поддержки Apigee.
Как задать пороговые значения для уведомлений
Установите пороговое значение, после которого должно создаваться оповещение. Значение зависит от конфигурации оборудования. Порог должен быть установлен с учетом вашей пропускной способности. Например, Apigee Edge может не подойти, если у вас всего 6 ГБ. Пороговое значение можно задать с помощью критерия "равно (=)" или "больше (>)". Вы также можете указать временной интервал между двумя последовательными оповещениями. Вы можете использовать вариант "Часы/минуты/секунды".
Критерии для настройки системных оповещений
В таблице ниже описаны критерии.
| Предупреждение об ошибке | Рекомендуемый порог | Описание |
|---|---|---|
|
Недостаточно памяти |
500 МБ |
Недостаточно памяти для запуска компонента |
|
Недостаточно места на диске (/var/log) |
8 ГБ |
На диске слишком мало места. |
|
Высокая нагрузка |
3+ |
Неожиданно увеличилось количество процессов, ожидающих выполнения |
|
Процесс остановлен |
Н/Д, логическое значение true или false |
Процесс Apigee Java в системе остановлен |
Проверка портов, используемых Apigee и сторонними сервисами
Отслеживайте следующие порты, чтобы убедиться, что они активны:
- Порты 4526, 4527 и 4528 на сервере управления, маршрутизаторе и процессоре сообщений
- Порты 1099, 1100 и 1101 на сервере управления, маршрутизаторе и процессоре сообщений
- Порты 8081 и 15999 на маршрутизаторах
- Порты 8082 и 8998 на процессорах сообщений
- Порт 8080 на сервере управления
Проверьте, активны ли следующие сторонние порты:
- Порт Qpid 5672
- Порт Postgres 5432
- Порты Cassandra: 7000, 7199, 9042, 9160
- Порт ZooKeeper 2181
- Порт OpenLDAP 10389
Чтобы определить, какой порт использует каждый компонент Apigee для прослушивания вызовов API, отправьте следующие вызовы API на сервер управления (обычно на порту 8080):
curl -v -u username:password http://host:port/v1/servers?pod=gateway®ion=dc-1curl -v -u username:password http://host:port/v1/servers?pod=central®ion=dc-1curl -v -u username:password http://host:port/v1/servers?pod=analytics®ion=dc-1
Выходные данные этих команд будут содержать разделы, похожие на приведенные ниже. В разделе http.management.port указан номер порта для определенного компонента.
{ "externalHostName" : "localhost", "externalIP" : "111.222.333.444", "internalHostName" : "localhost", "internalIP" : "111.222.333.444", "isUp" : true, "pod" : "gateway", "reachable" : true, "region" : "default", "tags" : { "property" : [ { "name" : "Profile", "value" : "Router" }, { "name" : "rpc.port", "value" : "4527" }, { "name" : "http.management.port", "value" : "8081" }, { "name" : "jmx.rmi.port", "value" : "1100" } ] }, "type" : [ "router" ], "uUID" : "2d4ec885-e20a-4173-ae87-10be38b35750" }
Просмотр журналов
В файлах журналов хранятся сообщения о событиях и операциях системы. Сообщения появляются в журнале, когда процессы запускаются и завершаются или когда возникает ошибка. Просматривая файлы журналов, вы можете получить информацию о системных компонентах, например ЦП, памяти, диске, нагрузке, процессах и т. д., до и после достижения состояния сбоя. Это также позволяет выявлять и диагностировать источники текущих проблем в системе или прогнозировать возможные проблемы.
Например, типичный системный журнал компонента содержит следующие записи:
TimeStamp = 25/01/13 19:25 ; NextDelay = 30 Memory HeapMemoryUsage = {used = 29086176}{max = 64880640} ; NonHeapMemoryUsage = {init = 24313856}{committed = 57278464} ; Threading PeakThreadCount = 53 ; ThreadCount = 53 ; OperatingSystem SystemLoadAverage = 0.25 ;
Вы можете изменить файл /opt/apigee/conf/logback.xml, чтобы управлять механизмом ведения журнала, не перезапуская сервер. Файл logback.xml содержит следующее свойство, которое задает частоту, с которой механизм ведения журнала проверяет файл logback.xml на наличие изменений конфигурации:
<configuration scan="true" scanPeriod="30 seconds" >
По умолчанию механизм регистрации проверяет наличие изменений каждую минуту. Если вы не укажете единицы времени в атрибуте scanPeriod, по умолчанию будут использоваться миллисекунды.
В таблице ниже указано, где хранятся файлы журналов компонентов Apigee Edge Private Cloud.
| Компоненты | Местоположение |
|---|---|
|
Сервер управления |
|
|
Маршрутизатор |
|
|
Message Processor |
|
|
Сервер Qpid |
|
|
Сервер Apigee Postgres |
|
|
Интерфейс Edge |
|
|
ZooKeeper |
|
|
OpenLDAP |
|
|
Cassandra |
|
|
Qpidd |
|
|
База данных PostgreSQL |
|
Как включить журналы отладки для процессора сообщений и интерфейса Edge
Чтобы включить журналы отладки для Message Processor:
- На узле Message Processor измените файл
/opt/apigee/customer/application/messsage-processor.properties. Если такого файла нет, создайте его. - Добавьте в файл следующее свойство:
conf_system_log.level=DEBUG
- Перезапустите Message Processor:
/opt/apigee/apigee-service/bin/apigee-service edge-message-processor restart
Чтобы включить журналы отладки для интерфейса Edge:
- В узле Edge UI измените
/opt/apigee/customer/application/ui.properties. Если такого файла нет, создайте его. - Добавьте в файл следующее свойство:
conf_application_logger.application=DEBUG
- Перезапустите интерфейс Edge:
/opt/apigee/apigee-service/bin/apigee-service edge-ui restart
Рекомендации по использованию apigee-monit
При использовании apigee-monit Apigee рекомендует:
- Остановите мониторинг компонента, прежде чем выполнять любые операции, которые запускают или останавливают его, например резервное копирование или обновление.
- Отслеживайте
apigee-monitс помощью такого инструмента, какcron. Подробнее о том, как отслеживать apigee-monit…
Инструменты мониторинга
Инструменты мониторинга, такие как Nagios, Collectd, Graphite, Splunk, Sumologic и Monit, помогут вам отслеживать всю корпоративную среду и бизнес-процессы.
| Компонент | Nagios | Collectd | Splunk | |
|---|---|---|---|---|
|
Системные проверки |
Загрузка ЦП |
|||
|
Свободная/используемая память |
||||
|
Использование дискового пространства |
||||
|
Статистика сети |
||||
|
Процессы |
|
|
||
|
Проверки API |
||||
|
JMX |
||||
|
Java |
||||
|
Файлы журналов |
||||
|
Критические события |
Превышено ограничение на частоту запросов |
|||
|
Не удается подключиться к внутреннему серверу (Hybris или SharePoint) |
||||
|
Не удается подключиться к FaaS (STS) |
||||
|
События с предупреждениями |
Не удается подключиться к SMTP-серверу |
|||
|
Нарушения SLA |
||||