روال‌های مطلوب پایشگری

هشدارهای پایش

وقتی خطا یا خرابی به‌دلیل خرابی رویداد رخ می‌دهد، Apigee Edge به شما امکان می‌دهد هشدارها را به گزارش‌های سیستم یا سیستم‌ها/ابزارهای نظارت خارجی بازارسال کنید. این هشدارها می‌توانند هشدارهای سطح سیستم یا رویداد/هشدارهای سطح برنامه باشند. هشدارهای سطح برنامه بیشتر هشدارهای سفارشی هستند که براساس رویدادهای تولیدشده ایجاد می‌شوند. سرپرست شبکه معمولاً شرایط سفارشی را پیکربندی می‌کند. برای کسب اطلاعات بیشتر درباره هشدارها، با «پشتیبانی Apigee» تماس بگیرید.

تنظیم آستانه‌های هشدار

آستانه‌ای را تنظیم کنید که پس‌از آن باید هشدار تولید شود. آنچه تنظیم می‌کنید به پیکربندی سخت‌افزارتان بستگی دارد. آستانه باید نسبت به ظرفیت شما تنظیم شود. برای مثال، اگر فقط ۶ گیگابایت ظرفیت داشته باشید، ممکن است Apigee Edge خیلی پایین باشد. می‌توانید آستانه را با معیار مساوی با (=) یا بزرگ‌تر از (>) اختصاص دهید. همچنین می‌توانید فاصله زمانی بین دو هشدار متوالی را مشخص کنید. می‌توانید از گزینه ساعت/دقیقه/ثانیه استفاده کنید.

معیارهای تنظیم هشدارهای سطح سیستم

جدول زیر معیارها را شرح می‌دهد:

هشدار آستانه پیشنهادی شرح

حافظه کم

‫۵۰۰ مگابایت

حافظه برای شروع یک عنصر کافی نیست

فضای دیسک کم است (/var/log)

‫۸ گیگابایت

فضای دیسک خیلی کم شده است.

بار زیاد

بیش‌از ۳ بار

تعداد فرایندهایی که درانتظار اجرا هستند به‌طور غیرمنتظره‌ای افزایش یافته است

پردازش متوقف شد

N/A، مقدار بولی درست یا نادرست

فرایند Apigee Java در سیستم متوقف شده است

درحال بررسی درگاه‌های ویژه Apigee و طرف سوم

درگاه‌های زیر را پایش کنید تا مطمئن شوید فعال هستند

  • درگاه‌های ۴۵۲۶، ۴۵۲۷، و ۴۵۲۸ در «سرور مدیریت»، «مسیریاب»، و «پردازشگر پیام»
  • درگاه ۱۰۹۹، ۱۱۰۰، و ۱۱۰۱ در «سرور مدیریت»، «رهیاب»، و «پردازشگر پیام»
  • درگاه ۸۰۸۱ و ۱۵۹۹۹ در «رهیاب‌ها»
  • درگاه ۸۰۸۲ و ۸۹۹۸ در «پردازنده‌های پیام»
  • درگاه ۸۰۸۰ در «سرور مدیریت»

درگاه‌های طرف سوم زیر را بررسی کنید تا مطمئن شوید فعال باشند:

  • درگاه Qpid 5672
  • درگاه Postgres 5432
  • درگاه Cassandra 7000،‏ 7199،‏ 9042،‏ 9160
  • درگاه ZooKeeper 2181
  • درگاه OpenLDAP 10389

برای تعیین اینکه هریک از عناصر Apigee در کدام درگاه به فراخوانی‌های API گوش می‌دهد، فراخوانی‌های API زیر را به «سرور مدیریت» (که معمولاً در درگاه ۸۰۸۰ است) صادر کنید:

curl -v -u username:password http://host:port/v1/servers?pod=gateway&region=dc-1
curl -v -u username:password http://host:port/v1/servers?pod=central&region=dc-1
curl -v -u username:password http://host:port/v1/servers?pod=analytics&region=dc-1

برونداد این فرمان‌ها شامل بخش‌هایی مشابه آنچه در زیر نشان داده شده است خواهد بود. بخش http.management.port شماره درگاه را برای عنصر مشخص‌شده ارائه می‌دهد.

{
  "externalHostName" : "localhost",
  "externalIP" : "111.222.333.444",
  "internalHostName" : "localhost",
  "internalIP" : "111.222.333.444",
  "isUp" : true,
  "pod" : "gateway",
  "reachable" : true,
  "region" : "default",
  "tags" : {
    "property" : [ {
      "name" : "Profile",
      "value" : "Router"
    }, {
      "name" : "rpc.port",
      "value" : "4527"
    }, {
      "name" : "http.management.port",
      "value" : "8081"
    }, {
      "name" : "jmx.rmi.port",
      "value" : "1100"
    } ]
  },
  "type" : [ "router" ],
  "uUID" : "2d4ec885-e20a-4173-ae87-10be38b35750"
}

مشاهده گزارش‌ها

فایل‌های گزارش پیام‌های مربوط به رویداد/عملکرد سیستم را پیگیری می‌کنند. وقتی فرایندها شروع و تکمیل می‌شوند یا وقتی شرایط خطا رخ می‌دهد، پیام‌هایی در گزارش ظاهر می‌شود. با مشاهده فایل‌های گزارش، می‌توانید اطلاعاتی درباره اجزای سیستم، برای مثال، واحد پردازش مرکزی، حافظه، دیسک، بار، فرایندها، و غیره، قبل و بعداز رسیدن به وضعیت ناموفق به‌دست آورید. این کار همچنین به شما امکان می‌دهد منبع مشکلات فعلی سیستم را شناسایی و تشخیص دهید یا به شما کمک می‌کند مشکلات احتمالی سیستم را پیش‌بینی کنید.

برای مثال، گزارش سیستم معمولی یک مؤلفه حاوی ورودی‌های زیر است که در زیر نشان داده شده است:

TimeStamp = 25/01/13 19:25 ; NextDelay = 30
Memory
HeapMemoryUsage = {used = 29086176}{max = 64880640} ;
NonHeapMemoryUsage = {init = 24313856}{committed = 57278464} ;
Threading
PeakThreadCount = 53 ; ThreadCount = 53 ;
OperatingSystem
SystemLoadAverage = 0.25 ;

می‌توانید فایل /opt/apigee/conf/logback.xml را ویرایش کنید تا سازوکار گزارش‌گیری را بدون نیاز به راه‌اندازی مجدد سرور کنترل کنید. فایل logback.xml حاوی ویژگی زیر است که تعداد دفعاتی را که سازوکار گزارش‌گیری فایل logback.xml را برای تغییرات پیکربندی بررسی می‌کند تنظیم می‌کند:

<configuration scan="true" scanPeriod="30 seconds" >

به‌طور پیش‌فرض، سازوکار گزارش‌گیری هر دقیقه تغییرات را بررسی می‌کند. اگر واحدهای زمان را به مشخصه scanPeriod اضافه نکنید، به‌طور پیش‌فرض روی میلی‌ثانیه تنظیم می‌شود.

جدول زیر مکان فایل‌های گزارش مؤلفه‌های Apigee Edge Private Cloud را نشان می‌دهد.

اجزا مکان

سرور مدیریت

opt/apigee/var/log/edge-management-server

رهیاب

opt/apigee/var/log/edge-router

پردازشگر پیام

opt/apigee/var/log/edge-message-processor

سرور Qpid

opt/apigee/var/log/edge-qpid-server

سرور Apigee Postgres

opt/apigee/var/log/edge-postgres-server

میانای کاربر Edge

opt/apigee/var/log/edge-ui

ZooKeeper

opt/apigee/var/log/apigee-zookeeper

OpenLDAP

opt/apigee/var/log/apigee-openldap

Cassandra

opt/apigee/var/log/apigee-cassandra

Qpidd

opt/apigee/var/log/apigee-qpidd

پایگاه داده PostgreSQL

opt/apigee/var/log/apigee-postgresql

فعال کردن گزارش‌های اشکال‌زدایی برای «پردازنده پیام» و «واسط کاربر Edge»

برای فعال کردن گزارش‌های اشکال‌زدایی برای «پردازشگر پیام»:

  1. در گره «پردازشگر پیام»، /opt/apigee/customer/application/messsage-processor.properties را ویرایش کنید. اگر آن فایل وجود ندارد، آن را ایجاد کنید.
  2. دارایی زیر را به فایل اضافه کنید:
    conf_system_log.level=DEBUG
  3. بازراه‌اندازی «پردازشگر پیام»:
    /opt/apigee/apigee-service/bin/apigee-service edge-message-processor restart

برای فعال کردن گزارش‌های اشکال‌زدایی برای «میانای کاربر Edge»:

  1. در گره «میانای کاربر Edge»، /opt/apigee/customer/application/ui.properties را ویرایش کنید. اگر آن فایل وجود ندارد، آن را ایجاد کنید.
  2. دارایی زیر را به فایل اضافه کنید:
    conf_application_logger.application=DEBUG
  3. بازراه‌اندازی واسط کاربر Edge:
    /opt/apigee/apigee-service/bin/apigee-service edge-ui restart

روال‌های مطلوب apigee-monit

هنگام استفاده از apigee-monit، Apigee توصیه می‌کند که:

  • قبل‌از انجام هرگونه عملیاتی که باعث شروع یا توقف یک جزء می‌شود، مانند پشتیبان‌گیری یا ارتقا، نظارت بر آن جزء را متوقف کنید.
  • بااستفاده از ابزاری مثل cron، apigee-monit را پایش کنید. برای اطلاعات بیشتر، مانیتور apigee-monit را ببینید.

ابزارهای پایش

ابزارهای پایش مانند Nagios،‏ Collectd،‏ Graphite،‏ Splunk،‏ Sumologic، و Monit می‌توانند به شما کمک کنند کل محیط سازمانی و فرایندهای کسب‌وکارتان را پایش کنید.

مؤلفه Nagios Collectd Splunk

بررسی‌های سطح سیستم

بهره‌وری واحد پردازش مرکزی

حافظه آزاد/استفاده‌شده

استفاده از فضای دیسک

آمار شبکه

فرایندها

بررسی‌های میانای برنامه‌سازی کاربردی

JMX

جاوا

فایل‌های گزارش

رویدادهای بحرانی

به محدودیت نرخ رسیدید

دسترسی به سرور زیرینه (Hybris یا SharePoint) امکان‌پذیر نیست

دسترسی به FaaS (STS) امکان‌پذیر نیست

رویدادهای هشدار

دسترسی به سرور SMTP امکان‌پذیر نیست

قراردادهای سطح سرویس نقض شد