هشدارهای پایش
وقتی خطا یا خرابی بهدلیل خرابی رویداد رخ میدهد، Apigee Edge به شما امکان میدهد هشدارها را به گزارشهای سیستم یا سیستمها/ابزارهای نظارت خارجی بازارسال کنید. این هشدارها میتوانند هشدارهای سطح سیستم یا رویداد/هشدارهای سطح برنامه باشند. هشدارهای سطح برنامه بیشتر هشدارهای سفارشی هستند که براساس رویدادهای تولیدشده ایجاد میشوند. سرپرست شبکه معمولاً شرایط سفارشی را پیکربندی میکند. برای کسب اطلاعات بیشتر درباره هشدارها، با «پشتیبانی Apigee» تماس بگیرید.
تنظیم آستانههای هشدار
آستانهای را تنظیم کنید که پساز آن باید هشدار تولید شود. آنچه تنظیم میکنید به پیکربندی سختافزارتان بستگی دارد. آستانه باید نسبت به ظرفیت شما تنظیم شود. برای مثال، اگر فقط ۶ گیگابایت ظرفیت داشته باشید، ممکن است Apigee Edge خیلی پایین باشد. میتوانید آستانه را با معیار مساوی با (=) یا بزرگتر از (>) اختصاص دهید. همچنین میتوانید فاصله زمانی بین دو هشدار متوالی را مشخص کنید. میتوانید از گزینه ساعت/دقیقه/ثانیه استفاده کنید.
معیارهای تنظیم هشدارهای سطح سیستم
جدول زیر معیارها را شرح میدهد:
| هشدار | آستانه پیشنهادی | شرح |
|---|---|---|
|
حافظه کم |
۵۰۰ مگابایت |
حافظه برای شروع یک عنصر کافی نیست |
|
فضای دیسک کم است (/var/log) |
۸ گیگابایت |
فضای دیسک خیلی کم شده است. |
|
بار زیاد |
بیشاز ۳ بار |
تعداد فرایندهایی که درانتظار اجرا هستند بهطور غیرمنتظرهای افزایش یافته است |
|
پردازش متوقف شد |
N/A، مقدار بولی درست یا نادرست |
فرایند Apigee Java در سیستم متوقف شده است |
درحال بررسی درگاههای ویژه Apigee و طرف سوم
درگاههای زیر را پایش کنید تا مطمئن شوید فعال هستند
- درگاههای ۴۵۲۶، ۴۵۲۷، و ۴۵۲۸ در «سرور مدیریت»، «مسیریاب»، و «پردازشگر پیام»
- درگاه ۱۰۹۹، ۱۱۰۰، و ۱۱۰۱ در «سرور مدیریت»، «رهیاب»، و «پردازشگر پیام»
- درگاه ۸۰۸۱ و ۱۵۹۹۹ در «رهیابها»
- درگاه ۸۰۸۲ و ۸۹۹۸ در «پردازندههای پیام»
- درگاه ۸۰۸۰ در «سرور مدیریت»
درگاههای طرف سوم زیر را بررسی کنید تا مطمئن شوید فعال باشند:
- درگاه Qpid 5672
- درگاه Postgres 5432
- درگاه Cassandra 7000، 7199، 9042، 9160
- درگاه ZooKeeper 2181
- درگاه OpenLDAP 10389
برای تعیین اینکه هریک از عناصر Apigee در کدام درگاه به فراخوانیهای API گوش میدهد، فراخوانیهای API زیر را به «سرور مدیریت» (که معمولاً در درگاه ۸۰۸۰ است) صادر کنید:
curl -v -u username:password http://host:port/v1/servers?pod=gateway®ion=dc-1curl -v -u username:password http://host:port/v1/servers?pod=central®ion=dc-1curl -v -u username:password http://host:port/v1/servers?pod=analytics®ion=dc-1
برونداد این فرمانها شامل بخشهایی مشابه آنچه در زیر نشان داده شده است خواهد بود. بخش http.management.port شماره درگاه را برای عنصر مشخصشده ارائه میدهد.
{ "externalHostName" : "localhost", "externalIP" : "111.222.333.444", "internalHostName" : "localhost", "internalIP" : "111.222.333.444", "isUp" : true, "pod" : "gateway", "reachable" : true, "region" : "default", "tags" : { "property" : [ { "name" : "Profile", "value" : "Router" }, { "name" : "rpc.port", "value" : "4527" }, { "name" : "http.management.port", "value" : "8081" }, { "name" : "jmx.rmi.port", "value" : "1100" } ] }, "type" : [ "router" ], "uUID" : "2d4ec885-e20a-4173-ae87-10be38b35750" }
مشاهده گزارشها
فایلهای گزارش پیامهای مربوط به رویداد/عملکرد سیستم را پیگیری میکنند. وقتی فرایندها شروع و تکمیل میشوند یا وقتی شرایط خطا رخ میدهد، پیامهایی در گزارش ظاهر میشود. با مشاهده فایلهای گزارش، میتوانید اطلاعاتی درباره اجزای سیستم، برای مثال، واحد پردازش مرکزی، حافظه، دیسک، بار، فرایندها، و غیره، قبل و بعداز رسیدن به وضعیت ناموفق بهدست آورید. این کار همچنین به شما امکان میدهد منبع مشکلات فعلی سیستم را شناسایی و تشخیص دهید یا به شما کمک میکند مشکلات احتمالی سیستم را پیشبینی کنید.
برای مثال، گزارش سیستم معمولی یک مؤلفه حاوی ورودیهای زیر است که در زیر نشان داده شده است:
TimeStamp = 25/01/13 19:25 ; NextDelay = 30 Memory HeapMemoryUsage = {used = 29086176}{max = 64880640} ; NonHeapMemoryUsage = {init = 24313856}{committed = 57278464} ; Threading PeakThreadCount = 53 ; ThreadCount = 53 ; OperatingSystem SystemLoadAverage = 0.25 ;
میتوانید فایل /opt/apigee/conf/logback.xml را ویرایش کنید تا سازوکار گزارشگیری را بدون نیاز به
راهاندازی مجدد سرور کنترل کنید. فایل logback.xml حاوی ویژگی زیر است که
تعداد دفعاتی را که سازوکار گزارشگیری فایل logback.xml را برای تغییرات پیکربندی بررسی میکند تنظیم میکند:
<configuration scan="true" scanPeriod="30 seconds" >
بهطور پیشفرض، سازوکار گزارشگیری هر دقیقه تغییرات را بررسی میکند. اگر واحدهای زمان را
به مشخصه scanPeriod اضافه نکنید، بهطور پیشفرض روی میلیثانیه تنظیم میشود.
جدول زیر مکان فایلهای گزارش مؤلفههای Apigee Edge Private Cloud را نشان میدهد.
| اجزا | مکان |
|---|---|
|
سرور مدیریت |
|
|
رهیاب |
|
|
پردازشگر پیام |
|
|
سرور Qpid |
|
|
سرور Apigee Postgres |
|
|
میانای کاربر Edge |
|
|
ZooKeeper |
|
|
OpenLDAP |
|
|
Cassandra |
|
|
Qpidd |
|
|
پایگاه داده PostgreSQL |
|
فعال کردن گزارشهای اشکالزدایی برای «پردازنده پیام» و «واسط کاربر Edge»
برای فعال کردن گزارشهای اشکالزدایی برای «پردازشگر پیام»:
- در گره «پردازشگر پیام»،
/opt/apigee/customer/application/messsage-processor.propertiesرا ویرایش کنید. اگر آن فایل وجود ندارد، آن را ایجاد کنید. - دارایی زیر را به فایل اضافه کنید:
conf_system_log.level=DEBUG
- بازراهاندازی «پردازشگر پیام»:
/opt/apigee/apigee-service/bin/apigee-service edge-message-processor restart
برای فعال کردن گزارشهای اشکالزدایی برای «میانای کاربر Edge»:
- در گره «میانای کاربر Edge»،
/opt/apigee/customer/application/ui.propertiesرا ویرایش کنید. اگر آن فایل وجود ندارد، آن را ایجاد کنید. - دارایی زیر را به فایل اضافه کنید:
conf_application_logger.application=DEBUG
- بازراهاندازی واسط کاربر Edge:
/opt/apigee/apigee-service/bin/apigee-service edge-ui restart
روالهای مطلوب apigee-monit
هنگام استفاده از apigee-monit، Apigee توصیه میکند که:
- قبلاز انجام هرگونه عملیاتی که باعث شروع یا توقف یک جزء میشود، مانند پشتیبانگیری یا ارتقا، نظارت بر آن جزء را متوقف کنید.
- بااستفاده از ابزاری مثل
cron،apigee-monitرا پایش کنید. برای اطلاعات بیشتر، مانیتور apigee-monit را ببینید.
ابزارهای پایش
ابزارهای پایش مانند Nagios، Collectd، Graphite، Splunk، Sumologic، و Monit میتوانند به شما کمک کنند کل محیط سازمانی و فرایندهای کسبوکارتان را پایش کنید.
| مؤلفه | Nagios | Collectd | Splunk | |
|---|---|---|---|---|
|
بررسیهای سطح سیستم |
بهرهوری واحد پردازش مرکزی |
|||
|
حافظه آزاد/استفادهشده |
||||
|
استفاده از فضای دیسک |
||||
|
آمار شبکه |
||||
|
فرایندها |
|
|
||
|
بررسیهای میانای برنامهسازی کاربردی |
||||
|
JMX |
||||
|
جاوا |
||||
|
فایلهای گزارش |
||||
|
رویدادهای بحرانی |
به محدودیت نرخ رسیدید |
|||
|
دسترسی به سرور زیرینه (Hybris یا SharePoint) امکانپذیر نیست |
||||
|
دسترسی به FaaS (STS) امکانپذیر نیست |
||||
|
رویدادهای هشدار |
دسترسی به سرور SMTP امکانپذیر نیست |
|||
|
قراردادهای سطح سرویس نقض شد |
||||