این مقاله یک راهنمای فنی برای پایش سیستم و مدیریت هشدارها در Dell PowerStore است. در این راهنما، قابلیتهای PowerStore Manager برای بررسی Events، مدیریت Alerts، فعالسازی اعلان ایمیلی، پیکربندی SNMP، بررسی Health Score، اجرای System Checks و تنظیم Remote Logging توضیح داده میشود.
- Events تغییرات سیستم را نمایش میدهند، اما Alerts رویدادهایی هستند که به توجه مدیر سیستم نیاز دارند.
- هشدارهای Active و Unacknowledged از طریق Dashboard و صفحه Monitoring > Alerts قابل مشاهده هستند.
- APEX AIOps Observability Health Score نمایی سطحبالا از سلامت Cluster ارائه میکند.
- اعلانهای ایمیلی و SNMP برای ارسال هشدارها به تیم فنی و سیستمهای مانیتورینگ خارجی کاربرد دارند.
- System Checks برای اجرای Health Check مستقل از هشدارهای سیستم استفاده میشود.
- Remote Logging امکان ارسال Audit Log Messageها و رویدادهای مرتبط با هشدار را به مقصدهای خارجی فراهم میکند.
- نقش PowerStore Manager در پایش و بهینهسازی سیستم
- قابلیتهای اصلی پایش در Dell PowerStore
- مدیریت Events و Alerts در PowerStore Manager
- سطوح Severity در هشدارهای Dell PowerStore
- نحوه پایش هشدارها در سطح Cluster و Object
- بررسی سلامت سیستم با APEX AIOps Observability
- پیکربندی اعلان ایمیلی هشدارها
- غیرفعالسازی موقت اعلانهای پشتیبانی با Maintenance Window
- پیکربندی SNMP برای ارسال اطلاعات هشدار
- بنر اطلاعات حیاتی در PowerStore Manager
- اجرای System Checks برای بررسی سلامت سیستم
- ثبت وقایع از راه دور با Remote Logging
- نکات فنی مهم برای پایش مؤثر PowerStore
- سوالات پرتکرار
نقش PowerStore Manager در پایش و بهینهسازی سیستم
PowerStore Manager برای پایش و بهینهسازی Applianceهای مختلف PowerStore استفاده میشود. این محیط مدیریتی به مدیر زیرساخت کمک میکند تغییرات سیستم، هشدارهای مهم، مصرف ظرفیت و وضعیت عملکرد را از یک نقطه مرکزی بررسی کند.
هدف پایش در PowerStore فقط مشاهده وضعیت لحظهای نیست. اعلانهای هشدار، نمودارهای ظرفیت و نمودارهای عملکرد کمک میکنند پیش از گسترش مشکل، نشانههای آن شناسایی شود. همچنین در صورت بروز رخدادهای نیازمند بررسی بیشتر، PowerStore امکان جمعآوری Support Materials را برای تحلیل و رفع مشکل فراهم میکند.
بازگشت به بالا ↑
قابلیتهای اصلی پایش در Dell PowerStore
PowerStore Manager چند قابلیت اصلی برای مانیتورینگ سیستم ارائه میدهد. هرکدام از این قابلیتها بخشی از تصویر کلی سلامت سیستم را نشان میدهند و در کنار هم مسیر پایش فنی سیستم را کامل میکنند.
نمودارهای ظرفیت و عملکرد
نمودارهای ظرفیت، میزان مصرف فعلی ظرفیت در یک PowerStore Cluster و منابع آن را نمایش میدهند. این اطلاعات برای تشخیص منابعی که بیشترین مصرف فضای ذخیرهسازی را دارند کاربرد دارد.
نمودارهای عملکرد برای بررسی سلامت سیستم استفاده میشوند. این نمودارها به تیم فنی کمک میکنند نشانههای احتمالی مشکل را پیش از تأثیر جدی بر سیستم شناسایی کند.
نقش اعلانهای هشدار در کاهش زمان عیبیابی
اعلانهای هشدار باعث میشوند تیم زیرساخت سریعتر نسبت به مشکلات واکنش نشان دهد. درک نحوه مصرف ظرفیت نیز کمک میکند بار میان فضای ذخیرهسازی موجود متعادل شود و زمان مناسب برای افزودن ظرفیت بیشتر به Cluster مشخص گردد.
بازگشت به بالا ↑
مدیریت Events و Alerts در PowerStore Manager
مدیریت Events و Alerts در PowerStore Manager از بخش Monitoring انجام میشود. این بخش برای مشاهده رویدادهای عادی، هشدارهای فعال، هشدارهای تأییدشده و هشدارهای Cleared کاربرد دارد.
تفاوت Events و Alerts
Events اطلاعات مربوط به تغییرات سیستم هستند. Alerts رویدادهایی هستند که نیاز به توجه دارند. بنابراین هر Alert یک رخداد مهم محسوب میشود، اما همه Events الزاماً Alert نیستند.
برای مرور رویدادهایی که به سطح هشدار نمیرسند، از مسیر Monitoring > Events استفاده میشود.
محل نمایش هشدارهای Active و Unacknowledged
هشدارهای Active و Unacknowledged در دو محل اصلی نمایش داده میشوند: Alerts Card روی Dashboard و صفحه Alerts در بخش Monitoring.
همچنین امکان مشاهده هشدارهای مربوط به اشیای منفرد در Cluster وجود دارد. برای نمونه، هشدارهای مربوط به یک Appliance، Storage Resource یا Virtual Machine از Alerts Card همان Object قابل بررسی است.
فیلترهای اصلی در صفحه Alerts
در زمان مشاهده Events و Alerts میتوان هشدارها را بر اساس ستونها مرتب کرد و با دستهبندیهای مختلف فیلتر نمود. فیلترهای پیشفرض شامل Severity، Resource Type، Acknowledged و Cleared هستند.
| فیلتر | کاربرد |
|---|---|
| Severity | محدود کردن نمایش رویدادها و هشدارها بر اساس شدت. |
| Resource Type | فیلتر کردن رویدادها یا هشدارها بر اساس نوع منبع مرتبط. |
| Acknowledged | نمایش یا مخفیسازی هشدارهایی که توسط کاربر مشاهده و تأیید شدهاند. |
| Cleared | مشاهده هشدارهایی که دیگر مرتبط نیستند یا توسط سیستم Clear شدهاند. |
بازگشت به بالا ↑
سطوح Severity در هشدارهای Dell PowerStore
سطح Severity مشخص میکند یک هشدار چه میزان اهمیت دارد و واکنش تیم فنی باید با چه اولویتی انجام شود. این سطحبندی برای تفکیک رخدادهای بحرانی از هشدارهای اطلاعرسانی استفاده میشود.
| سطح Severity | مفهوم فنی | نمونه وضعیت |
|---|---|---|
| Critical | رویدادی با اثر قابلتوجه بر سیستم که باید بلافاصله برطرف شود. | نبودن یا از کار افتادن یک جزء که ممکن است بازیابی آن امکانپذیر نباشد. |
| Major | رویدادی که ممکن است بر سیستم اثر بگذارد و باید هرچه زودتر بررسی شود. | عدم تطابق آخرین زمان همگامسازی یک Resource با Protection Policy. |
| Minor | رویدادی که نیازمند آگاهی است اما اثر قابلتوجهی بر سیستم ندارد. | کارکرد یک جزء با عملکرد غیر بهینه. |
| Info | رویدادی بدون اثر بر عملکرد سیستم. | در دسترس بودن نرمافزار جدید برای دانلود. |
بازگشت به بالا ↑
نحوه پایش هشدارها در سطح Cluster و Object
PowerStore Manager امکان مشاهده هشدارها را در چند سطح فراهم میکند؛ از کل Cluster تا یک Object منفرد مانند Volume. صفحه Alerts هر ۳۰ ثانیه بهصورت خودکار Refresh میشود.
مشاهده هشدارها در سطح Cluster
برای مشاهده هشدارها در سطح Cluster، میتوان از Alerts Card روی Dashboard گزینه View All Alerts را انتخاب کرد. مسیر دیگر، انتخاب Monitoring > Alerts است.
این نما برای بررسی وضعیت کلی سیستم مناسب است و زمانی کاربرد دارد که مدیر زیرساخت بخواهد همه هشدارهای فعال یا فیلترشده را در یک نمای متمرکز مشاهده کند.
مشاهده هشدارهای یک Object
برای بررسی هشدارهای مربوط به یک Object منفرد، ابتدا باید همان Object مانند Volume باز شود. سپس Alerts Card مربوط به آن Object انتخاب میشود.
این روش زمانی کاربرد دارد که مشکل در یک منبع خاص بررسی میشود و مدیر سیستم نمیخواهد میان هشدارهای کل Cluster جستجو کند.
بررسی جزئیات هشدار و Associated Events
از صفحه Alerts یا Alerts Card میتوان هشدارهای Acknowledged و Cleared را نمایش داد یا مخفی کرد. همچنین امکان فیلتر کردن هشدارها بر اساس Category، انتخاب ستونهای جدول، خروجی گرفتن به فایل .csv یا .xlsx و Refresh کردن جدول وجود دارد.
برای مشاهده اطلاعات بیشتر، باید روی توضیح هشدار کلیک شود. در این بخش، اثر هشدار بر سیستم، Timeline، Remediation پیشنهادی و سایر رویدادهای مرتبط نمایش داده میشود.
Acknowledge کردن هشدار
برای Acknowledge کردن یک هشدار، چکباکس هشدار انتخاب میشود و سپس گزینه Acknowledge کلیک میشود. پس از Acknowledge شدن، سیستم هشدار را از فهرست هشدارها حذف میکند، مگر اینکه نمایش هشدارهای Acknowledged فعال باشد.
این کار برای مدیریت نمای هشدارها مفید است، اما نباید با رفع مشکل اشتباه گرفته شود. مشکل اصلی باید همچنان از طریق Remediation یا بررسی فنی مربوطه پیگیری شود.
بازگشت به بالا ↑
بررسی سلامت سیستم با APEX AIOps Observability
APEX AIOps Observability Health Score یک نمای کلی سطحبالا از سلامت Cluster ارائه میکند. هدف این قابلیت، کمک به شناسایی سریع مشکلات موجود در سیستم است.
کارت Health Score در Dashboard نمایش داده میشود و امتیاز کلی سلامت را همراه با وضعیت پنج ویژگی نشان میدهد: Components، Configuration، Capacity، Performance و Data Protection. برای هر ویژگی، تعداد مشکلات موجود نمایش داده میشود.
پیشنیاز فعالسازی Health Score
برای ارسال داده به APEX AIOps Observability، باید Support Connectivity روی Cluster فعال باشد. PowerStore هر پنج دقیقه یک Health Score بهروزشده را بهصورت خودکار Upload میکند.
برای فعال کردن کارت Health Score، مسیر Settings > Support > Support Connectivity انتخاب میشود. سپس در تب Connection Type گزینه Enable فعال میشود. اگر گزینه Connect to APEX AIOps Observability فعال نیست، باید آن را فعال کرد.
وضعیتهای نمایش کارت Health Score
| وضعیت APEX AIOps Observability | نتیجه در Dashboard |
|---|---|
| APEX AIOps Observability فعال نیست. | کارت Health Score نمایش داده نمیشود. |
| APEX AIOps Observability فعال است، اتصال Active است و داده در دسترس است. | کارت Health Score نمایش داده میشود و امتیاز سلامت بهروزشده را نشان میدهد. |
| اتصال به Secure Remote Services مختل شده است. | کارت Health Score غیرفعال میشود و خطای اتصال را نشان میدهد. |
بازگشت به بالا ↑
پیکربندی اعلان ایمیلی هشدارها
PowerStore Manager امکان ارسال اعلانهای هشدار به مشترکان ایمیلی را فراهم میکند. این قابلیت برای تیمهایی کاربرد دارد که نیاز دارند هشدارهای سیستم را خارج از محیط مدیریتی نیز دریافت کنند.
مرحله ۱: آیکون Settings انتخاب شود و از بخش Networking گزینه SMTP Server باز شود.
مرحله ۲: اگر قابلیت SMTP Server غیرفعال است، با دکمه Toggle فعال شود.
مرحله ۳: آدرس SMTP Server در فیلد Server Address وارد شود.
مرحله ۴: آدرس ایمیلی که اعلانها از آن ارسال میشوند در فیلد From Email Address وارد شود.
مرحله ۵: گزینه Apply انتخاب شود.
مرحله ۶: در صورت نیاز، یک ایمیل آزمایشی برای بررسی صحت تنظیمات SMTP Server ارسال شود.
مرحله ۷: در بخش Email Notifications گزینه Add/remove email subscribers انتخاب شود.
مرحله ۸: برای افزودن مشترک ایمیلی، گزینه Add انتخاب و آدرس ایمیل مقصد در فیلد Email Address وارد شود.
مرحله ۹: سطح Severity اعلانهای ارسالی برای آن آدرس ایمیل انتخاب شود.
مرحله ۱۰: در صورت نیاز، با انتخاب چکباکس آدرس ایمیل و کلیک روی Send Test Email، دریافت اعلان بررسی شود.
بازگشت به بالا ↑
غیرفعالسازی موقت اعلانهای پشتیبانی با Maintenance Window
در برخی عملیات نگهداری مانند جدا کردن کابلها، تعویض Driveها یا ارتقای نرمافزار، ممکن است لازم باشد ارسال Call Home Alertها به Support بهصورت موقت متوقف شود. برای این کار از Maintenance Window استفاده میشود.
مرحله ۱: در صفحه Settings، گزینه Maintenance Window از بخش Support انتخاب شود.
مرحله ۲: Appliance موردنظر برای غیرفعالسازی موقت اعلانها انتخاب شود.
مرحله ۳: گزینه Enable/Modify انتخاب شود.
مرحله ۴: در پنل Maintenance Window، تعداد روزها و ساعتهای غیرفعالسازی اعلانها در فیلد Maintenance Window Duration مشخص شود.
مرحله ۵: گزینه Apply انتخاب شود.
بازگشت به بالا ↑
پیکربندی SNMP برای ارسال اطلاعات هشدار
PowerStore میتواند اطلاعات هشدار را به حداکثر ۱۰ SNMP Manager تعیینشده ارسال کند. این مقصدها به عنوان Trap Destination استفاده میشوند.
برای مشاهده Local Engine ID باید مسیر Settings > Networking > SNMP انتخاب شود. مقدار Local Engine ID در بخش Details نمایش داده میشود.
مرحله ۱: در PowerStore Manager گزینه Settings انتخاب شود.
مرحله ۲: در بخش Networking، گزینه SNMP انتخاب شود.
مرحله ۳: برای افزودن SNMP Manager، در بخش SNMP Managers روی Add کلیک شود.
مرحله ۴: در پنل Add SNMP Manager، اطلاعات مربوط به نسخه SNMP وارد شود.
مرحله ۵: گزینه Add انتخاب شود.
مرحله ۶: در صورت نیاز، با گزینه Send Test SNMP Trap دسترسی مقصدهای SNMP Manager و صحت دریافت اطلاعات بررسی شود.
اطلاعات موردنیاز برای SNMPv2c
| پارامتر | توضیح |
|---|---|
| Network Name یا IP Address | نام شبکه یا آدرس مقصد SNMP Manager. |
| Port | پورت مقصد. |
| Minimal Severity Level of Alerts | حداقل سطح Severity هشدارهایی که ارسال میشوند. |
| Version | نسخه SNMP. |
| Trap Community String | رشته Community برای Trap. |
اطلاعات موردنیاز برای SNMPv3
| پارامتر | توضیح |
|---|---|
| Network Name یا IP Address | نام شبکه یا آدرس مقصد SNMP Manager. |
| Port | پورت مقصد. |
| Minimal Severity Level of Alerts | حداقل سطح Severity هشدارها. |
| Version | نسخه SNMP. |
| Security Level | سطح امنیتی انتخابشده. |
| Username | نام کاربری مرتبط با پیام SNMPv3. |
| Password | رمز عبور تعیینشده توسط سیستم در سطوح امنیتی دارای احراز هویت. |
| Authentication Protocol | یکی از MD5 یا SHA256. |
| Privacy Protocol | یکی از AES256 یا TDES در حالت Authentication and Privacy. |
نکات امنیتی SNMPv3
در SNMPv3، فیلدهای قابل مشاهده به Security Level انتخابشده بستگی دارند. اگر Security Level برابر None باشد، فقط Username نمایش داده میشود و Username باید NULL باشد.
اگر Security Level برابر Authentication Only باشد، فیلدهای Username، Password و Authentication Protocol نمایش داده میشوند. اگر Authentication and Privacy انتخاب شود، علاوه بر این موارد، Privacy Protocol نیز نمایش داده میشود.
نام کاربری SNMP میتواند حداکثر ۳۲ کاراکتر داشته باشد و شامل ترکیبی از کاراکترهای Alphanumeric باشد.
بازگشت به بالا ↑
بنر اطلاعات حیاتی در PowerStore Manager
بنر اطلاعات حیاتی در بالای PowerStore Manager نمایش داده میشود و اطلاعات مربوط به Global Alertها را به همه کاربران واردشده به سیستم نشان میدهد.
اگر فقط یک Global Alert صادر شده باشد، بنر توضیح همان هشدار را نمایش میدهد. اگر چند هشدار وجود داشته باشد، تعداد Global Alertهای فعال نمایش داده میشود.
| نوع هشدار | رنگ بنر |
|---|---|
| Information Alerts | آبی، Information. |
| Minor/Major Alerts | زرد، Warning. |
| Critical Alerts | قرمز، Error. |
وقتی سیستم هشدارها را Clear کند، بنر ناپدید میشود.
بازگشت به بالا ↑
اجرای System Checks برای بررسی سلامت سیستم
صفحه System Checks امکان اجرای Health Check روی کل سیستم را فراهم میکند. این بررسیها مستقل از هشدارهایی هستند که سیستم صادر میکند.
اجرای System Check پیش از اقداماتی مانند Upgrade یا فعالسازی Support Connectivity کاربرد دارد. هدف این است که مشکلات احتمالی پیش از ارتقای سیستم یا فعالسازی Support Connectivity شناسایی و برطرف شوند.
انتخاب Run System Check فقط پروفایل Service Engagement را Trigger میکند؛ اما عملیات دیگر در PowerStore Manager میتوانند پروفایلهای دیگری را Trigger کنند.
اطلاعات جدول System Check
| فیلد | توضیح |
|---|---|
| Item | آیتم Health Check. |
| Description | توضیح نتیجه Health Check. |
| Status | نتیجه Health Check؛ Passed یا Failed. |
| Category | دسته Health Check؛ Configured Resource، Hardware یا Software Services. |
| Appliance | Applianceای که آیتم Health Check برای آن اجرا شده است. |
| Node | Nodeای که آیتم Health Check برای آن اجرا شده است. |
مراحل اجرای System Check
مرحله ۱: در بخش Monitoring، گزینه System Checks انتخاب شود.
مرحله ۲: روی Run System Check کلیک شود.
مرحله ۳: نتایج System Check در جدول نمایش داده میشود.
مرحله ۴: با کلیک روی یک آیتم Failed، اطلاعات بیشتری درباره نتیجه بررسی قابل مشاهده است.
مرحله ۵: اطلاعات Profile و Last Run نیز پس از اجرا بهروزرسانی میشوند.
بازگشت به بالا ↑
ثبت وقایع از راه دور با Remote Logging
Storage System از ارسال Audit Log Messageها و رویدادهای مرتبط با System Alert به حداکثر دو Host پشتیبانی میکند. این Hostها باید از سمت Storage System قابل دسترسی باشند.
انتقال Audit Log Messageها میتواند از One-way Authentication با Server CA Certificates یا Two-way Authentication اختیاری با Mutual Authentication Certificate استفاده کند. اگر Remote Syslog Server برای TLS Encryption پیکربندی شده باشد، Certificate واردشده برای آن اعمال میشود.
برای مرور یا بهروزرسانی تنظیمات Remote Logging، باید وارد PowerStore شد، گزینه Settings را انتخاب کرد و از Settings Sidebar در بخش Security گزینه Remote Logging را باز کرد.
بازگشت به بالا ↑
نکات فنی مهم برای پایش مؤثر PowerStore
برای مدیریت دقیقتر هشدارها، باید تفاوت میان Acknowledged و Cleared بهدرستی درک شود. Acknowledged فقط نشان میدهد هشدار توسط کاربر دیده شده است؛ در حالی که Cleared زمانی رخ میدهد که هشدار دیگر مرتبط نباشد یا مشکل توسط سیستم برطرفشده تشخیص داده شود.
در بررسی هشدارها، فیلتر Severity اهمیت زیادی دارد. هشدارهای Critical باید با اولویت بیشتری بررسی شوند، در حالی که Info معمولاً نیازمند اقدام مستقیم نیست.
در تنظیم اعلانها، انتخاب Severity مناسب برای مشترکان ایمیلی و مقصدهای SNMP باعث میشود تیم فنی فقط هشدارهای مرتبط و قابل اقدام را دریافت کند. همچنین اجرای System Checks پیش از عملیات مهم مانند Upgrade یا فعالسازی Support Connectivity میتواند ریسک اجرای عملیات را کاهش دهد.
بازگشت به بالا ↑
سوالات پرتکرار
تفاوت Events و Alerts در Dell PowerStore چیست؟
Events تغییرات سیستم را نشان میدهند، اما Alerts رویدادهایی هستند که به توجه نیاز دارند. بیشتر Alerts نشاندهنده وجود مشکل یا وضعیتی هستند که باید توسط تیم فنی بررسی شود.
آیا Acknowledge کردن یک هشدار یعنی مشکل رفع شده است؟
خیر. Acknowledge فقط نشان میدهد هشدار توسط یک کاربر مشاهده و تأیید شده است. رفع مشکل باید جداگانه از طریق بررسی جزئیات هشدار و Remediation انجام شود.
صفحه Alerts در PowerStore Manager هر چند وقت یکبار بهروزرسانی میشود؟
صفحه Alerts هر 30 ثانیه بهصورت خودکار Refresh میشود. این موضوع کمک میکند وضعیت هشدارها در نمای مدیریتی بهروز بماند.
برای فعال شدن APEX AIOps Observability Health Score چه پیشنیازی وجود دارد؟
برای ارسال داده به APEX AIOps Observability باید Support Connectivity روی Cluster فعال باشد. همچنین سیستم باید به Secure Remote Services متصل باشد و داده سلامت در دسترس قرار گیرد.
در SNMPv3 چه پروتکلهای Authentication قابل انتخاب هستند؟
در حالتهایی که Authentication فعال است، میتوان یکی از MD5 یا SHA256 را به عنوان Authentication Protocol انتخاب کرد.
Remote Logging در PowerStore چه کاربردی دارد؟
Remote Logging برای ارسال Audit Log Messageها و رویدادهای مرتبط با System Alert به حداکثر 2 Host استفاده میشود. این قابلیت برای ثبت و پیگیری وقایع سیستم در مقصدهای خارجی کاربرد دارد.
System Checks چه زمانی در PowerStore کاربرد دارد؟
System Checks برای اجرای Health Check روی کل سیستم استفاده میشود. این بررسی بهویژه پیش از Upgrade یا فعالسازی Support Connectivity مفید است، چون میتواند مشکلات احتمالی را قبل از انجام عملیات مشخص کند.
HPE
DELL
Broadcom
HPE
DELL
Broadcom
Vmware