خاموشسازی Cluster در Dell PowerStore یک عملیات حساس و مرحلهای است که باید از مسیر PowerStore Manager و با رعایت پیشنیازهای فنی انجام شود. در این فرآیند، دسترسی Hostهای Map شده به دادههای داخل Cluster متوقف میشود؛ بنابراین قبل از اجرای Power Down Cluster باید وضعیت Hostها، VMها، Objectهای فعال، اطلاعات سرویس و ترتیب روشنکردن مجدد Cluster بررسی شود.
این مقاله قسمت دوم راهنمای کنترل توان در Dell PowerStore است و روی خاموشکردن Cluster، روشنکردن مجدد Cluster و مدیریت Maintenance Window تمرکز دارد. هدف این راهنما این است که کارشناس زیرساخت، Storage Admin یا تیم دیتاسنتر بتواند عملیات خاموشسازی یا نگهداری برنامهریزیشده را با ترتیب صحیح، کنترلشده و قابل پیگیری انجام دهد.
در این راهنما، مسیر خاموشسازی از مرحله آمادهسازی تا Validation، بررسی Active Objects، تأیید نهایی، کنترل LEDها و قطع کابل برق بررسی میشود. همچنین مراحل روشنکردن Cluster و فعال یا غیرفعالکردن Maintenance Window بهصورت اجرایی توضیح داده شده است.
- خاموشسازی Cluster باید از مسیر PowerStore Manager و بهصورت Graceful انجام شود.
- قبل از Power Down Cluster باید دسترسی Hostها به Storage Resourceها بهصورت موقت قطع شود.
- VMهایی که از Storage داخل Cluster استفاده میکنند باید قبل از خاموشسازی بررسی و خاموش شوند.
- پس از خاموششدن Cluster، دسترسی به UI، API و CLI وجود نخواهد داشت؛ بنابراین دستورالعمل روشنکردن باید از قبل آماده باشد.
- در مرحله Validation باید Errorها، Warningها و Recommendationها بررسی شوند.
- Maintenance Window قبل از عملیاتهایی مانند جداکردن کابل یا تعویض مؤلفه فعال میشود تا هشدار اشتباه برای Customer Support ارسال نشود.
- پس از پایان عملیات نگهداری، Maintenance Window باید غیرفعال شود.
- مسیر مطالعه این راهنما
- دامنه این مقاله
- ملاحظات مهم قبل از کنترل توان در Dell PowerStore
- پیشنیازهای خاموشسازی Cluster در Dell PowerStore
- چکلیست آمادهسازی پیش از Power Down Cluster
- مراحل خاموشسازی Cluster با PowerStore Manager
- مراحل روشنکردن Cluster در Dell PowerStore
- کاربرد Maintenance Window در Dell PowerStore
- مراحل فعالکردن Maintenance Window
- مراحل غیرفعالکردن Maintenance Window
- احتیاطهای سختافزاری هنگام عملیات نگهداری
- نکات اجرایی برای کاهش ریسک خاموشسازی و نگهداری
- جمعبندی عملیاتی
- سوالات پرتکرار
مسیر مطالعه این راهنما
این مقاله در ادامه مقاله قبلی با موضوع مدیریت توان Appliance در Dell PowerStore قرار میگیرد. در قسمت قبلی، کنترل توان در سطح Appliance و مفاهیم مرتبط با خاموشکردن یا روشنکردن اجزای Appliance بررسی شده است.
برای مطالعه پیشزمینه این بخش، مقاله مدیریت توان Appliance در Dell PowerStore را ببینید. مقاله حاضر بهعنوان قسمت دوم، مسیر کنترل توان را در سطح Cluster کامل میکند و علاوه بر خاموشسازی و روشنسازی Cluster، مدیریت Maintenance Window را نیز پوشش میدهد.
بازگشت به بالا ↑
دامنه این مقاله
دامنه این مقاله شامل فرآیندهایی است که برای خاموشسازی کنترلشده Cluster، راهاندازی مجدد آن و جلوگیری از هشدارهای اشتباه در زمان عملیات نگهداری استفاده میشوند. این مقاله بهصورت یک پارت مستقل و کامل نوشته شده است و محتوای آن به چند مقاله جدید تقسیم نمیشود.
تمرکز اصلی مقاله روی سه محور اجرایی است: ابتدا آمادهسازی و خاموشکردن Cluster با PowerStore Manager، سپس روشنکردن Cluster با ترتیب صحیح، و در نهایت فعال یا غیرفعالکردن Maintenance Window برای جلوگیری از ارسال هشدار اشتباه به Customer Support هنگام عملیاتهایی مانند جداکردن کابلها یا تعویض مؤلفهها.
| محور مقاله | هدف اجرایی | خروجی مورد انتظار برای کاربر فنی |
|---|---|---|
| خاموشسازی Cluster | اجرای Power Down Cluster با بررسیهای لازم | خاموششدن کنترلشده همه Nodeهای داخل Cluster |
| روشنکردن Cluster | اتصال مجدد برق و راهاندازی اجزای Cluster با ترتیب مشخص | روشنشدن Expansion Enclosureها و Nodeها با نشانههای LED قابل بررسی |
| Maintenance Window | جلوگیری از هشدار اشتباه Customer Support در زمان نگهداری | فعالسازی و غیرفعالسازی بازه نگهداری برای Appliance موردنظر |
بازگشت به بالا ↑
ملاحظات مهم قبل از کنترل توان در Dell PowerStore
در رویههای کنترل توان Dell PowerStore، خاموشکردن Node، Appliance یا Cluster ممکن است چند دقیقه زمان ببرد. بنابراین این عملیات نباید بهعنوان یک اقدام فوری و بدون برنامهریزی در نظر گرفته شود؛ مگر در شرایط اضطراری واقعی برای قطع برق که در آن، کلیدهای برق Cabinet در وضعیت Off قرار میگیرند تا برق همه اجزای Cabinet بلافاصله قطع شود.
اگر عملیات نگهداری شامل جابهجایی یا تعویض سختافزار باشد، لازم است کابلکشی بین Enclosureها و Applianceها یادداشت شود. اگر هنگام نصب اولیه از برچسب کابل استفاده شده باشد، اتصال مجدد کابلها سادهتر خواهد بود. همچنین باید Dell Service Tag هر Enclosure در Cluster ثبت شود تا در زمان کابلکشی و روشنکردن، شناسایی اجزا با خطای کمتری انجام شود.
در صورتی که Nodeهای داخل Appliance پس از روشنشدن در Service Mode قرار بگیرند، باید وضعیت Boot Mode پاک شود و Node دوباره Reboot شود تا به Normal Mode بازگردد. اگر هر دو Node در یک Appliance در Service Mode ریبوت شوند، برای جلوگیری از تعارضهای نرمافزار مدیریت، ابتدا باید Node A به Normal Mode بازگردد و پس از آن Node B به Normal Mode بازگردانده شود.
| موضوع | اقدام یا محدودیت | دلیل اهمیت |
|---|---|---|
| زمان خاموشسازی | خاموشکردن Node، Appliance یا Cluster ممکن است چند دقیقه طول بکشد. | باید عملیات با برنامهریزی و انتظار زمانی مناسب انجام شود. |
| قطع برق اضطراری | در وضعیت اضطراری واقعی، کلیدهای برق Cabinet روی Off قرار میگیرند. | این کار برق همه اجزای Cabinet را بلافاصله قطع میکند. |
| کابلکشی | کابلکشی بین Enclosureها و Applianceها باید یادداشت شود. | در زمان روشنکردن و اتصال مجدد، احتمال خطا کاهش پیدا میکند. |
| Service Tag | Service Tag هر Enclosure در Cluster باید ثبت شود. | برای شناسایی دقیق اجزا در زمان سرویس یا نگهداری کاربرد دارد. |
| Service Mode | اگر هر دو Node در Service Mode ریبوت شدند، ابتدا Node A باید به Normal Mode برگردد. | از تعارضهای نرمافزار مدیریت جلوگیری میشود. |
بازگشت به بالا ↑
پیشنیازهای خاموشسازی Cluster در Dell PowerStore
خاموشکردن Cluster نسبت به خاموشکردن یک Appliance دامنه وسیعتری دارد. وقتی Cluster خاموش میشود، Hostهای Map شده دسترسی خود را به دادههای روی Cluster از دست میدهند. به همین دلیل، پیش از شروع عملیات باید دسترسی Hostها به همه Storage Resourceها بهصورت موقت قطع شده باشد.
همچنین باید بررسی شود که آیا VMهایی از Storage داخل Cluster استفاده میکنند یا خیر. توصیه شده است پیش از خاموشکردن Cluster، VMها خاموش شوند. این کار باعث میشود هنگام خاموشسازی، وابستگی فعال به Storage داخل Cluster باقی نماند.
نکته مهم دیگر این است که پس از خاموششدن Cluster، دسترسی به رابطهای UI، API و CLI وجود نخواهد داشت. بنابراین دستورالعملهای روشنکردن Cluster باید قبل از شروع عملیات چاپ یا در دسترس قرار داده شوند تا تیم فنی در زمان راهاندازی مجدد، ترتیب موردنیاز را در اختیار داشته باشد.
قطع موقت دسترسی Hostها به Storage Resourceها
پیش از اجرای Power Down Cluster باید اطمینان حاصل شود که Hostهای Map شده دیگر به Storage Resourceهای داخل Cluster وابسته نیستند. خاموشکردن Cluster باعث از دست رفتن دسترسی Hostها به دادههای روی Cluster میشود و این موضوع باید قبل از شروع عملیات مدیریت شود.
این پیشنیاز بهویژه در محیطهایی اهمیت دارد که چند Host بهصورت مستقیم یا غیرمستقیم به Storage Resourceها متصل هستند. اگر دسترسی Hostها پیش از عملیات قطع نشده باشد، خاموشسازی Cluster میتواند باعث توقف دسترسی آنها به داده شود.
بررسی VMهای وابسته به Storage داخل Cluster
در محیطهایی که Cluster به زیرساخت مجازیسازی سرویس میدهد، باید بررسی شود آیا VMهایی از Storage داخل Cluster استفاده میکنند یا خیر. توصیه شده است پیش از خاموشکردن Cluster، VMها خاموش شوند.
هدف از این کار جلوگیری از باقیماندن بار فعال روی Storage در زمان اجرای Power Down Cluster است. در ادامه فرآیند خاموشسازی، پنجره Active Objects نیز Objectهایی را نشان میدهد که طی پنج دقیقه گذشته فعالیت I/O داشتهاند؛ اما بررسی VMها باید قبل از رسیدن به مرحله تأیید نهایی انجام شده باشد.
آمادهسازی اطلاعات مدیریتی و سرویس
برای خاموشسازی Cluster باید اطلاعات مدیریتی و سرویس از قبل آماده باشد. این اطلاعات در شناسایی محیط، تأیید عملیات و مدیریت Applianceها یا Enclosureهای مرتبط استفاده میشود.
اطلاعات موردنیاز شامل آدرس IP مدیریتی Cluster، اعتبارنامه Service Account، Site ID، Service Tagهای Applianceها و در صورت کاربرد، Service Tagهای Expansion Enclosureهای مرتبط است.
| مورد موردنیاز | کاربرد در فرآیند خاموشسازی | اهمیت اجرایی |
|---|---|---|
| آدرس IP مدیریتی Cluster | ورود به PowerStore Manager و اجرای فرآیند Power Down Cluster | بدون این آدرس، مدیریت عملیات از مسیر رابط مدیریتی امکانپذیر نیست. |
| اعتبارنامه Service Account | استفاده در مراحل سرویس و آمادهسازی عملیات | برای سناریوهای سرویس و برخی عملیاتهای مرتبط با کنترل توان لازم است. |
| Site ID | شناسایی محیط در سناریوهای پشتیبانی | در زمان هماهنگی سرویس و پشتیبانی میتواند لازم باشد. |
| Service Tagهای Applianceها | شناسایی Applianceهای داخل Cluster | برای تشخیص دقیق اجزا در زمان عملیات نگهداری و روشنکردن مجدد کاربرد دارد. |
| Service Tagهای Expansion Enclosureها | شناسایی Enclosureهای مرتبط، در صورت وجود | در سناریوهای دارای Expansion Enclosure برای کابلکشی و راهاندازی مجدد مفید است. |
بازگشت به بالا ↑
چکلیست آمادهسازی پیش از Power Down Cluster
پیش از اجرای Power Down Cluster، بهتر است مراحل آمادهسازی بهصورت چکلیست بررسی شود. این چکلیست بر اساس پیشنیازها و ملاحظات فنی رویه خاموشسازی Cluster تنظیم شده است و به تیم فنی کمک میکند هیچ مرحله مهمی پیش از خاموشسازی فراموش نشود.
| ردیف | مورد بررسی | وضعیت مورد انتظار قبل از خاموشسازی |
|---|---|---|
| 1 | دسترسی Hostها به Storage Resourceها | بهصورت موقت قطع شده باشد. |
| 2 | VMهای وابسته به Storage داخل Cluster | بررسی شده و در صورت وجود، پیش از خاموشسازی خاموش شده باشند. |
| 3 | دستورالعمل روشنکردن Cluster | چاپ شده یا قبل از خاموششدن Cluster در دسترس تیم فنی باشد. |
| 4 | آدرس IP مدیریتی Cluster | برای ورود به PowerStore Manager آماده باشد. |
| 5 | اعتبارنامه Service Account | در دسترس فرد مجاز برای عملیات باشد. |
| 6 | Site ID و Service Tagها | برای شناسایی Applianceها و Enclosureهای مرتبط آماده باشد. |
| 7 | درایوهای Flash نوع TLC یا QLC | مدت خاموشماندن و دمای نگهداری با محدودیتهای اعلامشده سازگار باشد. |
| 8 | Maintenance Window | در صورت انجام عملیات نگهداری، قبل از شروع فعال شده باشد. |
محدودیت دسترسی پس از خاموششدن Cluster
وقتی Cluster خاموش میشود، دسترسی به UI، API یا CLI وجود نخواهد داشت. این نکته باید در مرحله برنامهریزی جدی گرفته شود؛ زیرا پس از خاموششدن Cluster، دیگر نمیتوان از خود سیستم برای مشاهده مراحل روشنکردن یا بازیابی ترتیب عملیات استفاده کرد.
به همین دلیل، دستورالعملهای روشنکردن Cluster باید قبل از خاموشسازی چاپ یا در دسترس قرار داده شوند. این آمادهسازی به تیم فنی کمک میکند فرآیند راهاندازی مجدد با ترتیب مشخص و بدون وابستگی به رابطهای مدیریتی خاموششده انجام شود.
ملاحظات نگهداری داده در درایوهای Flash
درایوهای Flash نوع TLC هنگام خاموشبودن، داده را تا 90 روز نگه میدارند. اگر این درایوها بیش از 90 روز خاموش باشند یا در دمای بالاتر از 40° C یا 104° F نگهداری شوند، ممکن است خرابی داده رخ دهد.
درایوهای Flash نوع QLC هنگام خاموشبودن، داده را تا 30 روز نگه میدارند. اگر این درایوها بیش از 30 روز خاموش باشند یا در دمای بالاتر از 40° C یا 104° F نگهداری شوند، ممکن است خرابی داده رخ دهد.
| نوع درایو Flash | مدت نگهداری داده هنگام خاموشبودن | شرایطی که میتواند باعث خرابی داده شود |
|---|---|---|
| TLC | تا 90 روز | خاموشبودن بیش از 90 روز یا نگهداری در دمای بالاتر از 40° C یا 104° F |
| QLC | تا 30 روز | خاموشبودن بیش از 30 روز یا نگهداری در دمای بالاتر از 40° C یا 104° F |
بازگشت به بالا ↑
مراحل خاموشسازی Cluster با PowerStore Manager
خاموشسازی Cluster از داخل PowerStore Manager انجام میشود. در این فرآیند، ابتدا مسیر Power Down Cluster انتخاب میشود، سپس Validation اجرا میشود، خطاها و هشدارها بررسی میشوند، Objectهای فعال مرور میشوند و در نهایت با واردکردن Service Password، عملیات Power Down آغاز میشود.
این فرآیند باید بهترتیب انجام شود و هر مرحله باید قبل از رفتن به مرحله بعدی بررسی شود. مخصوصاً مرحله Validation و بررسی Active Objects برای تصمیمگیری قبل از تأیید نهایی خاموشسازی اهمیت دارد.
- مرحله ۱: در PowerStore Manager، آیکون Settings را انتخاب کنید و سپس در بخش Cluster گزینه Power Down را انتخاب کنید.
- مرحله ۲: روی Power Down Cluster کلیک کنید تا پنجره Validation باز شود.
- مرحله ۳: روی Perform validation کلیک کنید.
- مرحله ۴: Errorها، Warningها و Recommendationها را بررسی کنید.
- مرحله ۵: اگر Cluster همه Validation Checkها را با موفقیت پشت سر گذاشت، روی Next کلیک کنید.
- مرحله ۶: اگر Errorهای باقیماندهای وجود دارد که میتوان آنها را با ایمنی نادیده گرفت، گزینه Ignore errors and proceed, regardless of possible data loss را انتخاب کنید و سپس روی Next کلیک کنید.
- مرحله ۷: در پنجره Active Objects، فهرست Objectهای روی Appliance را که طی پنج دقیقه گذشته فعالیت I/O داشتهاند بررسی کنید.
- مرحله ۸: روی Next کلیک کنید تا پنجره Confirm باز شود.
- مرحله ۹: Service Password را وارد کنید و روی Power Down کلیک کنید.
- مرحله ۱۰: با مشاهده LEDهای Node Power، وضعیت فرآیند خاموشسازی را بررسی کنید.
- مرحله ۱۱: وقتی LEDهای Node Power برای همه Nodeهای داخل Cluster خاموش شدند، فرآیند خاموشکردن کامل شده است.
- مرحله ۱۲: پس از تأیید خاموششدن Cluster، در صورت نیاز کابلهای برق را از هر دو Node در یکی از Base Enclosureهای داخل Cluster جدا کنید.
- مرحله ۱۳: چند ثانیه صبر کنید و تأیید کنید که همه LEDهای باقیمانده خاموش شدهاند.
- مرحله ۱۴: در صورت نیاز، کابلهای برق را از هر Expansion Enclosure مرتبط جدا کنید تا خاموش شوند.
- مرحله ۱۵: اگر Cluster بیش از یک Appliance دارد، مراحل مربوط به قطع برق Base Enclosure و Expansion Enclosure را برای Applianceهای باقیمانده در Cluster نیز تکرار کنید.
مرحله Validation و اهمیت بررسی پیامها
پس از انتخاب Power Down Cluster، پنجره Validation باز میشود. در این مرحله باید Perform validation اجرا شود تا وضعیت Cluster قبل از خاموشسازی بررسی شود.
نتیجه Validation ممکن است شامل Error، Warning و Recommendation باشد. اگر Cluster همه Validation Checkها را با موفقیت بگذراند، ادامه فرآیند با انتخاب Next انجام میشود. اگر Errorهای باقیماندهای وجود داشته باشد که بتوان آنها را با ایمنی نادیده گرفت، گزینه Ignore errors and proceed, regardless of possible data loss در دسترس است.
بررسی Active Objects قبل از تأیید نهایی
بعد از Validation، پنجره Active Objects باز میشود. در این بخش، فهرست Objectهایی نمایش داده میشود که طی پنج دقیقه گذشته فعالیت I/O داشتهاند.
بررسی این فهرست کمک میکند قبل از تأیید نهایی خاموشسازی، وضعیت فعالیتهای اخیر روی Appliance دیده شود. اگر Objectهایی همچنان فعالیت I/O داشته باشند، تیم فنی باید قبل از ادامه، وضعیت آنها را بررسی کند.
پس از بررسی Active Objects، با انتخاب Next پنجره Confirm باز میشود. در این مرحله Service Password وارد میشود و با انتخاب Power Down، عملیات خاموشسازی آغاز میشود.
کنترل تکمیل خاموشسازی با Node Power LED
پس از آغاز فرآیند خاموشسازی، وضعیت عملیات با مشاهده LEDهای Node Power بررسی میشود. فرآیند خاموشکردن زمانی کامل است که LEDهای Node Power برای همه Nodeهای داخل Cluster خاموش شده باشند.
تا زمانی که همه LEDهای Node Power خاموش نشدهاند، نباید فرآیند Power Down را کاملشده فرض کرد. این کنترل، نشانه فیزیکی تکمیل خاموشسازی در سطح Nodeهای Cluster است.
قطع کابل برق پس از خاموششدن Cluster
بعد از تأیید خاموششدن Cluster، در صورت نیاز کابلهای برق از هر دو Node در یکی از Base Enclosureهای داخل Cluster جدا میشود. پس از آن باید چند ثانیه صبر کرد و مطمئن شد همه LEDهای باقیمانده خاموش شدهاند.
اگر Expansion Enclosure مرتبط وجود دارد و نیاز به خاموشکردن آن نیز هست، کابلهای برق از هر Expansion Enclosure مرتبط جدا میشود. اگر Cluster بیش از یک Appliance دارد، همین دو مرحله برای Applianceهای باقیمانده در Cluster تکرار میشود.
| مرحله کلیدی | اقدام | نشانه یا خروجی مورد انتظار |
|---|---|---|
| شروع عملیات | انتخاب Power Down از بخش Cluster در PowerStore Manager | بازشدن فرآیند Power Down Cluster |
| Validation | اجرای Perform validation | نمایش Error، Warning و Recommendation |
| بررسی فعالیت | مرور Active Objects | مشاهده Objectهایی که طی پنج دقیقه گذشته فعالیت I/O داشتهاند |
| تأیید نهایی | واردکردن Service Password و انتخاب Power Down | شروع فرآیند خاموشسازی Cluster |
| کنترل وضعیت | بررسی LEDهای Node Power | خاموششدن LEDهای Node Power برای همه Nodeهای داخل Cluster |
| قطع برق فیزیکی | جداکردن کابلهای برق در صورت نیاز | خاموششدن LEDهای باقیمانده پس از چند ثانیه |
بازگشت به بالا ↑
مراحل روشنکردن Cluster در Dell PowerStore
روشنکردن Cluster باید با ترتیب مشخص انجام شود. اگر Nodeها از شاسی خارج شدهاند، ابتدا باید دوباره در شاسی Base Enclosure مربوطه جاگذاری شوند. در صورت وجود Expansion Enclosure، باید برای هر Appliance در Cluster مطمئن شد که این Enclosureها نیز دوباره در Cabinet جاگذاری شدهاند.
بعد از آمادهسازی فیزیکی اجزا، اتصال برق باید با ترتیب مشخص انجام شود. ابتدا کابلهای برق Expansion Enclosureها و سپس کابلهای برق Nodeها متصل میشوند. برای هر Appliance، کابلهای برق ابتدا به Node A و سپس به Node B وصل میشوند.
- مرحله ۱: اگر Nodeها خارج شدهاند، آنها را دوباره در شاسی Base Enclosure مربوطه جاگذاری کنید.
- مرحله ۲: در صورت کاربرد، برای هر Appliance در Cluster مطمئن شوید Expansion Enclosureها نیز دوباره در Cabinet جاگذاری شدهاند.
- مرحله ۳: در صورت کاربرد، برای هر Appliance در Cluster کابلهای برق را به هر Expansion Enclosure با ترتیب مشخص وصل کنید.
- مرحله ۴: ترتیب اتصال Expansion Enclosureها بهصورت Expansion enclosure 0، سپس Expansion enclosure 1 و سپس Expansion enclosure 2 است.
- مرحله ۵: پس از اتصال کابل برق، LEDهای وضعیت برق روی هر Expansion Enclosure روشن میشوند.
- مرحله ۶: برای هر Appliance، کابلهای برق را ابتدا به Node A و سپس به Node B وصل کنید.
- مرحله ۷: پس از اتصال کابل برق، LED مربوط به Node Power روی هر Node روشن میشود.
ترتیب روشنکردن Expansion Enclosureها
اگر Cluster دارای Expansion Enclosure است، برای هر Appliance باید کابلهای برق Expansion Enclosureها با ترتیب صعودی وصل شوند. ترتیب نمونه شامل Expansion enclosure 0، Expansion enclosure 1 و Expansion enclosure 2 است.
پس از اتصال کابل برق، LEDهای وضعیت برق روی هر Expansion Enclosure روشن میشوند. این نشانه نشان میدهد که Enclosure برق دریافت کرده است و میتوان ادامه فرآیند روشنکردن Appliance را طبق ترتیب مشخص دنبال کرد.
ترتیب اتصال برق Nodeها
بعد از اتصال برق Expansion Enclosureها، برای هر Appliance کابلهای برق ابتدا به Node A و سپس به Node B وصل میشود. این ترتیب باید برای هر Appliance داخل Cluster رعایت شود.
پس از اتصال کابل برق، LED مربوط به Node Power روی هر Node روشن میشود. بررسی این LEDها یکی از نشانههای مهم در فرآیند روشنکردن Cluster است.
| ترتیب | اقدام | نشانه مورد انتظار |
|---|---|---|
| 1 | جاگذاری Nodeها در Base Enclosure، در صورت خارجشدن | Nodeها آماده اتصال برق هستند. |
| 2 | جاگذاری Expansion Enclosureها در Cabinet، در صورت کاربرد | Enclosureهای مرتبط در جای درست قرار گرفتهاند. |
| 3 | اتصال برق به Expansion enclosure 0 | LED وضعیت برق روی Enclosure روشن میشود. |
| 4 | اتصال برق به Expansion enclosure 1 | LED وضعیت برق روی Enclosure روشن میشود. |
| 5 | اتصال برق به Expansion enclosure 2 | LED وضعیت برق روی Enclosure روشن میشود. |
| 6 | اتصال برق به Node A | LED مربوط به Node Power روشن میشود. |
| 7 | اتصال برق به Node B | LED مربوط به Node Power روشن میشود. |
بازگشت به بالا ↑
کاربرد Maintenance Window در Dell PowerStore
Maintenance Window برای زمانهایی استفاده میشود که قرار است عملیاتی روی سیستم انجام شود که ممکن است Customer Support را بهاشتباه از وجود مشکل یا Outage مطلع کند. در طول Maintenance Window، اقداماتی مانند جداکردن کابلها و تعویض مؤلفهها باعث نمیشود Customer Support بهاشتباه درباره Outage هشدار دریافت کند.
بنابراین پیش از انجام رویههایی که ممکن است وضعیت سیستم را به شکل موقت تغییر دهند و بهاشتباه بهعنوان مشکل گزارش شوند، باید Maintenance Window فعال شود. پس از تکمیل عملیات نیز باید Maintenance Window غیرفعال شود تا وضعیت سیستم به حالت عادی بازگردد.
مدت Maintenance Window باید بیشتر از زمان لازم برای تکمیل رویه در نظر گرفته شود. اگر مدت انتخابشده کوتاهتر از زمان واقعی عملیات باشد، ممکن است پیش از پایان کار، Notificationهای پشتیبانی دوباره فعال شوند.
بازگشت به بالا ↑
مراحل فعالکردن Maintenance Window
فعالکردن Maintenance Window از مسیر Settings و بخش Support انجام میشود. در این فرآیند، Appliance موردنظر انتخاب میشود و مدت بازه نگهداری بر اساس تعداد روزها و ساعتها تعیین میشود.
- مرحله ۱: آیکون Settings را انتخاب کنید.
- مرحله ۲: در بخش Support، گزینه Maintenance Window را انتخاب کنید.
- مرحله ۳: Appliance موردنظر را که میخواهید Maintenance Window برای آن فعال شود انتخاب کنید.
- مرحله ۴: روی Enable/Modify کلیک کنید.
- مرحله ۵: در فیلد Maintenance Window Duration، تعداد روزها و ساعتها را برای مدت Maintenance Window وارد کنید.
- مرحله ۶: مدتی را انتخاب کنید که طولانیتر از زمان لازم برای تکمیل رویه باشد.
- مرحله ۷: روی Apply کلیک کنید.
نتایج مورد انتظار پس از فعالسازی
پس از فعالشدن Maintenance Window، سیستم پیام Maintenance window was successfully enabled را نمایش میدهد. این پیام با رنگ سبز Highlight میشود.
همچنین ستون Status مقدار Enabled را نشان میدهد. ستون End Time (Cluster Time) نیز تاریخ و زمانی را نمایش میدهد که سیستم Notificationهای پشتیبانی را برای Appliance دوباره فعال میکند. در مسیر Settings > Support نیز سیستم کنار Maintenance Window مقدار Enabled را نشان میدهد.
| محل مشاهده | وضعیت مورد انتظار بعد از فعالسازی |
|---|---|
| پیام سیستم | Maintenance window was successfully enabled با Highlight سبز نمایش داده میشود. |
| ستون Status | مقدار Enabled نمایش داده میشود. |
| ستون End Time (Cluster Time) | زمان فعالشدن دوباره Notificationهای پشتیبانی برای Appliance نمایش داده میشود. |
| مسیر Settings > Support | کنار Maintenance Window مقدار Enabled نمایش داده میشود. |
بازگشت به بالا ↑
مراحل غیرفعالکردن Maintenance Window
پس از پایان عملیاتی که ممکن بود Customer Support را بهاشتباه از وجود مشکل در سیستم مطلع کند، Maintenance Window باید غیرفعال شود. این کار باعث میشود وضعیت بازه نگهداری پایان پیدا کند و سیستم دیگر مقدار Enabled را کنار Maintenance Window نمایش ندهد.
- مرحله ۱: آیکون Settings را انتخاب کنید.
- مرحله ۲: در بخش Support، گزینه Maintenance Window را انتخاب کنید.
- مرحله ۳: Appliance موردنظر را که میخواهید Maintenance Window آن غیرفعال شود انتخاب کنید.
- مرحله ۴: روی Disable کلیک کنید.
- مرحله ۵: روی Apply کلیک کنید.
نتایج مورد انتظار پس از غیرفعالسازی
پس از غیرفعالشدن Maintenance Window، سیستم پیام Maintenance window was disabled successfully را نمایش میدهد. این پیام نیز با رنگ سبز Highlight میشود.
در این وضعیت، ستون Status مقدار Disabled را نشان میدهد. همچنین در مسیر Settings > Support دیگر مقدار Enabled کنار Maintenance Window نمایش داده نمیشود.
| محل مشاهده | وضعیت مورد انتظار بعد از غیرفعالسازی |
|---|---|
| پیام سیستم | Maintenance window was disabled successfully با Highlight سبز نمایش داده میشود. |
| ستون Status | مقدار Disabled نمایش داده میشود. |
| مسیر Settings > Support | دیگر مقدار Enabled کنار Maintenance Window نمایش داده نمیشود. |
بازگشت به بالا ↑
احتیاطهای سختافزاری هنگام عملیات نگهداری
اگر عملیات خاموشسازی یا Maintenance Window با جابهجایی، نصب، خارجکردن یا تعویض واحدهای قابل تعویض همراه باشد، باید احتیاطهای ایمنی مربوط به سختافزار رعایت شود. کار با سختافزار میتواند باعث تخلیه الکترواستاتیک شود و به تجهیزات آسیب بزند.
پیش از کار با هر سختافزار، باید فضای کافی برای کار فراهم شود و محل کار از مواد غیرضروری یا موادی که بهطور طبیعی بار الکترواستاتیک ایجاد میکنند پاک شود. نمونههایی از این مواد شامل بستهبندی فومی، لیوان فومی و روکشهای Cellophane هستند.
واحدهای Replacement یا Upgrade نباید تا زمانی که آماده نصب نیستند از بستهبندی ضدالکتریسیته ساکن خارج شوند. همچنین پیش از شروع سرویس، کیت ESD و همه مواد موردنیاز باید آماده باشد.
پیشگیری از آسیب ناشی از ESD
برای جلوگیری از تخلیه الکترواستاتیک، باید از دستکش آنتیاستاتیک ESD یا Wristband نوع ESD همراه با Strap استفاده شود. اگر از Wristband نوع ESD همراه با Strap استفاده میشود، گیره Wristband باید به ESD Bracket یا فلز بدون رنگ روی Cabinet، Rack یا Enclosure وصل شود.
Wristband باید دور مچ بسته شود، بهگونهای که دکمه فلزی با پوست تماس داشته باشد. اگر Tester در دسترس است، Wristband باید تست شود.
پس از شروع سرویس، نباید از محل کار دور شد؛ زیرا ممکن است بار الکترواستاتیک دوباره روی بدن جمع شود. همچنین هنگام خارجکردن یک واحد از کیسه ضدالکتریسیته ساکن، نباید مؤلفهها و مدارهای الکترونیکی روی آن لمس شوند.
رویه اضطراری در نبود کیت ESD
اگر وضعیت اضطراری پیش آمد و کیت ESD در دسترس نبود، باید بدن فرد و Subassembly در یک پتانسیل الکترواستاتیک یکسان قرار بگیرند. این روش جایگزین استفاده از کیت ESD نیست و فقط برای شرایط اضطراری مطرح شده است.
در این وضعیت، پیش از لمس هر واحد باید یک سطح فلزی بدون رنگ از Cabinet، Rack یا Enclosure لمس شود. همچنین پیش از خارجکردن واحد از کیسه ضدالکتریسیته ساکن، باید یک دست روی سطح فلزی بدون رنگ قرار بگیرد و همزمان واحد در حالی که هنوز داخل کیسه مهر و موم شده است برداشته شود.
تا زمانی که واحد نصب نشده است، نباید در اتاق حرکت کرد یا سایر وسایل، افراد یا سطوح لمس شوند. اگر پیش از نصب لازم شد در اتاق حرکت شود یا سطح دیگری لمس شود، واحد باید دوباره داخل کیسه ضدالکتریسیته ساکن قرار بگیرد و وقتی آماده نصب شد، مراحل تکرار شود.
نکات ایمنی هنگام خارجکردن یا نصب واحدهای قابل تعویض
برخی واحدهای قابل تعویض بخش عمده وزن خود را در قسمت عقب مؤلفه دارند. هنگام نصب یا خارجکردن چنین واحدهایی، باید مطمئن شد پشت واحد پشتیبانی میشود. افتادن یک واحد قابل تعویض میتواند باعث آسیبدیدگی فردی یا آسیب به تجهیزات شود.
تا زمانی که قطعه جایگزین در دسترس نیست، واحد قابل تعویض Faulted نباید خارج شود. همچنین واحدهای قابل تعویض باید داخل کیسه ضدالکتریسیته ساکن و Container حملونقل ویژهای که با آن دریافت شدهاند نگهداری شوند.
پایداری حرارتی و شرایط نصب
واحدهای قابل تعویض باید پیش از اعمال برق با محیط عملیاتی همدما شوند. این موضوع مستلزم آن است که مؤلفه خارجشده از بستهبندی تا 16 ساعت در محیط عملیاتی قرار بگیرد تا از نظر حرارتی پایدار شود و از Condensation جلوگیری شود.
Front Bezelها باید همیشه متصل باشند تا سازگاری EMI حفظ شود. همچنین پس از تعویض یک مؤلفه، Bezel باید دوباره متصل شود. هر I/O Module یا Drive Slot نیز باید شامل یک مؤلفه یا Filler Panel باشد تا جریان هوای مناسب در سراسر سیستم تضمین شود.
بازکردن بستهبندی قطعه جایگزین
برای بازکردن بستهبندی قطعه، ابتدا باید دستکش ESD پوشیده شود یا Wristband نوع ESD به مچ و Enclosure محل نصب قطعه وصل شود. سپس قطعه از بستهبندی خارج شده و روی یک سطح بدون الکتریسیته ساکن قرار میگیرد.
اگر قطعه جایگزین برای یک قطعه Faulted استفاده میشود، مواد بستهبندی باید برای بازگرداندن قطعه Faulted نگه داشته شوند.
بازگشت به بالا ↑
نکات اجرایی برای کاهش ریسک خاموشسازی و نگهداری
در عملیات خاموشسازی Cluster، آمادهسازی پیش از شروع اهمیت زیادی دارد. Hostها باید از Storage Resourceها جدا شده باشند، VMهای وابسته به Storage بررسی شده باشند و دستورالعمل روشنکردن Cluster پیش از خاموشسازی در دسترس باشد.
در مرحله Validation نباید صرفاً از روی عادت روی Next کلیک شود. Errorها، Warningها و Recommendationها باید بررسی شوند. اگر Errorهای باقیمانده وجود داشته باشد، گزینه Ignore errors and proceed, regardless of possible data loss فقط زمانی باید انتخاب شود که نادیدهگرفتن آنها با ایمنی قابل انجام باشد.
در مرحله Active Objects نیز باید Objectهایی که طی پنج دقیقه گذشته فعالیت I/O داشتهاند بررسی شوند. این مرحله آخرین فرصت مشاهده فعالیتهای اخیر پیش از تأیید نهایی خاموشسازی است.
پس از آغاز Power Down، وضعیت فرآیند با LEDهای Node Power کنترل میشود. تا زمانی که LEDهای Node Power برای همه Nodeهای داخل Cluster خاموش نشدهاند، فرآیند نباید کاملشده در نظر گرفته شود.
در عملیات روشنکردن، ترتیب اتصال برق اهمیت دارد. Expansion Enclosureها در صورت وجود باید با ترتیب صعودی متصل شوند و پس از آن برای هر Appliance، کابلهای برق ابتدا به Node A و سپس به Node B وصل شوند.
Maintenance Window باید قبل از عملیاتهایی مانند جداکردن کابل یا تعویض مؤلفه فعال شود. مدت آن نیز باید طولانیتر از زمان لازم برای تکمیل کار انتخاب شود تا پیش از پایان عملیات، Notificationهای پشتیبانی دوباره فعال نشوند.
| ریسک اجرایی | اقدام کنترلی در مقاله |
|---|---|
| قطع دسترسی Hostها به داده هنگام خاموشسازی | قطع موقت دسترسی Host به همه Storage Resourceها پیش از شروع عملیات |
| وجود VM فعال وابسته به Storage | بررسی VMها و خاموشکردن آنها پیش از خاموشسازی Cluster |
| نبود دسترسی به UI، API و CLI پس از خاموششدن Cluster | چاپ یا آمادهسازی دستورالعمل روشنکردن Cluster قبل از شروع |
| ادامه فعالیت I/O پیش از خاموشسازی | بررسی Active Objects مربوط به پنج دقیقه گذشته |
| هشدار اشتباه به Customer Support در عملیات نگهداری | فعالکردن Maintenance Window پیش از شروع عملیات |
| فعالماندن غیرضروری Maintenance Window پس از پایان کار | غیرفعالکردن Maintenance Window پس از تکمیل عملیات |
| آسیب ناشی از ESD هنگام کار با سختافزار | رعایت احتیاطهای ESD و استفاده از دستکش یا Wristband مناسب |
بازگشت به بالا ↑
جمعبندی عملیاتی
خاموشسازی Cluster در Dell PowerStore باید بهصورت Graceful و از مسیر PowerStore Manager انجام شود. در این فرآیند، آمادهسازی Hostها، بررسی VMها، اجرای Validation، مرور Active Objects، واردکردن Service Password و کنترل LEDهای Node Power نقش کلیدی دارند.
پس از خاموششدن Cluster، در صورت نیاز کابلهای برق از Nodeها و Expansion Enclosureهای مرتبط جدا میشود. اگر Cluster بیش از یک Appliance داشته باشد، این مرحله برای Applianceهای باقیمانده نیز تکرار میشود.
برای روشنکردن Cluster، ابتدا باید Nodeها و Expansion Enclosureها در جای خود قرار بگیرند. سپس برق Expansion Enclosureها با ترتیب صعودی وصل میشود و در ادامه برای هر Appliance، برق ابتدا به Node A و سپس به Node B متصل میشود.
Maintenance Window بخش مهمی از عملیات نگهداری است. فعالکردن آن قبل از اقداماتی مانند جداکردن کابلها یا تعویض مؤلفهها باعث میشود Customer Support بهاشتباه درباره Outage هشدار دریافت نکند. پس از پایان عملیات نیز باید Maintenance Window غیرفعال شود تا وضعیت سیستم به حالت عادی بازگردد.
- خاموشسازی Cluster را از PowerStore Manager و از مسیر Power Down Cluster آغاز کنید.
- قبل از تأیید نهایی، Validation و Active Objects را با دقت بررسی کنید.
- کاملشدن خاموشسازی را با خاموششدن LEDهای Node Power تأیید کنید.
- در زمان روشنکردن، ابتدا Expansion Enclosureها و سپس Node A و Node B را طبق ترتیب مشخص برقدهی کنید.
- Maintenance Window را قبل از عملیات نگهداری فعال و پس از پایان کار غیرفعال کنید.
سوالات پرتکرار
خاموشسازی Cluster در Dell PowerStore از چه مسیری انجام میشود؟
قبل از خاموشکردن Cluster چه مواردی باید آماده باشد؟
چرا باید قبل از خاموشسازی Cluster، VMها بررسی شوند؟
بعد از خاموششدن Cluster آیا دسترسی به UI، API یا CLI وجود دارد؟
Active Objects در فرآیند Power Down Cluster چه کاربردی دارد؟
چه زمانی خاموشسازی Cluster کامل محسوب میشود؟
ترتیب روشنکردن Cluster در Dell PowerStore چگونه است؟
Maintenance Window در Dell PowerStore چه کاربردی دارد؟
مدت Maintenance Window چگونه باید انتخاب شود؟
بعد از فعالکردن Maintenance Window چه نشانههایی دیده میشود؟
پس از پایان عملیات نگهداری با Maintenance Window چه باید کرد؟
اگر عملیات نگهداری شامل تعویض قطعه باشد، چه احتیاطی لازم است؟
بازگشت به بالا ↑
HPE
DELL
Broadcom
HPE
DELL
Broadcom
Vmware