سرور Dell PowerEdge XE8640 یک پلتفرم شتابیافته دوسوکته و رکمونت 4U است که برای اجرای بارهای کاری AI، Machine Learning، Deep Learning و HPC طراحی شده است. این مدل با چهار شتابدهنده NVIDIA H100 SXM5 و ارتباط پرسرعت NVLink، توان پردازش موازی بالایی را در اختیار پروژههای محاسباتی سنگین قرار میدهد.
PowerEdge XE8640 از دو پردازنده Intel Xeon Scalable و حافظه DDR5 پشتیبانی میکند و برای سازمانهایی مناسب است که به پردازش چندGPU، تحلیل دادههای حجیم و اجرای مدلهای پیچیده هوش مصنوعی نیاز دارند.
این سرور برای دیتاسنترهایی مناسب است که توان برق و ظرفیت سرمایش هوایی کافی دارند، اما زیرساخت Facility Water در رک آنها فراهم نیست. انتخاب مدل CPU، ظرفیت حافظه، Storage، شبکه و Software Stack باید متناسب با Workload واقعی پروژه انجام شود.
PowerEdge XE8640 یک سرور شتابیافته از خانواده PowerEdge XE است که برای اجرای Workloadهای Compute-Intensive و GPU-Accelerated توسعه یافته است. این مدل در گروه سرورهای هوش مصنوعی Dell قرار میگیرد و برخلاف بسیاری از سرورهای عمومی، معماری آن بهطور مشخص برای آموزش مدلهای AI، پردازش موازی، تحلیل داده و محاسبات علمی طراحی شده است.
XE8640 همچنان یک سرور رکمونت دیتاسنتری است، اما نباید آن را معادل یک سرور عمومی مجهز به چند کارت گرافیکی PCIe در نظر گرفت. استفاده از پلتفرم NVIDIA HGX، چهار GPU مدل H100 SXM5 و Fabric داخلی NVLink، جایگاه این مدل را از بسیاری از سرورهای رکمونت دیتاسنتری Dell متمایز میکند.
سرور شتابیافته سیستمی است که علاوه بر CPU، از GPU یا Accelerator برای اجرای بخشهای موازی و محاسباتی Workload استفاده میکند. در XE8640، چهار GPU مدل H100 بخش عمده پردازش AI و محاسبات موازی را انجام میدهند و CPUها مدیریت سیستم، آمادهسازی داده، پردازشهای ترتیبی و هماهنگی میان منابع را بر عهده دارند.
تفاوت اصلی XE8640 با یک سرور GPU-Ready معمولی، استفاده از GPUهای SXM5 روی یک Baseboard یکپارچه NVIDIA HGX است. در این ساختار، GPUها برای ارتباط مستقیم و پرسرعت از NVLink استفاده میکنند؛ درحالیکه در بسیاری از سرورهای GPU-Ready، کارتهای گرافیکی استاندارد روی اسلاتهای PCIe مستقل نصب میشوند.
این تفاوت در Workloadهایی که تبادل مستمر داده میان GPUها دارند، مانند Training چندGPU، Tensor Parallelism و Model Parallelism اهمیت زیادی دارد. در مقابل، برای پروژههایی که تنها به یک یا دو GPU استاندارد PCIe نیاز دارند، معماری HGX ممکن است هزینه و پیچیدگی بیشتری نسبت به نیاز واقعی پروژه ایجاد کند.
این سرور جایگزین Storage سازمانی، Backup Appliance یا سرور مجازیسازی عمومی نیست. ارزش XE8640 زمانی ایجاد میشود که مدل AI، Dataset، Framework یا Solver علمی بتواند از چهار GPU و Fabric ارتباطی آن بهطور مؤثر استفاده کند.
مزیت XE8640 فقط در تعداد GPU خلاصه نمیشود. ترکیب پلتفرم HGX H100، پردازندههای دوسوکته، حافظه DDR5، مسیرهای PCIe Gen5، درایوهای NVMe و مدیریت یکپارچه Dell، این مدل را به یک Node محاسباتی تخصصی برای پروژههای AI و HPC تبدیل میکند.
PowerEdge XE8640 از دو پردازنده Intel Xeon Scalable پشتیبانی میکند. کانفیگهای نسل چهارم میتوانند تا 56 هسته در هر پردازنده و کانفیگهای نسل پنجم تا 64 هسته در هر پردازنده داشته باشند. مدل دقیق CPU باید بر اساس نوع Pipeline، تعداد Threadهای پردازش داده، نیاز به فرکانس، تعداد هسته، توان حرارتی و نسبت CPU-to-GPU انتخاب شود.
انتخاب بیشترین Core Count برای تمام پروژهها لزوماً بهترین تصمیم نیست. برخی Pipelineهای هوش مصنوعی به فرکانس CPU، پهنای باند حافظه یا I/O حساستر هستند؛ درحالیکه بعضی Workloadهای HPC از تعداد هسته بیشتر بهره میبرند. NUMA Awareness نرمافزار و نحوه اتصال NIC، Storage و GPUها نیز باید در طراحی لحاظ شود.
این سرور دارای 32 اسلات DDR5 RDIMM و حداکثر ظرفیت 4TB است. سرعت حافظه میتواند در کانفیگهای سازگار به 5600MT/s برسد، اما مقدار واقعی به نسل CPU، ظرفیت و Rank ماژولها، تعداد DIMM در هر Channel و الگوی پر شدن اسلاتها وابسته است.
ظرفیت RAM باید همراه با حجم Dataset، تعداد Workerها، فرآیندهای Data Loader، Cache نرمافزار، تعداد Jobهای همزمان و نیازهای سیستمعامل محاسبه شود. کمبود حافظه Host میتواند باعث افزایش I/O، افت GPU Utilization و کاهش Performance کل Pipeline شود.
XE8640 از پلتفرم NVIDIA HGX H100 با چهار GPU مدل H100 80GB 700W SXM5 استفاده میکند. این معماری برای انتخاب آزاد میان کارتهای AMD، مدلهای مختلف NVIDIA PCIe یا ترکیب Acceleratorهای ناهمگون طراحی نشده است. مزیت اصلی آن، یک معماری ثابت، یکپارچه و اعتبارسنجیشده برای پردازش Multi-GPU است.
در Workloadهای چندGPU، پارامترهای مدل، Gradientها، Activationها و بخشهایی از Dataset میان GPUها منتقل میشوند. هرچه این ارتباط فشردهتر باشد، پهنای باند و Latency مسیر GPU-to-GPU اهمیت بیشتری پیدا میکند. NVLink در XE8640 برای Trainingهایی که از Data Parallelism، Tensor Parallelism یا سایر روشهای توزیع داخل یک Node استفاده میکنند، مزیت ایجاد میکند.
قابلیت NVIDIA Multi-Instance GPU یا MIG نیز میتواند هر H100 را به حداکثر هفت Instance منطقی تقسیم کند. استفاده عملی از MIG به نسخه Driver، CUDA، Container Runtime، Orchestrator، Scheduler و سیاست تخصیص منابع وابسته است.
PowerEdge XE8640 بسته به Backplane سفارشدادهشده از حداکثر هشت درایو Hot-Swap مدل NVMe در فرم 2.5 اینچی یا E3.S پشتیبانی میکند. حداکثر ظرفیت خام اعلامشده برای کانفیگ هشت درایو 2.5 اینچی NVMe تا 122.88TB است؛ اما ظرفیت واقعی به مدل درایوهای تأییدشده و ظرفیت قابل سفارش در زمان خرید وابسته خواهد بود.
ظرفیت قابل استفاده پس از RAID، Formatting، Over-Provisioning و فضای رزروشده کمتر از ظرفیت خام خواهد بود. برای Boot نیز BOSS-N1 با دو SSD مدل M.2 و Hardware RAID 1 قابل استفاده است. Software RAID مدل S160 نیز در فهرست گزینههای رسمی این سیستم قرار دارد.
درایوهای داخلی برای سیستمعامل، Scratch Space، Cache، Checkpoint یا Datasetهای محدود مناسباند. پروژههای بزرگ AI و HPC معمولاً به Storage اشتراکی پرسرعت، Parallel File System، Object Storage یا SAN/NAS متناسب با نرخ خواندن و نوشتن Workload نیاز دارند.
استفاده از NVIDIA GPUDirect Storage میتواند در معماریهای سازگار مسیر انتقال داده میان Storage و GPU را بهینه کند. فعال شدن این قابلیت به Storage، NIC، Driver، CUDA، فایلسیستم و طراحی شبکه وابسته است و صرف خرید سرور، Performance مورد انتظار را تضمین نمیکند.
در کانفیگ دوپردازندهای، حداکثر چهار اسلات PCIe Gen5 x16 از نوع Full-Height و Half-Length در دسترس است. این اسلاتها میتوانند برای NICهای پرسرعت، InfiniBand، Ethernet مبتنی بر RDMA، DPU یا سایر کارتهای توسعه تأییدشده Dell استفاده شوند.
CPUهای XE8640 با Air Cooling خنک میشوند و بخش GPU از Liquid-Assisted Air Cooling استفاده میکند. این طراحی به Facility Water در محل رک نیاز ندارد، اما گرمای تولیدشده در نهایت به هوای دیتاسنتر منتقل میشود. بنابراین ظرفیت سرمایش سالن، دمای ورودی، CFM، فشار هوا، Hot Aisle و توان دفع حرارت باید پیش از استقرار بررسی شوند.
سیستم از چهار PSU مدل Titanium با توان 2800W یا 3200W، متناسب با نوع ورودی و کانفیگ، پشتیبانی میکند. برای حفظ Full Performance حداقل سه PSU مورد نیاز است و حالتهای Redundancy مانند 3+1 یا 2+2 باید همراه با رفتار Power Braking و محدودیت عملکرد GPU بررسی شوند.
چهار GPU با توان نامی 700W در مجموع میتوانند تا 2800W توان طراحی حرارتی داشته باشند؛ این مقدار بدون احتساب CPUها، حافظه، درایوها، NICها و فنها است. ظرفیت مدار برق، PDU، کابل، Redundancy و سرمایش باید بر اساس مصرف واقعی کانفیگ و با حاشیه عملیاتی مناسب محاسبه شود.
شاسی 4U این سرور با Bezel حدود 901.4 میلیمتر عمق دارد و حداکثر وزن آن در کانفیگ کامل حدود 61.4 کیلوگرم است. عمق مفید رک، Rail Kit، ظرفیت تحمل وزن، PDU، کابلکشی و فضای سرویس باید پیش از خرید کنترل شوند.
جدول زیر مشخصات اصلی PowerEdge XE8640 را نشان میدهد. مقادیر حداکثری به نسل پردازنده، Backplane، نوع درایو، Firmware، ورودی برق و کانفیگ تأییدشده Dell وابسته هستند.
| بخش | مشخصات PowerEdge XE8640 |
|---|---|
| نوع سیستم | سرور شتابیافته دوسوکته Rackmount |
| فرم فکتور | 4U |
| پردازنده | دو پردازنده Intel Xeon Scalable نسل چهارم یا پنجم |
| حداکثر هسته CPU | تا 56 هسته در نسل چهارم یا 64 هسته در نسل پنجم برای هر پردازنده |
| Chipset | Intel C741 |
| GPU | پلتفرم NVIDIA HGX H100 با چهار GPU مدل H100، حافظه 80GB، توان تا 700W و فرم SXM5 |
| ارتباط GPU | NVIDIA NVLink با پهنای باند ارتباطی تا 900GB/s برای هر GPU |
| قابلیت MIG | امکان ایجاد حداکثر هفت Instance منطقی روی هر H100، وابسته به Software Stack |
| حافظه | 32 اسلات DDR5 RDIMM با حداکثر ظرفیت 4TB |
| سرعت حافظه | 5600، 4800 یا 4400MT/s؛ وابسته به CPU، DIMM و نحوه چیدمان حافظه |
| Drive Bay | تا هشت درایو Hot-Swap مدل 2.5-inch NVMe SSD یا E3.S NVMe SSD، بسته به Backplane |
| حداکثر ظرفیت خام داخلی | تا 122.88TB در کانفیگهای سازگار 2.5-inch NVMe؛ وابسته به درایوهای قابل سفارش |
| Boot Storage | BOSS-N1 با دو SSD مدل M.2 و Hardware RAID 1 |
| کنترلر Storage | Software RAID مدل S160 و BOSS-N1 برای Boot |
| اسلات توسعه | تا چهار اسلات PCIe Gen5 x16 از نوع Full-Height و Half-Length |
| شبکه | یک اسلات OCP 3.0 اختیاری، دو Port یکگیگابیتی LOM اختیاری و NICهای PCIe متناسب با پروژه |
| مدیریت | iDRAC9، iDRAC Direct، Redfish API و مجموعه Dell OpenManage |
| امنیت | Secure Boot، Firmware امضاشده، Silicon Root of Trust، Secure Erase، TPM 2.0 و SED Encryption در کانفیگ سازگار |
| منبع تغذیه | چهار PSU مدل Titanium با توان 2800W یا 3200W؛ Hot-Swap و وابسته به نوع ورودی و کانفیگ |
| Redundancy برق | پشتیبانی از حالتهای 3+1 و 2+2؛ برای Full Performance حداقل سه PSU مورد نیاز است |
| خنککاری | Air Cooling برای CPU و Liquid-Assisted Air Cooling برای GPU؛ بدون نیاز به Facility Water در رک |
| سیستمعاملهای اصلی | Canonical Ubuntu Server LTS و Red Hat Enterprise Linux |
| ابعاد با Bezel | ارتفاع 174.3، عرض 481.91 و عمق حدود 901.4 میلیمتر |
| حداکثر وزن | حدود 61.4 کیلوگرم در کانفیگ کامل |
ظرفیت RAM، سرعت حافظه، نوع Backplane، درایوها، PSU، NIC، سیستمعامل، Licenseهای مدیریتی و امکانات امنیتی ممکن است در همه SKUها یکسان نباشند. پیش از ثبت سفارش، Bill of Materials نهایی باید با Product Guide و Support Matrix همان کانفیگ تطبیق داده شود.
XE8640 زمانی بیشترین ارزش را ایجاد میکند که نرمافزار مورد استفاده از GPU Acceleration و پردازش Multi-GPU پشتیبانی کند. وجود چهار H100 بهتنهایی تضمینکننده Performance بالا نیست و مسیر داده، Framework، شبکه و Storage نیز باید همراه سرور طراحی شوند.
چهار GPU مدل H100 و ارتباط NVLink، XE8640 را برای آموزش و استنتاج مدلهایی مناسب میکند که میتوانند از چند GPU داخل یک Node استفاده کنند. Machine Learning، Deep Learning، پردازش زبان طبیعی، بینایی ماشین، مدلهای توصیهگر و Fine-Tuning مدلها از سناریوهای قابل ارزیابی هستند.
تناسب نهایی به اندازه مدل، ظرفیت VRAM مورد نیاز، Precision محاسبات، Batch Size، Framework، روش Parallelism، اندازه Dataset و نرخ انتقال داده بستگی دارد. بعضی مدلها ممکن است به هشت GPU داخل یک Node یا VRAM بیشتری نیاز داشته باشند و برای XE8640 مناسب نباشند.
XE8640 برای Solverها و نرمافزارهای علمی که از CUDA و GPU Acceleration پشتیبانی میکنند مناسب است. Computational Fluid Dynamics، شبیهسازی مهندسی، محاسبات مولکولی، پردازش ژنوم، تحلیل لرزهای و مدلسازیهای عددی از کاربردهای قابل بررسی هستند.
در HPC باید مشخص شود نرمافزار مورد استفاده برای معماری NVIDIA Hopper و H100 بهینه شده است یا خیر. برخی Workloadها همچنان CPU-Bound، Memory-Bound یا وابسته به License نرمافزار هستند و ممکن است از معماری متفاوتی نتیجه بهتری بگیرند.
پردازش DataFrameهای بزرگ، تحلیل ریسک، مدلسازی مالی، GPU-Accelerated Analytics و پردازش دادههای علمی میتوانند از منابع XE8640 استفاده کنند. در این سناریوها، فرمت داده، ظرفیت RAM، سرعت Storage و پهنای باند شبکه باید همراه با GPUها Sizing شوند.
NVIDIA MIG امکان تقسیم منطقی هر GPU را برای چند Workload فراهم میکند. این قابلیت برای آزمایشگاههای تحقیقاتی، تیمهای توسعه، سرویسهای Inference و محیطهای اشتراکی مفید است؛ اما جداسازی منابع، Scheduling و مانیتورینگ باید توسط Container Platform یا Orchestrator سازگار مدیریت شود.
XE8640 زمانی انتخاب مناسبی است که سازمان نیاز مشخصی به چهار GPU مدل H100 و ارتباط یکپارچه NVLink داشته باشد. این سرور برای تمام دیتاسنترها یا تمام Workloadهای Enterprise گزینه پیشفرض نیست.
انتخاب میان سرورهای شتابیافته Dell باید بر اساس تعداد و نوع GPU، معماری Interconnect، تراکم رک، روش خنککاری و میزان انعطاف در انتخاب Accelerator انجام شود. برای شناخت معیارهای کلیتر میتوانید راهنمای انتخاب GPU Server را نیز بررسی کنید.
| مدل | فرم فکتور | معماری شتابدهنده | خنککاری شاخص | سناریوی مناسبتر |
|---|---|---|---|---|
| PowerEdge XE9640 | 2U | چهار GPU روی پلتفرم یکپارچه NVIDIA یا Intel | Direct Liquid Cooling برای CPU و GPU | تراکم بیشتر رک در دیتاسنتر مجهز به زیرساخت Liquid Cooling |
| PowerEdge XE8640 | 4U | چهار H100 SXM5 روی NVIDIA HGX با NVLink | Liquid-Assisted Air Cooling | AI و HPC مبتنی بر چهار H100 بدون Facility Water در رک |
| PowerEdge XE9680 | 6U | پلتفرمهای هشتGPU مانند NVIDIA HGX، AMD Instinct یا Intel Gaudi | Air Cooling متناسب با کانفیگ GPU-Dense | Trainingهای بزرگتر و Workloadهای نیازمند هشت Accelerator در یک Node |
| PowerEdge XE7740 | 4U | تا هشت Accelerator دواسلات یا شانزده Accelerator تکاسلات PCIe | Air Cooling | انعطاف بیشتر برای Inference، Fine-Tuning و Acceleratorهای PCIe |
اگر چهار H100 با NVLink و عدم نیاز به Facility Water اولویت دارد، XE8640 انتخاب مستقیمتری است. برای تراکم 2U و Direct Liquid Cooling باید XE9640 بررسی شود. برای هشت GPU یا Accelerator در یک Node، XE9680 گزینه مناسبتری است و برای تنوع Acceleratorهای استاندارد PCIe، XE7740 انعطاف بیشتری دارد.
خرید سرور PowerEdge XE8640 باید بر اساس یک Bill of Materials دقیق انجام شود. دو سیستم با نام XE8640 میتوانند از نظر CPU، RAM، Backplane، درایو، NIC، PSU، License مدیریتی و سطح پشتیبانی تفاوت قابلتوجهی داشته باشند.
در مستندات رسمی Dell برای اغلب مدلهای XE-Series، اجرای سرویس استقرار و آزمون زیرسامانه GPU بهعنوان بخشی از فرآیند Deployment ذکر شده است. شرایط دقیق قابل ارائه، مسئولیت نصب و الزامات گارانتی باید پیش از ثبت سفارش با تأمینکننده بررسی شوند.
XE8640 یک زیرساخت پرمصرف و Mission-Critical است. انتخاب سطح مناسب خدمات گارانتی و پشتیبانی تجهیزات آکو میتواند در برنامهریزی نگهداری، تأمین قطعات و کاهش زمان توقف سیستم نقش مهمی داشته باشد.
قیمت سرور Dell PowerEdge XE8640 باید پس از مشخص شدن نسل و مدل CPU، ظرفیت RAM، نوع Backplane و درایو، کارتهای شبکه، PSU، Licenseهای مدیریتی، خدمات نصب و سطح گارانتی اعلام شود. استعلام قیمت صرفاً بر اساس نام مدل، مبنای دقیقی برای مقایسه پیشنهادها نیست.
گزینهای 2U برای سناریوهایی که به GPUهای استاندارد PCIe و انعطاف بیشتر در انتخاب شتابدهنده نیاز دارند.
اهمیت Liquid Cooling در سرورهای نسل جدید
بررسی روشهای دفع حرارت، تفاوت خنککاری مستقیم و کمکی و الزامات استقرار سرورهای GPU-Dense.
مشاهده سرورهای PowerEdge طراحیشده برای AI، GPU Computing، Inference و HPC.
سرور Dell PowerEdge XE8640 یک پلتفرم تخصصی 4U برای AI، Machine Learning، Deep Learning و HPC است. چهار GPU مدل NVIDIA H100 SXM5، ارتباط NVLink، دو پردازنده Intel Xeon Scalable، حافظه DDR5 تا 4TB و مسیرهای توسعه PCIe Gen5، این مدل را برای Workloadهای چندGPU و پردازشهای محاسباتی سنگین مناسب میکنند.
مزیت متمایز XE8640، ارائه معماری چهارGPU NVIDIA HGX بدون نیاز به Facility Water در رک است. در مقابل، توان برق، دفع حرارت، شبکه، Storage و سازگاری Software Stack باید با دقت بررسی شوند. برای مجازیسازی عمومی، سرویسهای سبک یا پروژههایی که تنها به یک GPU استاندارد نیاز دارند، سرورهای عمومیتر ممکن است نسبت قیمت به کارایی مناسبتری ارائه دهند.
خرید سرور PowerEdge XE8640 باید پس از Sizing فنی و مشخص شدن CPU، RAM، Storage، NIC، PSU، نرمافزار، توسعه آینده و سطح پشتیبانی انجام شود؛ زیرا قیمت و Performance نهایی مستقیماً به کانفیگ و شرایط پیادهسازی وابسته هستند.
این سرور از پلتفرم NVIDIA HGX H100 با چهار GPU مدل H100 دارای حافظه 80GB، توان نامی تا 700W و فرم SXM5 استفاده میکند. GPUها از طریق NVIDIA NVLink به یکدیگر متصل هستند.
خیر. معماری رسمی XE8640 بر چهار GPU مدل NVIDIA H100 SXM5 مبتنی است و برای انتخاب آزاد GPUهای AMD یا کارتهای متنوع PCIe طراحی نشده است. برای چنین نیازی باید مدلهای GPU-Ready دیگر بررسی شوند.
خنککاری GPU از نوع Liquid-Assisted Air Cooling است و به Facility Water متصل به رک نیاز ندارد. بااینحال، ظرفیت هوای سرد، دفع حرارت، دمای ورودی و توان سرمایش دیتاسنتر باید متناسب با کانفیگ محاسبه شود.
این سرور دارای 32 اسلات DDR5 RDIMM و حداکثر ظرفیت 4TB است. Storage داخلی میتواند شامل حداکثر هشت درایو NVMe مدل 2.5 اینچی یا E3.S باشد. ظرفیت خام حداکثری اعلامشده برای برخی کانفیگهای 2.5 اینچی تا 122.88TB است.
اجرای پلتفرمهای مجازیسازی در صورت وجود پشتیبانی رسمی و Driverهای سازگار ممکن است، اما طراحی و هزینه XE8640 بر چهار GPU مدل H100 متمرکز است. برای مجازیسازی عمومی بدون نیاز به GPU، سرورهای PowerEdge متداول معمولاً اقتصادیتر هستند.
قیمت به نسل و مدل پردازنده، ظرفیت RAM، نوع Backplane و درایو، کارت شبکه، PSU، Licenseهای مدیریتی، خدمات نصب و سطح گارانتی بستگی دارد. برای اعلام قیمت دقیق باید کانفیگ و Bill of Materials نهایی تهیه شود.