
NVIDIA H200 SXM5 141GB HBM3e یکی از قدرتمندترین شتابدهندههای مبتنی بر معماری NVIDIA Hopper برای اجرای هوش مصنوعی در مقیاس دیتاسنتر است. این GPU برای AI Training، مدلهای زبانی بزرگ، Generative AI، Inference و محاسبات سنگین HPC طراحی شده است.
H200 SXM5 با 141 گیگابایت حافظه HBM3e و پهنای باند 4.8 ترابایت بر ثانیه منابع حافظهای بسیار قدرتمندی برای مدلهای بزرگ و Workloadهای حافظهمحور در اختیار سیستم قرار میدهد.
برخلاف نسخه H200 NVL که یک کارت PCIe دو اسلات است، نسخه SXM برای پلتفرمهای تخصصی دیتاسنتر مانند NVIDIA HGX H200 و سیستمهای چند GPU طراحی شده است.
| معماری GPU | NVIDIA Hopper |
| فرم فاکتور | SXM / SXM5 |
| حافظه GPU | 141GB HBM3e |
| پهنای باند حافظه | 4.8TB/s |
| FP64 | 34 TFLOPS |
| FP64 Tensor Core | 67 TFLOPS |
| FP32 | 67 TFLOPS |
| TF32 Tensor Core | تا 989 TFLOPS با Sparsity |
| FP16 / BFLOAT16 Tensor Core | تا 1,979 TFLOPS با Sparsity |
| FP8 Tensor Core | تا 3,958 TFLOPS با Sparsity |
| NVIDIA NVLink | تا 900GB/s |
| PCIe Host Interface | PCIe Gen5 تا 128GB/s |
| حداکثر TDP | تا 700 وات، قابل تنظیم |
| Multi-Instance GPU | تا 7 MIG با 18GB حافظه برای هر Instance |
| پلتفرمهای اصلی | NVIDIA HGX H200 و NVIDIA-Certified Systems |
یکی از مهمترین نقاط قوت NVIDIA H200 SXM5 استفاده از 141GB حافظه بسیار سریع HBM3e است.
ظرفیت بالای حافظه اجازه میدهد بخش بیشتری از مدل، پارامترها و دادههای موردنیاز GPU در حافظه محلی باقی بمانند و نیاز به انتقال مکرر داده کاهش پیدا کند.
پهنای باند 4.8TB/s نیز برای Workloadهایی مانند LLM، Deep Learning و HPC که به سرعت دسترسی به حافظه وابسته هستند، اهمیت بسیار زیادی دارد.
مدلهای زبانی بزرگ و سرویسهای Generative AI به ترکیبی از قدرت Tensor Core، ظرفیت بالای حافظه و ارتباط پرسرعت بین GPUها نیاز دارند.
H200 SXM5 برای Training، Fine-Tuning و Inference مدلهای هوش مصنوعی در محیطهای حرفهای طراحی شده و میتواند در کلاسترهای چند GPU برای اجرای مدلهای بسیار بزرگ استفاده شود.
NVIDIA H200 SXM از NVLink با پهنای باند تا 900GB/s بهره میبرد.
این قابلیت در سیستمهای چند GPU اهمیت ویژهای دارد؛ زیرا Training توزیعشده و اجرای مدلهایی که میان چند GPU تقسیم شدهاند به تبادل سریع داده نیاز دارند.
H200 SXM در پلتفرمهای NVIDIA HGX H200 مورد استفاده قرار میگیرد. NVIDIA سیستمهای HGX H200 را در پیکربندیهای چهار یا هشت GPU ارائه میکند.
هشت H200 با ظرفیت 141GB برای هر GPU، در مجموع بیش از 1.1 ترابایت حافظه HBM3e در اختیار پلتفرم HGX قرار میدهند؛ ظرفیتی مناسب برای AI Training و مدلهای بسیار بزرگ.
هر دو مدل دارای 141GB حافظه HBM3e و پهنای باند 4.8TB/s هستند، اما نسخه SXM برای دستیابی به حداکثر توان محاسباتی و استفاده در سیستمهای چند GPU تخصصی طراحی شده است.
H200 SXM5 تا 700 وات توان طراحی حرارتی دارد و FP8 Tensor Core آن با Sparsity تا 3,958 TFLOPS میرسد.
H200 NVL در مقابل، یک کارت PCIe دو اسلات با TDP تا 600 وات است و برای سرورهای Enterprise Air-Cooled با پیکربندی منعطفتر طراحی شده است.
این GPU دارای 141GB حافظه HBM3e با پهنای باند 4.8TB/s است.
حداکثر TDP اعلامشده برای نسخه SXM تا 700 وات و قابل تنظیم است.
خیر. H200 SXM5 یک ماژول SXM است و برای سرورها و پلتفرمهای سازگار با SXM/HGX طراحی شده است. برای فرم فاکتور PCIe باید H200 NVL را انتخاب کرد.
این GPU برای AI Training، LLM Training و Inference، Generative AI، Deep Learning، HPC و کلاسترهای پردازشی بسیار سنگین طراحی شده است.
* عملکردهای Tensor Core اعلامشده با استفاده از Sparsity محاسبه شدهاند. نوع خنکسازی و پیکربندی نهایی به سرور و پلتفرم مورد استفاده بستگی دارد.
هنوز نظری برای این محصول ثبت نشده است.
هنوز سوالی برای این محصول ثبت نشده است.

کارت گرافیک NVIDIA H200 SXM5 141GB HBM3e