
NVIDIA H200 NVL 141GB HBM3e یک GPU و شتابدهنده حرفهای دیتاسنتر مبتنی بر معماری NVIDIA Hopper است که برای اجرای مدلهای زبانی بزرگ، Generative AI، هوش مصنوعی سازمانی، Inference، Deep Learning و محاسبات HPC طراحی شده است.
H200 NVL با قرار دادن 141 گیگابایت حافظه HBM3e در یک طراحی دو اسلات PCIe، امکان استفاده از قدرت خانواده H200 را در سرورهای سازمانی Air-Cooled فراهم میکند.
پهنای باند حافظه فوقالعاده 4.8 ترابایت بر ثانیه یکی از مهمترین مزایای این GPU است و به سیستم اجازه میدهد حجم بسیار زیادی از داده را با سرعت بالا میان حافظه و واحدهای پردازشی جابهجا کند.
| معماری | NVIDIA Hopper |
| حافظه GPU | 141GB HBM3e |
| پهنای باند حافظه | 4.8TB/s |
| FP64 | 30 TFLOPS |
| FP64 Tensor Core | 60 TFLOPS |
| FP32 | 60 TFLOPS |
| TF32 Tensor Core | تا 835 TFLOPS با Sparsity |
| FP16 / BFLOAT16 Tensor Core | تا 1,671 TFLOPS با Sparsity |
| FP8 Tensor Core | تا 3,341 TFLOPS با Sparsity |
| فرم فاکتور | PCIe دو اسلات، Passive / Air-Cooled |
| PCI Express | PCIe Gen5 تا 128GB/s |
| NVIDIA NVLink | پشتیبانی از Bridge دو یا چهار GPU، تا 900GB/s برای هر GPU |
| حداکثر TDP | تا 600 وات، قابل تنظیم |
| Multi-Instance GPU | تا 7 MIG با 16.5GB حافظه برای هر Instance |
| NVIDIA AI Enterprise | اشتراک پنجساله NVIDIA AI Enterprise همراه محصول |
مدلهای هوش مصنوعی مدرن، بهخصوص Large Language Model یا LLM، تنها به قدرت پردازشی نیاز ندارند؛ ظرفیت حافظه و سرعت دسترسی به داده نیز نقش بسیار مهمی دارند.
وجود 141GB حافظه HBM3e باعث میشود بخش بزرگی از مدل، پارامترها، KV Cache و دادههای موردنیاز مستقیماً در حافظه GPU قرار گیرد. در نتیجه H200 NVL برای سرویسهای LLM Inference، RAG و Generative AI یک راهکار دیتاسنتری بسیار قدرتمند محسوب میشود.
یکی از تفاوتهای اساسی H200 NVL با نسخه SXM، فرم فاکتور آن است. H200 NVL بهصورت یک کارت PCIe دو اسلات طراحی شده و برای سرورهای Enterprise سازگار با GPUهای Passive مناسب است.
این موضوع برای مجموعههایی که قصد دارند زیرساخت AI خود را بدون مهاجرت مستقیم به پلتفرمهای HGX توسعه دهند، انعطافپذیری بیشتری ایجاد میکند.
در پروژههایی که یک GPU کافی نیست، H200 NVL در پیکربندیهای سازگار از NVLink Bridge دو یا چهار GPU پشتیبانی میکند.
اتصال چهار H200 NVL میتواند مجموع ظرفیت حافظه GPUها را به 564GB HBM3e برساند؛ ظرفیتی بسیار بالا برای مدلهای حجیم و Workloadهای سازمانی AI.
هر دو مدل دارای 141GB حافظه HBM3e و پهنای باند 4.8TB/s هستند، اما برای زیرساختهای متفاوتی طراحی شدهاند.
H200 NVL یک کارت PCIe دو اسلات با TDP تا 600 وات است، در حالی که H200 SXM5 از فرم فاکتور SXM استفاده میکند، تا 700 وات توان دارد و برای سیستمهای پرقدرت HGX و ارتباط GPU-to-GPU در مقیاس بالا طراحی شده است.
NVIDIA H200 NVL دارای 141GB حافظه HBM3e با پهنای باند 4.8TB/s است.
بله. این مدل یک کارت دو اسلات PCIe بوده و از PCIe Gen5 پشتیبانی میکند.
بله. ظرفیت بالای HBM3e و پهنای باند بسیار زیاد حافظه، H200 NVL را به یک GPU حرفهای برای LLM Inference، RAG و Generative AI تبدیل کرده است.
خیر. این محصول یک شتابدهنده تخصصی دیتاسنتر برای AI و HPC است و برای کامپیوترهای گیمینگ طراحی نشده است.
* عملکردهای Tensor Core اعلامشده با استفاده از Sparsity محاسبه شدهاند. مشخصات نهایی پلتفرم ممکن است بر اساس سازنده سرور و پیکربندی سیستم متفاوت باشد.
هنوز نظری برای این محصول ثبت نشده است.
هنوز سوالی برای این محصول ثبت نشده است.

کارت گرافیک NVIDIA H200 NVL 141GB HBM3e PCIe