انویدیا با GB200 NVL72

یک «سوپرکامپیوتر در یک رک» ساخته است: اتصال 72 پردازنده‌ی گرافیکی Blackwell به‌همراه 36 پردازنده Grace در آرایش یکپارچه و مایع‌خنک، تا استنتاج لحظه‌ای مدل‌های تریلیون‌پارامتری ممکن شود. این یعنی مدلی که دیروز فقط در مراکز ابررایانه اجرا می‌شد،

رک NVIDIA GB200 NVL72 با طراحی مایع‌خنک برای اجرای مدل‌های تریلیون‌پارامتری
GB200 NVL72؛ رک یکپارچه با 72 GPU نسل Blackwell و 36 CPU Grace.

کلید ماجرا چیست؟

  • دامنه NVLink 72-GPU که مثل یک GPU بزرگ رفتار می‌کند و گلوگاه ارتباطی را از بین می‌برد.
  • Transformer Engine نسل دوم با دقت‌های جدید مثل FP4 برای سرعت/بهره‌وری بیشتر در LLMها.
  • خنک‌سازی مایع رک-مقیاس برای چگالی محاسباتی بالاتر و مصرف انرژی کم‌تر.

اعداد که حرف می‌زنند

  • استنتاج LLM لحظه‌ای: 30× سریع‌تر از H100 (در سناریوهای واقعی).
  • آموزش در مقیاس بزرگ: 4× سریع‌تر از H100.
  • بهره‌وری انرژی: 25× بهتر از زیرساخت H100 هوا-خنک.
آیکون معماری Blackwell انویدیا با ترانزیستورهای پرشمار و اتصال بین‌تراشه‌ای
معماری Blackwell: موتور نسل جدید استنتاج و آموزش LLM.

این یعنی چه برای کسب‌وکار و گیم؟

برای شرکت‌ها: اجرای مدل‌های agentic و حافظه‌-بلند در زمان واقعی بدون مزرعه‌های عظیم. برای گیم: راه بازتر به رندر مولد، NPCهای هوشمند و سرویس‌های ابری با تأخیر کمتر—وقتی یک رک، نقش «GPU عظیم» را بازی می‌کند.

جمع‌بندی

GB200 NVL72 نه فقط یک محصول، بلکه قالب کارخانه‌ی هوش مصنوعی است: مقیاس‌پذیر، کم‌مصرف و آماده‌ی تولید. اگر به آینده‌ی مدل‌های بسیار بزرگ فکر می‌کنید، این رک همان سکوی پرتاب است.