NVIDIA GB200 NVL72؛ هیولای جدید برای اجرای لحظهای مدلهای تریلیونپارامتری

انویدیا با GB200 NVL72
یک «سوپرکامپیوتر در یک رک» ساخته است: اتصال 72 پردازندهی گرافیکی Blackwell بههمراه 36 پردازنده Grace در آرایش یکپارچه و مایعخنک، تا استنتاج لحظهای مدلهای تریلیونپارامتری ممکن شود. این یعنی مدلی که دیروز فقط در مراکز ابررایانه اجرا میشد،

کلید ماجرا چیست؟
- دامنه NVLink 72-GPU که مثل یک GPU بزرگ رفتار میکند و گلوگاه ارتباطی را از بین میبرد.
- Transformer Engine نسل دوم با دقتهای جدید مثل FP4 برای سرعت/بهرهوری بیشتر در LLMها.
- خنکسازی مایع رک-مقیاس برای چگالی محاسباتی بالاتر و مصرف انرژی کمتر.
اعداد که حرف میزنند
- استنتاج LLM لحظهای: 30× سریعتر از H100 (در سناریوهای واقعی).
- آموزش در مقیاس بزرگ: 4× سریعتر از H100.
- بهرهوری انرژی: 25× بهتر از زیرساخت H100 هوا-خنک.

این یعنی چه برای کسبوکار و گیم؟
برای شرکتها: اجرای مدلهای agentic و حافظه-بلند در زمان واقعی بدون مزرعههای عظیم. برای گیم: راه بازتر به رندر مولد، NPCهای هوشمند و سرویسهای ابری با تأخیر کمتر—وقتی یک رک، نقش «GPU عظیم» را بازی میکند.
جمعبندی
GB200 NVL72 نه فقط یک محصول، بلکه قالب کارخانهی هوش مصنوعی است: مقیاسپذیر، کممصرف و آمادهی تولید. اگر به آیندهی مدلهای بسیار بزرگ فکر میکنید، این رک همان سکوی پرتاب است.

دیدگاه های نامرتبط به مطلب تایید نخواهد شد.
از درج دیدگاه های تکراری پرهیز نمایید.