انویدیا حافظهٔ سفارشی NVHBM را برای شرکای برنامهٔ NVLink Fusion معرفی کرد. این استک حافظه وعده می‌دهد نسبت به HBM4e مرسوم تا ۳۰٪ پهنای باند بیشتر و ۱۵٪ مصرف برق کمتر فراهم کند.

  • چه چیزی تغییر می‌کند: کنترل‌کنندهٔ حافظه و بخشی از رابط فیزیکی (PHY) به داخل استک حافظه منتقل شده و به‌قول انویدیا فضای بسته‌بندی روی دی‌-ای‌سی اصلی آزاد می‌شود.
  • مخاطب اصلی: شرکای سیلیکون که از اتصال‌پذیری NVLink Fusion بهره می‌برند و به طراحی‌های چندچیپی و بسته‌بندی پیشرفته نیاز دارند.

NVHBM چیست و چطور کار می‌کند

NVHBM یک دی‌بیس سفارشیِ مبتنی بر معماری HBM است که کنترل‌کنندهٔ حافظه و بخشی از PHY را داخل استک حافظه می‌برد. با این روش، PHY روی دی‌-ای‌سی اصلی کوچکتر می‌شود و فضای بیشتری برای بلوک‌های محاسباتی آزاد می‌گردد. برای آشنایی فنی بیشتر می‌توانید به صفحات High-bandwidth memory و NVLink مراجعه کنید.

مزایای کلیدی NVHBM

  • پهنای باند بالاتر: هر استک NVHBM در مقایسه با HBM4e استاندارد تا ۳۰٪ پهنای باند بیشتر فراهم می‌کند؛ نتیجهٔ مستقیم برای بارهای کاری محدود به پهنای باند، افزایش نرخ توکن‌برثانیه در استنتاج مدل‌های بزرگ است.
  • مصرف برق کمتر: NVHBM حدود ۱۵٪ مصرف انرژی کمتری نسبت به استک‌های مرسوم HBM4e دارد؛ این بهبود می‌تواند عملکرد بر وات را ارتقا دهد یا توان آزادشده را برای واحدهای محاسباتی بیشتر اختصاص دهد.
  • کاهش ردپای مدار روی دی-ای-سی اصلی: انتقال کنترل‌کننده به دی‌بیس، فضای بسته‌بندی را باز می‌کند و انویدیا می‌گوید امکان افزودن تا ۳۰٪ مساحت محاسباتی بیشتر فراهم می‌شود.
  • سادگی مسیردهی و بسته‌بندی: NVHBM مسیردهی روی اینترپوزر را تسهیل می‌کند که برای طراحی‌های چندچیپی و بسته‌بندی‌های پیشرفته اهمیت دارد.

دسترسی محدود و دلیل اختصاصی‌سازی

NVHBM قرار نیست جایگزین HBM تجاری شود؛ این یک بلوک سازندهٔ سفارشی است که تنها در چارچوب برنامهٔ NVLink Fusion در اختیار شرکای سیلیکون قرار می‌گیرد. هدف کوتاه‌تر کردن مسیر توسعه و ورود به بازار برای تولیدکنندگان چیپ‌های سفارشی است، به‌ویژه آن‌هایی که به مزایای اتصال مقیاس‌پذیر NVLink نیاز دارند.

همکاری Amazon Annapurna Labs و مسیر پیش‌رو

آمازون از طریق واحد Annapurna Labs اولین شریک اعلام‌شدهٔ NVHBM است. نفئا بشاره، معاون Annapurna، این همکاری را گامی در جهت ارتقای طراحی‌های زیرساختی آتی AWS توصیف کرده است. چیپ‌های نسل بعدی Trainium 4 از پیش پشتیبانی از رابط NVLink Fusion را اعلام کرده‌اند، بنابراین انتظار منطقی این است که نسل‌های آتی این چیپ‌ها از NVHBM نیز پشتیبانی کنند.

نمای مفهومی NVHBM و بسته‌بندی HBM

کاربرد برای دیتاسنترها و شتاب‌دهنده‌های هوش مصنوعی

در مراکز داده با صدها یا هزاران شتاب‌دهنده، هر درصد صرفه‌جویی در توان یا افزایش پهنای باند می‌تواند به کاهش قابل‌توجه هزینهٔ کلی مالکیت (TCO) منجر شود. NVHBM برای انتقال وزن‌های مدل، کش‌های KV و پردازش ساختارهای دادهٔ بزرگ طراحی شده تا کارایی داده‌پردازی را بالا ببرد و مصرف انرژی را کاهش دهد.

ملاحظات و محدودیت‌ها

  • هم‌اکنون NVHBM تنها برای شرکای NVLink Fusion در دسترس است؛ استفادهٔ عمومی یا تجاری گستردهٔ آن مانند HBM4e در کوتاه‌مدت محتمل نیست.
  • افزایش پهنای باند و کاهش مصرف انرژی در عمل بستگی به طراحی کلی سیستم، اینترپوزر و نوع بار کاری خواهد داشت؛ ارقام اعلام‌شده می‌تواند در پیاده‌سازی‌های مختلف متفاوت باشد.
  • سازگاری با زنجیرهٔ تامین حافظه و پذیرش تولیدکنندگان حافظه از عوامل کلیدی در تعیین سرعت گسترش این فناوری خواهند بود.

تحلیل بازار

اعلام NVHBM نشان می‌دهد انویدیا فراتر از طراحی شتاب‌دهنده به مدیریت لایه‌های بسته‌بندی و حافظه می‌پردازد تا کنترل بیشتری روی بهینه‌سازی عملکرد بر وات و توان طراحی‌شده داشته باشد. اگر پذیرش توسط شرکا گسترده شود، این رویکرد می‌تواند در شکل‌دهی معماری نسل بعدی شتاب‌دهنده‌ها و مراکز داده تأثیرگذار باشد.

در ماه‌های آتی باید منتظر جزئیات فنی بیشتر و نمونه‌های عملیاتی از سمت شرکا ماند؛ با این حال، پهنای باند و کارایی انرژی همچنان معیارهای تعیین‌کننده در رقابت برای شتاب‌دهنده‌های هوش مصنوعی خواهند بود.