بر اساس گزارش‌های جدید، شرکت متا در حال سفارشی‌سازی شتاب‌دهنده‌های هوش مصنوعی AMD Instinct سری MI450 برای کاهش چشمگیر هزینه‌های خود است. این نسخه اختصاصی، که بر اساس تحلیل‌های منتشرشده در SemiAnalysis ارائه شده، تنها به 144 گیگابایت حافظه HBM4 مجهز خواهد شد؛ یعنی یک‌سوم ظرفیت نسخه کامل MI455X. هدف از این اقدام، بهینه‌سازی سخت‌افزار صرفاً برای سیستم‌های توصیه‌گر فیس‌بوک و سایر پلتفرم‌های اجتماعی این شرکت است.

کاهش حافظه و بهینه‌سازی برای سیستم‌های توصیه‌گر

نسخه استاندارد Instinct MI455X از 432 گیگابایت حافظه HBM4 با پهنای باند 19.6 ترابایت بر ثانیه بهره می‌برد، اما نسخه سفارشی متا با استفاده از شش بسته 8-Hi، تنها 144 گیگابایت حافظه دریافت می‌کند. گزارش‌ها حاکی از آن است که توان محاسباتی این نسخه نیز افت قابل‌توجهی را تجربه کرده است.

شتاب‌دهنده هوش مصنوعی AMD Instinct

این کاهش ظرفیت ممکن است در نگاه اول یک عقب‌گرد به نظر برسد، اما برای متا یک استراتژی مالی محسوب می‌شود. حافظه‌های HBM4 به‌شدت گران‌قیمت هستند و کاهش حجم از 432 به 144 گیگابایت، صورت‌حساب مواد (BOM) را به‌شدت پایین می‌آورد. کوچک‌تر شدن اندازه بسته شتاب‌دهنده و کاهش مصرف برق هنگام اجرای کارهای توصیه‌گر، مزایای جانبی این طراحی هستند. اگر متا این سخت‌افزار را صرفاً برای سیستم‌های توصیه‌گر به‌کار بگیرد، کل هزینه مالکیت (TCO) آن به‌طور قابل‌توجهی بهبود می‌یابد و می‌تواند ده‌ها میلیون دلار صرفه‌جویی ایجاد کند.

  • کاهش هزینه‌های BOM: حذف دو‌سوم حافظه HBM4 باعث کاهش چشمگیر قیمت تمام‌شده سخت‌افزار می‌شود.
  • بهینه‌سازی انرژی: عملکرد مطلوب در اجرای کارهای هدف با مصرف برق بسیار کمتر.
  • تعادل بهتر CPU/GPU: طراحی متناسب با نیازهای خاص سیستم‌های توصیه‌گر شبکه‌های اجتماعی.

چالش انعطاف‌پذیری و تکیه بر سخت‌افزار انویدیا

بزرگترین نقطه ضعف این شتاب‌دهنده‌های اختصاصی، از دست رفتن انعطاف‌پذیری است. کاهش توان محاسباتی و حافظه باعث می‌شود این سخت‌افزار برای آموزش مدل‌های زبانی بزرگ (LLM) و اجرای استنتاج جذابیت خود را از دست بدهد. حافظه 144 گیگابایتی برای پردازش مدل‌های زبانی مدرن به‌شدت محدودکننده است.

مشکل قابلیت تعویض‌پذیری در مراکز داده

یک شتاب‌دهنده با کاربرد عام مانند MI455X می‌تواند از سیستم‌های توصیه‌گر به آموزش مدل یا استنتاج تغییر کاربری دهد. اما نسخه تخصصی متا خارج از محدوده کاری مورد نظرش عملاً بی‌فایده است. اگر تقاضای محاسباتی متا در آینده به سمت آموزش مدل‌های هوش مصنوعی متمایل شود، این شرکت با انبوهی از سخت‌افزارهای تخصصی مواجه خواهد شد که برای کارهای جدید مناسب نیستند.

مدیریت زیرساخت هوش مصنوعی متا

به همین دلیل، بخش هوش مصنوعی پیشرفته متا همچنان به سمت سیستم‌های کامل AMD Instinct MI455X یا پلتفرم‌های رده‌بالای انویدیا گرایش خواهد داشت. نکته جالب توجه این است که تلاش متا برای کاهش هزینه‌ها با سفارشی‌سازی سخت‌افزار ای‌ام‌دی، ممکن است بخش پیشرفته این شرکت را مجبور کند تا شتاب‌دهنده‌های همه‌کاره بیشتری را از انویدیا خریداری کند.

توافق استراتژیک 6 گیگاواتی متا و ای‌ام‌دی

این گزارش‌ها در راستای توافق پیشین میان AMD و متا مطرح می‌شوند. بر اساس این قرارداد، AMD طی پنج سال آینده 6 گیگاوات شتاب‌دهنده هوش مصنوعی Instinct را به متا عرضه خواهد کرد. هر دو شرکت تأیید کرده‌اند که بخشی از این سخت‌افزارها نسخه‌های اختصاصی خواهند بود. اکنون مشخص می‌شود که این سخت‌افزارهای سفارشی تنها برای مجموعه محدودی از کارها طراحی شده‌اند و قرار نیست جایگزین همه‌کاره‌ها در زیرساخت‌های آموزش مدل‌های پیشرفته شوند. این استراتژی دوگانه نشان می‌دهد که غول‌های فناوری دیگر به دنبال یک سخت‌افزار واحد برای تمام نیازهای خود نیستند و رویکرد تخصصی‌سازی در مراکز داده در حال شکل‌گیری است.