بر اساس گزارشهای جدید، شرکت متا در حال سفارشیسازی شتابدهندههای هوش مصنوعی AMD Instinct سری MI450 برای کاهش چشمگیر هزینههای خود است. این نسخه اختصاصی، که بر اساس تحلیلهای منتشرشده در SemiAnalysis ارائه شده، تنها به 144 گیگابایت حافظه HBM4 مجهز خواهد شد؛ یعنی یکسوم ظرفیت نسخه کامل MI455X. هدف از این اقدام، بهینهسازی سختافزار صرفاً برای سیستمهای توصیهگر فیسبوک و سایر پلتفرمهای اجتماعی این شرکت است.
کاهش حافظه و بهینهسازی برای سیستمهای توصیهگر
نسخه استاندارد Instinct MI455X از 432 گیگابایت حافظه HBM4 با پهنای باند 19.6 ترابایت بر ثانیه بهره میبرد، اما نسخه سفارشی متا با استفاده از شش بسته 8-Hi، تنها 144 گیگابایت حافظه دریافت میکند. گزارشها حاکی از آن است که توان محاسباتی این نسخه نیز افت قابلتوجهی را تجربه کرده است.
این کاهش ظرفیت ممکن است در نگاه اول یک عقبگرد به نظر برسد، اما برای متا یک استراتژی مالی محسوب میشود. حافظههای HBM4 بهشدت گرانقیمت هستند و کاهش حجم از 432 به 144 گیگابایت، صورتحساب مواد (BOM) را بهشدت پایین میآورد. کوچکتر شدن اندازه بسته شتابدهنده و کاهش مصرف برق هنگام اجرای کارهای توصیهگر، مزایای جانبی این طراحی هستند. اگر متا این سختافزار را صرفاً برای سیستمهای توصیهگر بهکار بگیرد، کل هزینه مالکیت (TCO) آن بهطور قابلتوجهی بهبود مییابد و میتواند دهها میلیون دلار صرفهجویی ایجاد کند.
- کاهش هزینههای BOM: حذف دوسوم حافظه HBM4 باعث کاهش چشمگیر قیمت تمامشده سختافزار میشود.
- بهینهسازی انرژی: عملکرد مطلوب در اجرای کارهای هدف با مصرف برق بسیار کمتر.
- تعادل بهتر CPU/GPU: طراحی متناسب با نیازهای خاص سیستمهای توصیهگر شبکههای اجتماعی.
چالش انعطافپذیری و تکیه بر سختافزار انویدیا
بزرگترین نقطه ضعف این شتابدهندههای اختصاصی، از دست رفتن انعطافپذیری است. کاهش توان محاسباتی و حافظه باعث میشود این سختافزار برای آموزش مدلهای زبانی بزرگ (LLM) و اجرای استنتاج جذابیت خود را از دست بدهد. حافظه 144 گیگابایتی برای پردازش مدلهای زبانی مدرن بهشدت محدودکننده است.
مشکل قابلیت تعویضپذیری در مراکز داده
یک شتابدهنده با کاربرد عام مانند MI455X میتواند از سیستمهای توصیهگر به آموزش مدل یا استنتاج تغییر کاربری دهد. اما نسخه تخصصی متا خارج از محدوده کاری مورد نظرش عملاً بیفایده است. اگر تقاضای محاسباتی متا در آینده به سمت آموزش مدلهای هوش مصنوعی متمایل شود، این شرکت با انبوهی از سختافزارهای تخصصی مواجه خواهد شد که برای کارهای جدید مناسب نیستند.
به همین دلیل، بخش هوش مصنوعی پیشرفته متا همچنان به سمت سیستمهای کامل AMD Instinct MI455X یا پلتفرمهای ردهبالای انویدیا گرایش خواهد داشت. نکته جالب توجه این است که تلاش متا برای کاهش هزینهها با سفارشیسازی سختافزار ایامدی، ممکن است بخش پیشرفته این شرکت را مجبور کند تا شتابدهندههای همهکاره بیشتری را از انویدیا خریداری کند.
توافق استراتژیک 6 گیگاواتی متا و ایامدی
این گزارشها در راستای توافق پیشین میان AMD و متا مطرح میشوند. بر اساس این قرارداد، AMD طی پنج سال آینده 6 گیگاوات شتابدهنده هوش مصنوعی Instinct را به متا عرضه خواهد کرد. هر دو شرکت تأیید کردهاند که بخشی از این سختافزارها نسخههای اختصاصی خواهند بود. اکنون مشخص میشود که این سختافزارهای سفارشی تنها برای مجموعه محدودی از کارها طراحی شدهاند و قرار نیست جایگزین همهکارهها در زیرساختهای آموزش مدلهای پیشرفته شوند. این استراتژی دوگانه نشان میدهد که غولهای فناوری دیگر به دنبال یک سختافزار واحد برای تمام نیازهای خود نیستند و رویکرد تخصصیسازی در مراکز داده در حال شکلگیری است.





