مایکروسافت و AMD رسماً از برنامه‌های خود برای استقرار گسترده شتاب‌دهنده مقیاس رک Helios در مراکز داده Azure خبر دادند. این سیستم که از ۷۲ GPU نسل بعدی Instinct MI455X تشکیل شده، گامی بلند در جهت رقابت با زیرساخت‌های انویدیا محسوب می‌شود و قرار است توان محاسباتی بی‌سابقه‌ای را برای بارهای کاری هوش مصنوعی در اختیار مشتریان ابری قرار دهد.

جزئیات شتاب‌دهنده Helios و مشخصات فنی

سیستم Helios به‌گونه‌ای طراحی شده که مستقیماً با Nvidia Vera Rubin NVL72 رقابت کند. این شتاب‌دهنده با تجمیع ۷۲ GPU از سری Instinct MI455X، مجموعاً ۳۱٫۱ ترابایت حافظه HBM4 را در خود جای داده است. عملکرد آن در محاسبات FP8 به ۱٫۴ اگزافلاپس و در FP4 به ۲٫۹ اگزافلاپس می‌رسد که برای مدل‌های پیشرفته هوش مصنوعی کاملاً حیاتی است.

نمایش تصویری از شتاب‌دهنده مقیاس رک Helios شرکت AMD

پهنای باند مخصوص ارتباطات درون‌رک (scale-up) نیز ۲۶۰ ترابایت بر ثانیه اعلام شده که با سیستم انویدیا برابری می‌کند. در بخش ارتباطات بین رک (scale-out)، AMD از ۴۳ ترابایت بر ثانیه پهنای باند از طریق UALink روی اترنت بهره می‌برد که تقریباً دو برابر ورا رابین است؛ هرچند عملکرد عملی این فناوری هنوز در میدان آزمایش نشده است.

مقیاس استقرار و اهمیت استراتژیک

هرچند مایکروسافت و AMD رقم دقیق سرمایه‌گذاری یا مصرف برق این استقرار را اعلام نکرده‌اند، اما این همکاری گویای اعتماد روزافزون غول نرم‌افزاری به سخت‌افزارهای سرخ‌خانواده AMD است. این دومین پیروزی بزرگ AMD پس از عقد قراردادهای مشابه با OpenAI و متا در سال گذشته محسوب می‌شود که ارزش آنها به صدها میلیارد دلار می‌رسد.

مایکروسافت از Helios هم برای بارهای کاری داخلی خود و هم برای ارائه سرویس به مشتریان Azure AI استفاده خواهد کرد. شرکت‌ها و آزمایشگاه‌های هوش مصنوعی می‌توانند از این زیرساخت برای آموزش مدل‌های پیشرفته و همچنین استنتاج استفاده کنند. سرویس Microsoft Foundry نیز از این توان محاسباتی برای مشتریان سازمانی بهره خواهد برد.

ماشین‌های مجازی جدید بر پایه Epyc Venice

در کنار استقرار Helios، Azure میزبان دو سری ماشین مجازی تازه مبتنی بر پردازنده‌های نسل ششم Epyc Venice خواهد بود. سری HDv2 برای بارهای کاری «هوش مصنوعی عاملی و خطوط لوله داده» و سری HXv2 برای طراحی نیمه‌هادی و شبیه‌سازی‌های پیشرفته طراحی شده‌اند. این ماشین‌های مجازی گزینه‌های قدرتمندی را در اختیار مهندسان و داده‌دانان قرار می‌دهند.

لوگوی AMD و مشخصات پردازنده Epyc Venice

نقش DPUهای Pensando در Azure Boost

مایکروسافت همچنین از DPUهای AMD Pensando که پیشتر در زیرساخت خود مستقر کرده، برای تقویت سرویس Azure Boost استفاده خواهد کرد. این فناوری با تسریع عملیات شبکه و ذخیره‌سازی، تأخیر را کاهش داده و عملکرد کلی سیستم‌های ابری را بهبود می‌بخشد. ادغام Pensando با Azure Boost نشان‌دهنده عمق همکاری مایکروسافت و AMD فراتر از صرفاً GPU است.

جایگاه AMD در بازار GPUهای دیتاسنتر

با این اعلام، AMD گام مهمی در جهت گرفتن سهم بازار از انویدیا در حوزه دیتاسنتر برداشته است. هرچند AMD هنوز فاصله زیادی با غول سبز دارد، اما استقبال غول‌های فناوری مانند مایکروسافت، OpenAI و متا نشان می‌دهد که مشتریان به دنبال تنوع‌بخشی به زنجیره تأمین و کاهش وابستگی به یک فروشنده هستند. زمان نشان خواهد داد که آیا Helios می‌تواند انتظارات را برآورده کند و رقابت را در این عرصه داغ‌تر سازد.

انتظار می‌رود جزئیات بیشتری درباره برنامه‌های AMD در همین هفته در رویداد «پیشبرد هوش مصنوعی» این شرکت اعلام شود. باید دید آیا AMD می‌تواند با محصولات جدید خود، معادلات بازار را تغییر دهد یا خیر.