ای‌ام‌دی شرکت کانادایی Taalas را تصاحب کرد. Taalas مدل‌های هوش مصنوعی را مستقیماً در سیلیکون تعبیه می‌کرد تا فرایند استنتاج را با تأخیر کمتر و عملکرد بالاتر انجام دهد.

آنچه خریده شد و اهمیتش

Taalas که در تورنتو و در سال 2023 تأسیس شد، رویکردی متفاوت ارائه داد: معماری مدل و پارامترهای آموزش‌دیده را به‌صورت فیزیکی داخل تراشه قرار می‌دهد. نمونه نمایشی این شرکت نشان داد روی مدل Llama 3.1-8B می‌توان بیش از 16,000 توکن بر ثانیه به‌ازای هر کاربر پردازش کرد؛ عملکردی که به‌طور قابل‌توجهی از بسیاری از راهکارهای مرسوم سریع‌تر است.

مزایا و محدودیت‌های مدل‌درون‌تراشه

  • مزایا: تأخیر بسیار پایین، مصرف انرژی بهینه‌تر در عملیات استنتاج خاص و توان بالاتر در پردازش همزمان کاربران.
  • محدودیت‌ها: هر تراشه معمولاً به یک مدل یا معماری مشخص وابسته می‌شود؛ به‌روزرسانی مدل یا تغییر معماری مستلزم طراحی مجدد سیلیکون یا تعویض سخت‌افزار است.
نمای گرافیکی تراشه Taalas و تعبیه مدل‌های هوش مصنوعی

ادغام فناوری در راهکار سطح‌سیستم ای‌ام‌دی

ای‌ام‌دی اعلام کرده فناوری Taalas را در نقشه‌راه شتاب‌دهنده‌های خود ادغام خواهد کرد و آن را در کنار GPUهای Instinct به‌عنوان بخشی از یک راهکار سطح‌سیستم عرضه می‌کند. به‌گفته وامسی بوپانا، نایب‌رئیس بخش هوش مصنوعی ای‌ام‌دی، این اقدام مجموعه قابلیت‌های شرکت در حوزه هوش مصنوعی را تقویت می‌کند.

واکنش استارتاپ و رقابت

لیوبیشا باییچ، یکی از بنیان‌گذاران Taalas، می‌گوید ای‌ام‌دی مقیاس و دسترسی لازم را فراهم می‌کند تا فناوری در مراکز داده و محصولات تجاری گسترده‌تر عرضه شود. در همین حال گزارش‌هایی از توسعه تراشه‌ای مشابه توسط گوگل برای خانواده Gemini حکایت دارد که رقابت در بازار شتاب‌دهنده‌های مختص استنتاج را تشدید می‌کند.

پیامدها برای دیتاسنترها و توسعه‌دهندگان

ترکیب تراشه‌های مدل‌درون‌تراشه با GPUهای عمومی امکان اجرای هدفمندتر مدل‌ها را فراهم می‌کند؛ برای مثال:

  • استفاده از شتاب‌دهنده‌های درون‌تراشه برای مدل‌های پرتقاضا و ثابت که نیاز به تأخیر بسیار پایین دارند.
  • استفاده از GPUهای قابل‌برنامه‌ریزی برای مدل‌های پویا، قابل به‌روزرسانی یا چندمنظوره.
  • تعیین ترکیب مناسب براساس نیازهای هزینه، تأخیر و انعطاف‌پذیری نرم‌افزاری.

چالش‌های اجرایی

  • به‌روزرسانی مدل‌ها: تراشه‌های قفل‌شده فرایند آپدیت و نگهداری را پیچیده می‌کنند.
  • امنیت و حاکمیت: نگهداری پارامترها داخل سخت‌افزار پرسش‌هایی درباره امنیت زنجیره تأمین و کنترل دسترسی ایجاد می‌کند.
  • اقتصاد مقیاس: موفقیت تجاری فناوری وابسته به قیمت تمام‌شده تولید و پذیرش توسط اپراتورهای بزرگ ابر است.

گام بعدی و وضعیت معامله

تصاحب Taalas مشروط به تصویب نهادهای نظارتی است. در صورت نهایی‌شدن معامله، انتظار می‌رود طی ماه‌های آینده شاهد معرفی محصولات ترکیبی باشیم که GPUهای Instinct را با شتاب‌دهنده‌های مدل‌درون‌تراشه برای کاربردهای استنتاجی مشخص ترکیب کنند.

این اقدام نشان می‌دهد تولیدکنندگان سخت‌افزار به دنبال تعریف مرز جدیدی میان طراحی سیلیکون و نرم‌افزار مدل هستند؛ مرزی که می‌تواند نحوه استقرار و مدل پرداخت در خدمات هوش مصنوعی را تغییر دهد.