کارت گرافیک RTX 4090 در ساعات بیکاری می‌تواند به‌جای بیکار ماندن، به استنتاج یک چت‌بات یا سرویس سبک پردازد. دو استارتاپ نوپا، Far Labs از ابوظبی و Evolving Edge از آستین، پلتفرم‌هایی عرضه کرده‌اند که GPUهای خانگی را برای انجام استنتاج مدل‌های هوش مصنوعی اجاره می‌دهند و خود را «اوبر/ایربی‌ان‌بی برای محاسبات استنتاج» معرفی کرده‌اند.

معماری و ابزارها

Far Labs ادعا می‌کند پلتفرمش با نام Far AI تاخیر پاسخ را به حدود 100 میلی‌ثانیه یا کمتر می‌رساند. روش آنها شامل تقسیم مدل به قطعات و پخش آنها بین چند ماشین با استفاده از یک زمان‌بندی‌کننده اختصاصی است؛ سپس ارکستراتور و لودبالانسر خروجی‌های جزئی را دوباره ترکیب می‌کنند. Evolving Edge برای توزیع کارها از چارچوب متن‌باز Ray استفاده می‌کند، همان ابزاری که در دیتاسنترها هم کاربرد دارد.

هر دو شرکت روی مدل‌های متن‌باز و نسبتاً کوچک تمرکز دارند؛ نه مدل‌های عظیم با میلیاردها پارامتر و نه پروژه‌های ماینینگ رمزارز. هدف نزدیک کردن استنتاج به کاربردهای واقعی مانند چت‌بات‌های محلی و سرویس‌های تحلیل تصویر سبک است.

  • تقسیم مدل و پردازش موازی برای کاهش تاخیر.
  • ارکستراسیون و تجمیع نتایج روی نودهای توزیع‌شده.
  • استفاده از ابزارهای متن‌باز برای سازگاری با نرم‌افزارهای محلی میزبان.
نمونه‌ای از کیس گیمینگ و کارت گرافیک RTX نصب‌شده

امنیت و حریم خصوصی

پذیرفتن بار کاری خارجی روی دستگاه شخصی مخاطراتی واقعی دارد؛ از اجرای کد مخرب تا دسترسی غیرمجاز به فایل‌ها یا سوءاستفاده از شبکه. تدابیر کلی در این پلتفرم‌ها شامل موارد زیر است:

  • اجرای فرایندهای استنتاج در محیط‌های سندباکس‌شده و جداشده از سیستم اصلی.
  • رمزنگاری ترافیک و کانال‌های ارتباطی بین نودها.
  • محدودسازی سختِ مصرف منابع: GPU، CPU، حافظه، ذخیره‌سازی و پهنای‌باند شبکه.
  • متن‌باز کردن نرم‌افزار نود تا میزبان بتواند کد را بررسی و اعتماد نسبی برقرار کند (اقدام Evolving Edge).

سودآوری و هزینه‌ها

پلتفرم‌هایی مانند Salad پیش‌تر تجربه فروش محاسبات GPU میزبان را داشتند؛ قیمت پایه برای مشتری از حدود 0.02 دلار در ساعت آغاز می‌شود، اما سهم صاحب کارت پس از کسر هزینه پلتفرم و سایر مخارج بسیار پایین است. بررسی‌های پیشین نشان داده‌اند پلتفرم‌ها بخش عمده درآمد را برداشت می‌کنند و میزبان‌ها برای جبران هزینه برق و فرسایش سخت‌افزار اغلب درآمد اندکی دارند یا حتی متحمل زیان می‌شوند.

  • یک RTX 4090 در بار کامل حدود 350–450 وات مصرف می‌کند.
  • با قیمت برق 0.15 دلار به ازای هر کیلووات‌ساعت، مصرف پیوسته کارت حدود 40–50 دلار در ماه هزینه برق ایجاد می‌کند.
  • اگر درآمد ماهانه کمتر از هزینه برق و استهلاک باشد، میزبان عملاً متضرر خواهد شد.
نمودار مصرف انرژی کارت‌های گرافیک در بار کامل

مزیت توزیع‌شده: تاب‌آوری در برابر قطعی‌های متمرکز

شبکه‌های توزیع‌شده در مقابل قطعی‌های سراسری مقاوم‌ترند؛ به‌عنوان مثال قطعی یک سرویس ابری مرکزی می‌تواند میلیون‌ها کاربر را تحت‌تأثیر قرار دهد، اما شبکه توزیع‌شده با هزاران نود می‌تواند بخش‌هایی از ظرفیت را از دست بدهد بدون اینکه عملکرد کلی به‌طور کامل مختل شود. برای مطالعه بیشتر در زمینه محاسبات توزیع‌شده می‌توانید به صفحه Distributed computing در ویکی‌پدیا مراجعه کنید.

مسائل اعتبارسنجی و نمونه‌های گمراه‌کننده

وعده‌ها جذاب‌اند اما باید با احتیاط مواجه شوند. نمونه‌هایی وجود داشته‌اند که پروژه‌ها ادعا کردند محاسبات مفیدی انجام می‌دهند، اما در عمل بارهای بی‌معنی اجرا می‌کردند. Far Labs و Evolving Edge مدعی‌اند محاسبات استنتاج مشتری را مسیر‌دهی می‌کنند؛ اما تا زمانی که ارقام واقعی درباره تاخیر، هزینه‌ها و مقیاس‌پذیری به‌صورت مستقل تأیید نشود، پذیرش این ادعاها زودهنگام خواهد بود.

معیارهای کلیدی که باید مشاهده شوند

  • اندازه‌گیری تاخیر در شرایط واقعی و با ترافیک همزمان.
  • شفافیت در محاسبات درآمدی و سهم میزبان پس از کسر هزینه‌ها.
  • آزمون‌های امنیتی و کد بررسی‌شده برای اطمینان از نبود امکان دسترسی غیرمجاز.
  • نمونه‌های عملیاتی در مقیاس که نشان دهد شبکه می‌تواند بار واقعی را تحمل کند.

نتیجه‌گیری و توصیه برای علاقه‌مندان سخت‌افزار

اگر این پلتفرم‌ها توانایی ارائه نرخ پرداختی منصفانه، شفافیت کد و کنترل دقیق مصرف انرژی را داشته باشند، تبدیل GPUهای خانگی به زیرساخت استنتاج می‌تواند برای علاقه‌مندان سخت‌افزار جذاب باشد. اما تا روشن شدن نرخ‌های پرداخت و ارائه نمونه‌های عملی در مقیاس، این مدل بیشتر یک ایده نوآورانه با ریسک اقتصادی است تا یک جریان درآمدی مطمئن.

نکات عملی برای میزبانان محتمل:

  • برآورد دقیق مصرف برق و استهلاک سخت‌افزار قبل از مشارکت.
  • بررسی متن‌باز بودن و امنیت نرم‌افزار نود ارائه‌شده.
  • مطالبه شفافیت در گزارش‌های عملکرد و پرداختی از پلتفرم.

برای دسترسی به منابع فنی بیشتر و مستندات، به Ray و سرویس‌هایی مانند Salad مراجعه کنید.

خبر و تحلیل بر پایه گزارش IEEE Spectrum و اطلاعات عمومی منتشرشده از سوی شرکت‌های مذکور آماده شده است.