مسیریاب مدل Foundry اکنون از دو منطقهٔ اولیه (East US 2 و Sweden Central) به 28 منطقه برای استقرارهای استاندارد جهانی و 21 منطقه برای استقرارهای «منطقه داده» گسترش یافته و همزمان مجموعهٔ مدلهای قابل انتخاب را بازتراز (refresh) کرده است.
چه مدلهایی اضافه یا حذف شدند؟
فهرست پشتیبانیشده حالا شامل Claude Opus 4.8 از Anthropic و خانوادهٔ GPT-5.6 است. همزمان، مدلهای gpt-5-chat، gpt-5.2-chat، gpt-5.3-chat و DeepSeek-V3.1 از چرخه خارج شدهاند.
تأثیر بر استقرارها: پیشفرضها در برابر مجموعهٔ محدود
تیمهایی که از پیکربندی پیشفرض استفاده میکنند، بهروزرسانی مجموعهٔ مدلها را بدون نیاز به اقدام دستی دریافت خواهند کرد. در مقابل، اگر مسیریابی را به یک زیرمجموعهٔ مشخص محدود کرده باشید، مدلهای جدید بهصورت خودکار به آن مجموعه اضافه نمیشوند و باید صراحتاً افزوده شوند. این رفتار عملاً مکانیزم «قفل ایمنی» را ایجاد میکند که میتواند از تغییرات ناخواسته در رفتار سرویس جلوگیری کند.
پیامدهای عملی
- در حالت پیشفرض (Balanced)، بار بین تمام مدلهای پشتیبانیشده توزیع میشود؛ بنابراین یک بار کاری ممکن است اکنون توسط مدلهایی اجرا شود که قبلاً تست نشدهاند.
- در پیکربندی زیرمجموعه، کنترل روی مدلهای فعال دقیقتر است اما نیاز به مدیریت دستی دارد.
- تغییر مدل زیربنایی میتواند سبک پاسخ، انتخاب ابزارها، توزیع تأخیر، مصرف توکن یا الگوهای خطا را تغییر دهد و در نتیجه نتایج کسبوکار را متفاوت کند.
حالات مسیریابی و زمان اعمال تغییرات
سه حالت مسیریابی اصلی وجود دارد:
- Balanced: حالت پیشفرض — تلاش برای بهینهسازی هزینه همراه حفظ کیفیت.
- Quality: مناسب برای وظایف حساس مانند بررسیهای حقوقی، گزارشهای پزشکی و استدلالهای پیچیده.
- Cost: مناسب وظایف حجمی و ساده مانند دستهبندی و پرسشوپاسخ پایه.
تغییر حالت یا تغییر زیرمجموعه معمولاً ظرف حداکثر 5 دقیقه اعمال میشود.
محدودیتها و نکات فنی کلیدی
نکات فنی که باید در برنامهریزی و آزمون در نظر گرفته شوند:
- پنجرهٔ مؤثر کانتکست: مسیریاب از کوچکترین پنجرهٔ مدلهای زیرین استفاده میکند؛ افزودن مدلی با پنجرهٔ کوچکتر میتواند ظرفیت ورودی همهٔ درخواستها را کاهش دهد.
- تصمیمگیری مبتنی بر متن: ورودیهای تصویری ممکن است پذیرفته شوند اما تصاویر در تصمیمگیری مسیریاب نقشی ندارند و صوت پشتیبانی نمیشود.
- هزینهٔ اضافی مسیریاب: مسیریاب هزینهٔ پرامپت خود را جداگانه و بر بالای هزینهٔ مدل زیربنایی محاسبه میکند؛ هر ادعای کاهش هزینه باید این مارکاپ را لحاظ کند.
- پیشنیاز برای مدلهای Anthropic: مدلهای Claude باید بهطور جداگانه در همان حساب Foundry و با SKU منطبق مستقر شوند تا مسیریاب بتواند آنها را انتخاب کند؛ صرف وجود نام در فهرست پشتیبانی به معنی در دسترس بودن نیست و در نبود استقرار مناسب با خطای
InvalidResourcePropertiesمواجه خواهید شد.
منطقهبندی، انطباق و پرسشهای باز
مایکروسافت گسترش مناطق را عمدتاً از منظر انطباق مطرح کرده است؛ برخی مشتریان الزام دارند که درخواستهای استنتاج در محدودهٔ جغرافیایی خاصی نگه داشته شوند. هنوز روشن نیست که وقتی مدلی که مسیریاب میتواند انتخاب کند در آن مرز در دسترس نباشد، مسیریاب چگونه عمل خواهد کرد: آیا به مدل جایگزین منطقهای رجوع میکند یا درخواست را رد میکند؟
همچنین سازوکار هماهنگی فهرست ناشران مجاز (Microsoft و ناشر هر مدل) با سطح جدید AI Gateway در Azure که مدلها را پشت سیاستهای زمان اجرا قرار میدهد، در مستندات عمومی بهروشنی توضیح داده نشده است. برای بررسیهای بیشتر دربارهٔ خدمات AI مایکروسافت میتوانید به صفحهٔ رسمی Azure AI مراجعه کنید.
توصیههای عملی برای تیمها
- در صورت حساسیت خروجیها، مجموعهٔ مسیریابی را به زیرمجموعهٔ مشخص محدود کنید و هر مدل جدید را پیش از فعالسازی آزمون نمایید.
- پیش از ارزیابی صرفهجویی هزینه یا افزایش پنجرهٔ کانتکست، تأثیر افزودن مدلهای با پنجرهٔ کوچکتر را بررسی کنید.
- برای استفاده از Claude Opus 4.8، آن را جداگانه با SKU منطبق در همان حساب Foundry مستقر کنید.
جمعبندی و چشمانداز
گسترش مناطق عملیاتی و بهروزرسانی مجموعهٔ مدلها دسترسی و گزینهها را افزایش میدهد، اما مدیریت فعال سیاستهای مسیریابی، معیارهای کیفیت و محدودیتهای انطباق را ضروری میکند. شفافیت بیشتر دربارهٔ تعامل AI Gateway با مسیریاب و معیارهای سنجش تأثیر مدلهای جدید بر نتایج کسبوکار برای تصمیمگیری سازمانی ضروری است.
منابع مرتبط: صفحهٔ عمومی Microsoft و معرفی Anthropic در Wikipedia. برای مقایسههای مرتبط به مطلب داخلی GPT-5.6 در برابر Fable 5 مراجعه کنید.





