در حالی که بسیاری از گигانت‌های تکنولوژی در IFA برلین از «هوش مصنوعی» تنها به عنوان یک شعار بازاریابی بهره می‌برند، XPENG لایه‌های فنیِ هوش مصنوعی فیزیکی (Physical AI) را برای محصولاتی که به‌زودی به اروپا می‌رسند، گشود. جان ما، مدیر ارشد و رئیس واحد تحویل ADAS و کابین هوشمند در مناطق خارج از چین، در سخنرانی اصلی به معماری مدل VLA 2.0 تورینگ و چالش‌های اجرایی در جهان واقعی پرداخت.

محدودیت‌های سخت‌افزاری: مثلث انرژی، تأخیر و امنیت

جان ما تأکید کرد که علی‌الحاق داشتن پیشروترین قدرت پردازش صنعتی با تراشه‌های تورینگِ اختصاصی، محاسبه در برد (Onboard) همچنان در három محدودیت بنیادین گیر کرده است: مصرف انرژی پایین، تأخیر کمینه، و امنیت به عنوان پیش‌نیازِ عدم‌تقابل با مقررات قانونی. این سه ضلع، مثلثی ناگسنی برای استقرار هوش مصنوعی در خودروهای فیزیکی می‌سازند.

معماری VLA 2.0: درک زمان برای تصمیم‌گیری هوشمندتر

نکته کلیدی در نسخه ۶.۳.۰ مدل VLA 2.0، افزودن بُعد زمان به استنتاج شبکه عصبی است. این پشته تکنولوژیک از چهار لایه اصلی بر پایه تراشه تورینگ تشکیل شده:

  • Infini-VLA: بافت زمانی ۳۰ ثانیه‌ای داده‌های تاریخی برای تصمیم‌گیری‌های لحظه‌ای، با حفظ بودجه محاسبه.
  • Streaming Inference: پیش‌بینی رویدادهای نزدیک با بهبود ۳۰۰ درصدی در سرعت پاسخ‌دهی.
  • X-Foresight: مدل‌سازی آینده تا ۶ ثانیه پیش‌رو برای انتخاب مسیر بهینه.
  • Flow Matching: ترسیم چندمسیر و انتخاب بهترین ترازکتوری از میان گزینه‌ها.

این معماری اکنون در چین، بر روی خودروهای سری الترا (مجهز به سه تراشه تورینگ) و ناوگان ربات‌تاکسی فعال در گوانگژو مستقر شده است؛ برنامه گسترش پوشش برای سال آینده روی میز است.

معماری مدل VLA 2.0 تورینگ XPENG

نسخه مقطر برای تراشه‌های تک و دو تراشه‌ای

XPENG قصد دارد VLA 2.0 را به خودروهای مجهز به یک تراشه تورینگ و سپس مدل‌های قدیمی‌تر با دو تراشه NVIDIA Orin بیاورد. برای این منظور، نسخه‌ای «مقطر» (Distilled) از مدل آموزش می‌شود که بدون از دست دادن قابلیت‌های امنیتی، با بودجه محاسبه کمتر سازگاری یابد. جان ما در مصاحبه اختصاصی توضیح داد:

«اخیراً آزمایش‌های عمومی تک‌تراشه‌ای انجام دادیم و اجرای روی Orin در جریان است. امنیت خط قرمز ماست و تضمین می‌شود؛ اما روانی بودن در برخی سناریوهای پیچیده ممکن است تفاوت جزئی با نسخه اولترا (سه تراشه) داشته باشد. بازخورد کاربران را جمع‌آوری می‌کنیم و در صورت نیاز از طریق آپدیت OTA اصلاحات اعمال خواهیم کرد.»

مستر ایژنت صوتی: کنترل مکالمه‌محور کابین

اعلام مهم دیگر، کنترل صوتی مستر ایژنت (Master Agent) بود که بر پایه مدل زبان بزرگ (LLM) داخلی XPENG و تراشه سوم تورینگ در خودروهای اولترا و ربات‌تاکسی اجرا می‌شود. این سیستم از تعامل بسیار طبیعی برای کنترل توابع رانندگی هوشمند و کابین پشتیبانی می‌کند و در حال حاضر انگلیسی، ماندارین و کانتونیزه را پوشش می‌دهد؛ گسترش به زبان‌های اروپایی در نقشه‌رح قرار دارد.

نمایشگاه XPENG در IFA برلین ۲۰۲۶

استراتژی ورود به اروپا: تحویل محصول، نه فقط وعده

ارائه در IFA که مخاطب عام داشت، بر شفاف‌سازی فناوری متمرکز بود تا اعتماد خریداران اروپایی جلب شود. XPENG با ترکیبی از تراشه اختصاصی، معماری VLA مبتنی بر زمان، و رابط صوتی LLM، در پی جایگاه منحصر‌به‌فردی در بخش خودروهای خودران سطح ۴ و حمل‌ونقل هوشمند است. به‌روزرسانی‌های OTA مداوم و چرخه بازخورد کاربران، موتور اصلی تکامل این پلتفرم خواهند بود.

ربات تاکسی XPENG در گوانگژو