گوگل با انتشار سه مدل جدید از خانواده هوش مصنوعی خود، فصل جدیدی از رقابت در بازار مدل‌های زبانی را آغاز کرد، اما پرچمداری که همه منتظرش بودند همچنان غایب است. این شرکت مدل‌های جمینای ۳.۶ فلش (Gemini 3.6 Flash)، نسخه ارزان‌تر و سریع‌تر ۳.۵ فلش-لایت (3.5 Flash-Lite) و ۳.۵ فلش سایبر (3.5 Flash Cyber) را معرفی کرد. مدل سایبر برای کاربردهای امنیتی بهینه‌سازی شده و در این حوزه عملکرد بهتری نسبت به مدل ۴.۶ اپوس (Opus) متعلق به شرکت آنتروپیک ارائه می‌دهد.

غیبت بارز در این رویداد، مدل پرچمدار یعنی جمینای ۳.۵ پرو (3.5 Pro) است. گوگل این مدل را در کنفرانس Google I/O در ماه مه معرفی کرد و وعده انتشار در ژوئن را داد. اکنون هفته‌ها از وعده گذشته و شرکت تنها اعلام کرده است که این مدل «در حال آزمایش با شرکا» است و «به محض آماده شدن» به طور گسترده در دسترس قرار می‌گیرد. گوگل همچنین از آغاز فرآیند پیش‌آموزش (pre-training) نسل بعدی یعنی جمینای ۴ خبر داد.

جمینای ۳.۶ فلش؛ ارتقای شایان توجه

اغلب توسعه‌دهندگان انتظار نداشتند پیش از مدل پرچمدار، نسخه جدید فلش را ببینند، اما ۳.۶ فلش یک به‌روزرسانی معنادار محسوب می‌شود. هزینه ورودی به ازای هر یک میلیون توکن همچنان 1.50 دلار است، اما گوگل قیمت خروجی را از 9 دلار به 7.50 دلار کاهش داده است.

گوگل تاکید می‌کند ۳.۶ فلش در جریان‌های کاری عامل‌محور (agentic workflows) به مراحل استدلال و فراخوانی ابزار کمتری نیاز دارد که هزینه‌های اجرایی را به شدت کاهش می‌دهد. طبق گزارش وب‌سایت Artificial Analysis، مصرف توکن در این مدل 17 درصد افت کرده است.

مقایسه عملکرد مدل‌های هوش مصنوعی جمینای 3.6 فلش و رقبا

سنجش عملکرد در بنچمارک‌ها

در اکثر بنچمارک‌ها، ۳.۶ فلش به راحتی از نسخه قبلی خود پیشی می‌گیرد، به ویژه در زمینه برنامه‌نویسی. در بنچمارک جدید مهندسی نرم‌افزار DeepSWE، این مدل امتیاز 49 درصدی کسب کرد در حالی که این رقم برای ۳.۵ فلش 37 درصد بود. با این حال، رقبا همچنان پیشتاز هستند؛ مدل کلود سونت 5 آنتروپیک 54 درصد و مدل‌های مرزی (frontier) بالای 70 درصد امتیاز می‌گیرند.

تیم گوگل همچنین شاهد پیشرفت چشمگیر در بنچمارک تحقیقات یادگیری ماشین MLE Bench (63.9 در برابر 49.7) و آزمون استفاده از کامپیوتر OSWorld-Verified (83 در برابر 78.4) بود. در کارهای دانشی، ۳.۶ فلش در معیار GDPval-AA v2 به امتیاز 1421 رسید که اگرچه بهتر از امتیاز 1349 مدل قبلی است، اما از مدل‌های میان‌رده رقبا مانند سونت 5 آنتروپیک (1600) و مدل GPT-5.6 Terra شرکت OpenAI (1581) عقب‌تر می‌ماند.

رقابت گوگل بر سر قیمت نیز پیچیده است. ۳.۶ فلش همیشه از مدل GPT 5.6 Luna پیشی نمی‌گیرد که با قیمت 1 دلار برای ورودی و 6 دلار برای خروجی در دسترس است (با محدودیت پنجره زمینه 272000 توکن). مدل سونت 5 آنتروپیک نیز تا پایان اوت با قیمت ویژه 2 دلار ورودی و 10 دلار خروجی ارائه می‌شود.

دسترسی و توزیع مدل‌های جدید

مدل‌های ۳.۶ فلش و ۳.۵ فلش لایت اکنون از طریق API جمینای در Google AI Studio و Android Studio در دسترس توسعه‌دهندگان هستند. مدل ۳.۶ فلش در ابزار کدنویسی عامل‌محور Antigravity و پلتفرم سازمانی گوگل (که پیشتر Vertex AI نامیده می‌شد) نیز قرار گرفته است. برای کاربران عادی، نسخه ۳.۵ فلش-لایت به زودی به جستجوی گوگل اضافه خواهد شد.

جمینای ۳.۵ فلش-لایت؛ مدل اقتصادی برای حجم بالا

این مدل جدیدترین نسخه پایین‌رده گوگل است. از آنجا که نسخه قبلی حدود نیم سال پیش منتشر شد، ارتقای همه‌جانبه آن دور از انتظار نیست. البته این پیشرفت با افزایش قیمت همراه بوده است؛ هزینه ورودی از 0.25 دلار به 0.30 دلار و خروجی از 1.50 دلار به 2.50 دلار به ازای هر یک میلیون توکن افزایش یافته است.

هدف این مدل ثبت رکوردهای بنچمارک نیست، بلکه برای پردازش‌های با حجم بالا مانند جستجوی عامل‌محور و پردازش اسناد طراحی شده است. با این وجود، عملکرد آن به مراتب بهتر از نسخه قبل است: امتیاز GDPval-AA v2 به 1140 (در برابر 642) و SWE-Bench Pro به 54.2 درصد (در برابر 49.6) رسیده و در OSWorld-Verified به 74 درصد دست یافته است.

گوگل با عرضه این مدل‌های میان‌رده نشان می‌دهد که در حال حاضر بر گسترش زیرساخت‌های مقیاس‌پذیر و تخصصی تمرکز دارد، اما فشار برای عرضه پرچمدار و رقیب سرسخت OpenAI همچنان پابرجاست. باید دید آیا جمینای ۴ می‌تواند فاصله ایجاد شده توسط این تاخیرها را جبران کند یا خیر.