گوگل به‌صورت ناگهانی و بدون اعلام رسمی نسخه‌ای جدید از مدل باز Gemma 4 منتشر کرده که اصلاحات مهمی در عملکرد، ثبات و قابلیت‌های پردازش تصویر شامل می‌شود. این به‌روزرسانی «پنهانی» (Stealth Update) همچنان تحت نام «گمّا ۴» منتشر شده و باعث انتقادات جامعه توسعه‌دهندگان شده است.

افزایش چشمگیر سرعت با Flash Attention ۴

بر اساس اعلام گوگل، فعال‌سازی Flash Attention ۴ روی پردازنده‌های گرافیکی Nvidia Hopper (H100 و H200) سرعت پردازش توکن‌های پیش‌فرآیند (Prompt Processing) را بین ۲۵ تا ۷۰ درصد بهبود بخشیده است. همچنین زمان تولید اولین توکن (Time to First Token) تا ۳۱ درصد کاهش یافته است. این پیشرفت مستقیماً بر تجربه کاربری در برنامه‌های چت‌بات و ایجنت‌های هوشمند تأثیر می‌گذارد.

رفع باگ‌های حیاتی: فراخوانی ابزار و قطع پاسخ‌ها

دو مشکل اصلی که توسعه‌دهندگان را دچار گਸ਼ می‌کرد برطرف شده‌اند:

  • باگ‌های Tool Calling: مدل اکنون قابل‌اعتمادتر در فراخوانی توابع خارجی (Function Calling) و استفاده از APIها عمل می‌کند.
  • پاسخ‌های کوتاه‌شده (Truncated Responses): گوگل اعلام کرده احتمال قطع ناگهانی متن‌های طولانی یا خروجی‌های ناقص به‌شکل قابل‌توجهی کاهش یافته است.

بهبود پردازش تصویر: OCR دقیق‌تر و رزولوشن بالاتر

برای وظایو بینایی‌محور، پارامتر max_soft_tokens از پیش‌فرض ۲۸۰ به ۱۱۲۰ قابل‌افزایش است. این تغییر به مدل اجازه می‌دهد تا:

  • نتایج OCR (تشخیص نویسه) دقیق‌تر و خواناتر تولید کند.
  • تصاویر تا رزولوشن ۲.۵۱ مگاپیکسل را پردازش نماید.

گوگل یک پیکربندی‌کننده تعاملی در هاگینگ‌فیس قرار داده تا توسعه‌دهندگان بتوانند این پارامترها را به‌سادگی تست و تنظیم کنند.

همه اندازه‌های پارامتر به‌روزرسانی شده‌اند

اگرچه معیارهای (Benchmarks) منتشرشده تنها مدل‌های ۳۱B و E4B را با پیشین‌هایشان مقایسه کرده‌اند، اما بررسی مخزن رسمی Hugging Face گمّا ۴ نشان می‌دهد که تمام اندازه‌های این نسل — از جمله reciente منتشرشده ۱۲B — Gewicht‌های جدید دریافت کرده‌اند.

واکنش جامعه: چرا نسخه ۴.۱ منتشر نشد؟

انتشار این اصلاحات مهم تحت همان برچسب «گمّا ۴» (بدون تگ‌گذاری نسخه مانند v4.1 یا 4.0.1) موجی از انتقاد در گیتهاب، ردیت و هاگینگ‌فیس را برانگیخت. توسعه‌دهندگان معتقدند این روش:

  • پیچیدگی مدیریت نسخه (Versioning) و وابستگی‌ها را برای برنامه‌های تولیدی بالا می‌برد.
  • تکرارپذیری آزمایش‌ها (Reproducibility) را دشوار می‌سازد.
  • با اصول SemVer و راهنمای مدل‌های باز تضاد دارد.

گوگل تا لحظه نگارش این خبر توضیح رسمی درباره استراتژی نسخه‌بندی جدیدی نداده است.

خلاصه تغییرات کلیدی

ویژگی تغییر
سرعت پیش‌فرآیند (Hopper + FlashAttn-4) +۲۵٪ تا ۷۰٪
زمان تا اولین توکن -۳۱٪
ثبات Tool Calling بازیابی شده
کاهش پاسخ‌های ناقص به‌مرور کاهش یافته
max_soft_tokens (تصویر) ۲۸۰ → ۱۱۲۰ (اختیاری)
پشتیبانی رزولوشن تصویر تا ۲.۵۱ مگاپیکسل

آیا شما نیز از گمّا ۴ در پروژه‌هایتان استفاده می‌کنید؟ تجربه‌تان از این به‌روزرسانی پنهانی چطور است؟ در بخش نظرات به اشتراک بگذارید.