گوگل از Gemini 3.6 Flash و دو مدل تازه رونمایی کرد
خلاصهٔ کاملتر
گوگل تو این اعلامیه سه مدل جدید از خانوادهٔ Gemini Flash رو معرفی کرده. منطق پشت این سری هم صریح بیان شده: تیم میگه توسعهدهندههایی که ایجنتهای واقعی و در مقیاس تولید میسازن، بیشتر از هر چیز به بهرهوری توکن، تأخیر کم و عملکرد قابلاتکا نیاز دارن، نه لزوماً به بزرگترین مدل ممکن.
مدل اصلی، Gemini 3.6 Flash، مستقیم روی بازخورد کاربران ۳.۵ Flash ساخته شده. جالبترین ادعا دربارهٔ بهرهوریه: طبق ایندکس Artificial Analysis این مدل ۱۷٪ توکن خروجی کمتری مصرف میکنه و تو بعضی بنچمارکها مثل DeepSWE این کاهش تا ۶۵٪ هم دیده شده. ضمناً برای کارهای چندمرحلهای به گامهای استدلال و فراخوانی ابزار کمتری نیاز داره.
این بهرهوری با قیمت پایینتر هم همراه شده: ۱.۵ دلار بهازای هر یک میلیون توکن ورودی و ۷.۵ دلار برای هر یک میلیون توکن خروجی، که در مجموع هزینهٔ هر «کار ایجنتی» رو پایین میآره.
از نظر کیفیت هم گوگل چند عدد داده: دقت بالاتر و ویرایشهای ناخواستهٔ کمتر تو کد (DeepSWE ۴۹٪ در برابر ۳۷٪)، جهش تو تحقیقات یادگیری ماشین (MLE Bench ۶۳.۹٪ در برابر ۴۹.۷٪)، و بهبود در کار با کامپیوتر (OSWorld-Verified ۸۳.۰٪ در برابر ۷۸.۴٪). خودِ «استفاده از کامپیوتر» حالا بهعنوان یه ابزار داخلی سمت کلاینت تو Gemini API در دسترسه. مشتریهایی مثل Hebbia و Harvey هم گفتن تو کارهای چندوجهی مثل تجزیهٔ اسناد و تحلیل نمودار خوب جواب داده.
مدل دوم، Gemini 3.5 Flash-Lite، برای کارهای کمتأخیر و پرحجم ساخته شده؛ چیزهایی مثل جستوجوی ایجنتی و پردازش انبوه اسناد. سریعترین مدل این سریه با ۳۵۰ توکن خروجی بر ثانیه و قیمت ۰.۳ دلار ورودی و ۲.۵ دلار خروجی بهازای هر میلیون توکن. توسعهدهنده میتونه سطح «تفکر» مدل رو تنظیم کنه: حداقلی برای کارهای انبوه و ارزون، یا بالاتر برای بارهای چندمرحلهای زیرایجنتها. جالب اینکه تو خیلی از ارزیابیهای کدنویسی از مدل بزرگتر نسل قبل (۳ Flash) هم جلو زده، مثلاً SWE-Bench Pro ۵۴.۲٪ در برابر ۴۹.۶٪.
مدل سوم، Gemini 3.5 Flash Cyber، داستان متفاوتی داره. گوگل میگه مدلهای هوش مصنوعی حالا سریعتر از اونی که سیستمهای فعلی بتونن وصله کنن آسیبپذیری پیدا میکنن، و این مدل روی ۳.۵ Flash فاینتیون شده تا آسیبپذیریها رو با هزینهٔ توکن کمتری نسبت به مدلهای بزرگتر پیدا و رفع کنه. داخل ایجنت CodeMender، چند نمونه از این مدل با هم کار میکنن و یه گزارش واحد تولید میکنن.
بهخاطر ماهیت دووجهی این فناوری، انتشارش عمداً محدود شده: Flash Cyber فقط از طریق CodeMender و در قالب یه برنامهٔ آزمایشی با دسترسی محدود در اختیار دولتها و شرکای مورد اعتماد قرار میگیره تا مدافعان جلوتر از مهاجمها باشن. مدل ۳.۶ Flash هم با محافظتهای تقویتشدهٔ Frontier Safety در حوزههای CBRN و حملات سایبری عرضه شده که به گفتهٔ گوگل مقاومتش در برابر جیلبریک رو بهطور محسوسی بالا برده، ضمن اینکه آموزش دیده تا برای کاربردهای مفید کمتر درخواستها رو رد کنه.
دو مدل ۳.۶ Flash و ۳.۵ Flash-Lite از همون روز برای توسعهدهندهها در Gemini API و AI Studio، برای سازمانها در پلتفرم Gemini Enterprise و برای عموم تو اپ Gemini در دسترسن. گوگل همزمان خبر داده Gemini 3.5 Pro در حال آزمایش با شرکاست و مهمتر اینکه بلندپروازانهترین دور پیشآموزش تاریخشون برای Gemini 4 شروع شده.
نکات کلیدی:
- ۳.۶ Flash با ۱۷٪ توکن خروجی کمتر و قیمت پایینتر (۱.۵ و ۷.۵ دلار بهازای هر میلیون توکن ورودی/خروجی)
- بهبود محسوس در کد، تحقیقات ML و کار با کامپیوتر؛ computer use حالا ابزار داخلی Gemini API ـه
- ۳.۵ Flash-Lite سریعترین مدل سری با ۳۵۰ توکن بر ثانیه و سطح تفکر قابل تنظیم
- Flash-Lite تو چند بنچمارک از مدل بزرگتر نسل قبل هم جلو زده
- ۳.۵ Flash Cyber برای یافتن و وصلهٔ آسیبپذیریها، فقط برای دولتها و شرکای منتخب از طریق CodeMender
- Gemini 3.5 Pro در حال آزمایش با شرکاست و پیشآموزش Gemini 4 شروع شده




