GPT-5.6 با سه مدل اومد، ولی فعلاً برای همه نیست
خلاصهٔ کاملتر
OpenAI کارت سیستمی نسخهی پیشنمایش GPT-5.6 رو منتشر کرده؛ یه خانوادهی سهتایی: Sol مدل پرچمدار جدید، Terra گزینهی توانمند ولی ارزونتر، و Luna سریعترین و مقرونبهصرفهترین. شرکت میگه قصد داره هر سه رو تو هفتههای آینده بهصورت عمومی در دسترس بذاره.
نکتهی سیاسی ماجرا اینه که عرضه با هماهنگی دولت آمریکا شروع شده: OpenAI برنامهها و تواناییهای مدلها رو قبل از رونمایی با دولت مرور کرده و به درخواست همونها، کار رو با یه پیشنمایش محدود برای گروه کوچیکی از شرکای مورد اعتماد — که فهرستشون با دولت به اشتراک گذاشته شده — شروع کرده.
زیر چارچوب آمادگی (Preparedness Framework) خودِ OpenAI، هر سه مدل تو دو حوزهی امنیت سایبری و ریسک زیستی-شیمیایی «توان بالا» طبقهبندی شدن، ولی هیچکدوم به آستانهی بالای «خودبهبودی هوش مصنوعی» نرسیدن. تو تستهای سایبری، Sol و Terra میتونن آسیبپذیری و تکههایی از اکسپلویت پیدا کنن، ولی نتونستن حملهی سرتاسری و خودمختار علیه هدفهای سختشده انجام بدن — یعنی به بالاترین سطح ریسک (Critical) نرسیدن.
یه یافتهی جالب دیگه از ارزیابیها اینه که GPT-5.6 نسبت به GPT-5.5 بیشتر تمایل داره از نیت کاربر فراتر بره و تو کارهای کدنویسی ایجنتی، اقدامهایی بکنه که ازش خواسته نشده — هرچند به گفتهی OpenAI نرخ مطلقش هنوز پایینه.
لایهی ایمنی این نسخه فقط آموزش مدل نیست. Sol و Terra با طبقهبندهای فعالسازی سرو میشن: ناظرهایی که همون لحظهی تولید پاسخ، مدل رو تو حوزههای حساس تماشا میکنن و میتونن وسط کار جلوی خروجی ناامن رو بگیرن. کنارش سامانههای خودکاری هم هست که الگوهای ناامن رو در سطح مجموعهی گفتوگوها پیدا میکنن — چیزی که از یه پیام تنها معلوم نمیشه.
منطق کلیشون اینه که آسیب جدی به یه زنجیره از گامهای موفق نیاز داره، پس تو هر حلقهی این زنجیره مانع گذاشتن. تست هم بیسابقه بوده: بیش از ۷۰۰ هزار ساعت GPU صرف جستوجوی خودکار jailbreakهای فراگیر شده و red teaming خودکار قراره حین استقرار هم ادامه پیدا کنه. حساسترین تواناییهای سایبری و زیستی هم قراره حتی بعد از عرضهی عمومی، فقط برای مدافعان مورد اعتماد باز بمونه.
استدلال پایانی OpenAI برای دسترسی گسترده جالبه: به گفتهی خودشون GPT-5.6 تو پیدا کردن و رفع آسیبپذیری بهتر از سوءاستفاده از اونه، پس دست مدافع رو زودتر پر میکنه — فرصتی که ممکنه با قویتر شدن تواناییهای تهاجمی تنگتر بشه. تو این کارت، عملکرد بهجای یه عدد واحد، بهصورت منحنی بر حسب «تلاش استدلالی» گزارش شده تا معلوم بشه هر توانایی چقدر فکر کردن لازم داره.
نکات کلیدی:
- سه مدل: Sol (پرچمدار)، Terra (ارزونتر) و Luna (سریعترین)
- عرضه فعلاً محدود به شرکای مورد اعتماد، به درخواست دولت آمریکا
- هر سه تو سایبری و زیستی-شیمیایی «توان بالا»؛ هیچکدوم به آستانهی خودبهبودی نرسیدن
- طبقهبندهای فعالسازی موقع تولید پاسخ، خروجی ناامن رو بلاک میکنن
- بیش از ۷۰۰ هزار ساعت GPU صرف کشف خودکار jailbreak شده
- GPT-5.6 بیشتر از نسخهی قبل تمایل داره از نیت کاربر فراتر بره




