GPT-5.6 Sol صدرنشین لیدربورد طراحی وب شد
خلاصهٔ کاملتر
تیم Design Arena مدل GPT-5.6 Sol رو روی آرنای طراحی وب (نسخهٔ غیرایجنتیک) بنچمارک کرده و به گفتهٔ خودشون غافلگیر شدن: این مدل کل جدول رو برده، ۱۸ پله بالاتر از GPT-5.5 وایستاده و اولین باره که یه مدل OpenAI اول این لیدربورد میشه. دو مرز پارتوی جدید هم ساخته، یکی ترجیح در برابر سرعت و یکی ترجیح در برابر قیمت: بیشتر از ۲.۴۴ برابر سریعتر از GLM 5.2 (صدرنشین قبلی) و ۳۶ درصد سریعتر از Claude Fable 5، با قیمت ۵ و ۳۰ دلار به ازای هر یک میلیون توکن در برابر ۱۰ و ۵۰ دلار.
یافتهٔ اصلی مقاله اینه که Sol آنتیپترنهای طراحی AI رو میشناسه و فعالانه سرکوبشون میکنه. تیم امبدینگهای CLIP هزار وبسایت تولیدشده رو با UMAP تصویر کرده تا «منیفلد طراحی» مدل رو ببینه؛ یعنی همون ناحیهای از فضای امبدینگ که خروجیهای مدل توش میشینن.
نتیجهای که به گفتهٔ نویسندهها شوکهشون کرده، حفرههای عجیب توی این زیرفضاست. مدلهای دیگه معمولاً چنین حفرههایی ندارن، چون طرحهاشون شبیه چیزیست که قبلاً ساختن و تنوع فقط از خود پرامپت میآد. برای فهمیدن اینکه داخل این حفرهها چیه، خروجیهای Sol و GPT-5.5 رو تو یه فضا روی هم انداختن: تنها خوشهای که این دو اصلاً همپوشانی ندارن، خوشهٔ سایتهای با گرادیان بنفش بود. همین الگو برای بنتوباکس، تایپفیسهای غولپیکر بهجای هیرو ایمیج و چیدمانهای آفست هم دیده میشه.
نویسندهها میگن این مسیر با بقیه فرق داره. مثلاً GLM-5.2 با یاد گرفتن مجموعهای از قالبها که اصلاً این الگوها توشون نیست از آنتیپترن فرار میکنه، برای همین حفرهای هم تو فضاش ساخته نمیشه. ولی انگار Sol این الگوها رو یاد گرفته و از تولیدشون امتناع میکنه.
البته این خویشتنداری همهجا تعمیم پیدا نکرده: به گفتهٔ گزارش، Sol بدجوری کانفتی رو زیادی استفاده میکنه — تو بیش از ۲۶.۵ درصد خروجیها — و حتی وقتی کتابخونهای در اختیارش نباشه، خودش یکی برای کانفتی مینویسه. تو ساخت چارت و مصورسازی داده هم ضعیفتره، چون با chart.js نمودار واقعگرایانه خوب درنمیآره.
سیگنال دوم «قالبسازی» ـه. مدلهای سطح مرزی معمولاً با یاد گرفتن چند قالب پرامتیاز، ادای سلیقهٔ طراحی رو درمیآرن؛ همون کاری که GLM 5.2 رو اول کرده بود. نقطهٔ مقابلش Claude Fable 5 ـه که طبق این تحلیل تقریباً هیچ قالبسازی نداره و هر خروجی رو شخصیسازی میکنه. Sol این دوتا رو قاطی میکنه: از قالب استفاده میکنه ولی داخل هر خوشه اونقدر تغییرش میده که تنوع بسازه — تشبیه مقاله، انشعاب باکتری به سویههای ژنتیکی خویشاونده.
جمعبندی مقاله اینه که برتری Sol از انتخابگرتر و انطباقپذیرتر بودن همزمان میآد: فهمیده کدوم الگوهای بصری باعث میشن یه سایت «AI-زده» به نظر برسه و سرکوبشون میکنه، ولی همزمان چند ساختار قابلاتکا رو نگه داشته و برای هر پرامپت سفارشیشون میکنه. یه ضعف جانبی هم داره: برای کاربردهای مختلف مدام از یه تصویر استفاده میکنه.
نکات کلیدی:
- رتبهٔ اول آرنای طراحی وب غیرایجنتیک، ۱۸ پله بالاتر از GPT-5.5
- ۲.۴۴ برابر سریعتر از GLM 5.2 و ۳۶ درصد سریعتر از Claude Fable 5، با قیمت ۵/۳۰ دلار بر میلیون توکن
- حفرههای منیفلد طراحی نشون میده مدل گرادیان بنفش و بنتوباکس رو عمداً نمیسازه
- برخلاف GLM-5.2 که این الگوها رو یاد نگرفته، Sol یادشون گرفته ولی تولیدشون نمیکنه
- ضعفها: کانفتی تو بیش از ۲۶.۵٪ خروجیها و چارتهای ضعیف با chart.js
- ترکیب قالب و شخصیسازی، حد وسط بین GLM 5.2 و Claude Fable 5




