GLM-5.3: مدل کدنویسی که امنیتکار از آب دراومد
خلاصهٔ کاملتر
ZAI مدل جدیدش GLM-5.3 رو معرفی کرده که روی همون پایهٔ ۷۴۳ میلیارد پارامتری GLM-5.2 سواره، ولی این بار پستترینینگ — یعنی مرحلهٔ آموزش تکمیلی بعد از پیشآموزش — خیلی سنگینتری روی کدنویسی و کارهای agentic گرفته؛ کارهایی که مدل باید چند مرحله پشت هم ابزار صدا بزنه و خودش جلو بره. تو این مقاله اومده که نکتهٔ جالب ماجرا فقط بالا رفتن عدد بنچمارک نیست.
ZAI مدل رو روی Terminal-Bench، Agent's Last Exam، Automation Bench و نسخهٔ ابزارمحور Humanity's Last Exam سنجیده و GLM-5.3 تقریباً همهجا بالای مدلهای open weight وایستاده و جاهایی به مدلهای بستهٔ فرانتیر هم میرسه. مهمتر از رتبه، نمودار دقت در برابر مصرف توکنه: نسبت به GLM-5.2 با توکن کمتر دقت بیشتری میگیره. یعنی تو حلقههای طولانی agent هم هزینه پایینتر میمونه هم کمتر به سقف rate limit میخوری.
بخش سروصداکنندهٔ خبر، نتایج امنیتیشه. تو پیدا کردن آسیبپذیری بهصورت white box و استدلال روی exploit و چالشهای زماندار، GLM-5.3 جهش بزرگی نسبت به ۵.۲ داشته و صدر مدلهای باز رو گرفته. به گفتهٔ ZAI این توانایی هدف اصلی آموزش نبوده و وقتی محاسبات پستترینینگ رو بیشتر کردن، سریعتر از انتظارشون رشد کرده. منطقی هم هست: دیباگ کردن یه کدبیس بزرگ و دنبال کردن مسیر یه exploit مهارتهای مشترکی دارن.
همین جهش باعث شده ZAI وزنها و دسترسی کامل API رو تا تموم شدن بررسی ایمنی داخلی نگه داره؛ نه روی Hugging Face چیزی منتشر شده نه رابط چت عمومیشون که هنوز GLM-5.2 رو اجرا میکنه. تنها راه ورود، پلن کدنویسی خود ZAIه که کاربرهای اولیه از throttle و محدودیت نرخ سنگینش شاکیان. نویسنده توصیه میکنه فعلاً صبر کنی تا وزنهای باز یا قیمتگذاری استاندارد API بیاد، بعد روی کار واقعی خودت تستش کنی.
به نظر نویسنده، GLM-5.3 نمونهٔ یه وضعیت میانیه که بین آزمایشگاههای نزدیک به فرانتیر داره عادی میشه: درآمد اشتراک لازمه تا هزینهٔ آموزش دربیاد، ولی دسترسی قفلشده یعنی محقق مستقل نمیتونه ادعاهای بنچمارک رو راستیآزمایی کنه، تیم امنیتی نمیتونه مدلی با این حد از استدلال exploit رو ممیزی کنه و کسی هم نمیتونه نسخههای کوچیکترش رو fine-tune کنه.
نکات کلیدی:
- پایهٔ مدل همون ۷۴۳ میلیارد پارامتر GLM-5.2 هست؛ تفاوت اصلی تو پستترینینگه
- تو Terminal-Bench و Agent's Last Exam صدر مدلهای open weight وایستاده
- نسبت به GLM-5.2 با توکن کمتر دقت agentic بیشتری میگیره
- وزنها و API کامل تا پایان بررسی ایمنی داخلی منتشر نمیشن
- تنها راه دسترسی فعلی، پلن کدنویسی ZAI با throttle سنگینه
- رابط چت عمومی ZAI هنوز روی GLM-5.2 کار میکنه




