رد پای Ox Alpha: مدل مرموز OpenRouter از خانوادهٔ GLM درومد
خلاصهٔ کاملتر
مدل ناشناسی به اسم Ox Alpha از ۲۰ آگوست روی OpenRouter بالا اومد، با این توضیح که یه ارائهدهندهٔ ثالث ساخته و اجراش میکنه. تیم CTGT مستقل از حدسهای جامعه رفت سراغ fingerprinting رفتاری (یعنی شناسایی هویت یه مدل از روی رفتار و خروجیهاش، نه کد و وزنهاش) و به همون نتیجهای رسید که بقیه هم رسیده بودن: این مدل از خانوادهٔ GLM-5 هست. جالب اینکه خود مدل یه system prompt داره که بهش گفته هیچی از منشأش لو نده.
روش کارشون شمردن توکن بود. یازده پروب مختلف (پاراگراف چینی، تایی، کرهای، عربی، ارقام عدد پی، CJK جدا، ایموجی، انگلیسی، توکنهای نادر و کد) رو فرستادن و اختلاف prompt_tokens رو اندازه گرفتن؛ هر ۱۱ تا با واژگان GLM-5.x جور درومد. پروبهای تایی و ایموجی از همه مهمتر بودن، چون دقیقاً همونجاییه که واژگان GLM موقع رفتن از ۴.x به ۵.x گسترش پیدا کرده.
نشونههای خود API هم همین رو تأیید میکنه. سقف temperature دقیقاً ۱.۰ هست و ۱.۰۱ خطا میده، که Google و OpenAI و xAI رو کنار میذاره چون اونها تا ۲.۰ اجازه میدن، ولی با بازهٔ مستندشدهٔ Zhipu میخونه. top_k از ۱ تا ۱۰۰۰۰۰ قبول میشه که OpenAI رو رد میکنه، reasoning اجباریه و با effort: none خطای ۴۰۰ میگیری، و کد خطای داخلیاش هم همونیه که مدلهای GLM میزبانیشده روی Z.AI برمیگردونن.
اما بخش جذابتر تحقیق سانسوره. CTGT مدل رو با LineageEval سنجید، ابزاری که جفتسؤالهای متناظر میسازه تا بیمیلی مدل به یه موضوع خاص رو از طفرهرفتن کلیاش جدا کنه. نتیجه اینه که سانسور Ox Alpha یه کلیده، نه یه شیب: میانگین نمرهاش ۷.۴۲ه که ۷.۳۹ واحدش فقط از ۷ موضوع حساس میاد و ۶۸ جفت باقیمونده عملاً هیچی بهش اضافه نمیکنن.
این شکل با DeepSeek V4 Flash فرق داره که تقریباً همهجا یهکم سانسور میکنه. روی شی جینپینگ و مشروعیت داخلی، Ox Alpha از نظر آماری از V4 Flash قابل تفکیک نیست، ولی روی شینجیانگ و تایوان دقیقاً مثل GPT-OSS-120B جواب میده و حتی منابعی رو نقل میکنه که تو چین جنجالیان. چون بیشتر ممیزیهای سانسور دور همین موضوعهای موردتوجه خارجی چیده شدن، به گفتهٔ CTGT این مدل تو اون تستها تمیز به نظر میرسه، در حالی که سانسورش روی ریسک سیاسی داخلی متمرکزه.
نکات کلیدی:
- تطابق ۱۱ از ۱۱ پروب توکنایزر با واژگان GLM-5.x
- سقف temperature دقیقاً ۱.۰ و اجباریبودن reasoning، منطبق با مدلهای thinking خانوادهٔ GLM-5.x
- از میانگین سانسور ۷.۴۲، سهم ۷ موضوع حساس ۷.۳۹ و سهم ۶۸ جفت دیگه تقریباً صفره
- ۵ تا از ۷۶ پاسخ حساس با لحن رسمی دولتی چین شروع میشن
- سه پاسخ با برچسب refusal، completion token هم حساب کردن؛ یه پرامپت رد شده با درخواست مجدد جواب کامل داد
- context یکمیلیونی و چندوجهی، با یه wrapper پنهان حدوداً ۸۸ توکنی روی هر درخواست




