مدلهای چینی چقدر به آمریکا نزدیک شدن؟
خلاصهٔ کاملتر
به گفتهٔ نویسنده، جواب کوتاه به این سؤال که چین داره فاصله رو کم میکنه یا نه اینه: تا حدی و ناهموار. ارزیابی دولتی CAISI مدل DeepSeek V4 Pro رو در مجموع حدود هشت ماه عقبتر از مدل پیشروی آمریکایی دیده، ولی روی بنچمارکهای تکی این فاصله کوچیک یا صفر میشه. همین ناهمواری داستان اصلیه؛ نه یه «مدل چینی» واحد وجود داره نه یه «مدل آمریکایی» واحد، و مقایسهٔ درست کاملاً به تسکی که تست میکنی بستگی داره.
پنج اسم مدام تکرار میشن. DeepSeek روی اقتصاد اینفرنس بهینه شده: V4 Pro با ۱٫۶ تریلیون پارامتر کل، خروجی رو حدود ۸۷ سنت بهازای هر میلیون توکن قیمت میده. Qwen بیشتر یه خانوادهست تا یه مدل، از مدلهای کوچیکِ محلی تا خط بسته و میزبانیشدهٔ Max. GLM 5.2 با لایسنس MIT روی کدنویسی طولانی قویه ولی چکپوینت BF16 اون حدود ۱٫۵ ترابایته. Kimi K3 هم با ۲٫۸ تریلیون پارامتر و کانتکست یکمیلیون توکنی، پرمیوم قیمت خورده: حدود ۱۵ دلار برای هر میلیون توکن خروجی.
«وزنباز» هم یه خاصیت واحد نیست، یه بستهٔ سؤاله: میتونی از API صداش کنی؟ وزنها واقعاً دانلودشدنیان؟ لایسنس کاربردِ تو رو مجاز میدونه؟ سختافزارت با طول کانتکست و سرعتی که میخوای از پسش برمیاد؟ Kimi K3 قبل از اینکه وزنهاش دانلودشدنی باشه وزنباز خونده شد، و لایسنس MiniMax M3 بالای ۲۰ میلیون دلار درآمد اجازهٔ کتبی میخواد و کاربرد نظامی رو ممنوع کرده.
معماری mixture-of-experts توضیح میده چرا یه مدل میتونه همزمان از راه API ارزون و روی سختافزار شخصی غیرعملی باشه؛ پارامترهای فعال هزینهٔ محاسبهٔ هر توکن رو تعیین میکنن ولی پارامتر کل هنوز حافظه و ذخیرهسازی رو میبلعه. مهمتر اینکه CAISI بهجای قیمت روی برچسب، هزینهٔ هر تسکِ درستحلشده رو اندازه گرفته و نتیجه بین ۵۳ درصد ارزونتر تا ۴۱ درصد گرونتر از پایهٔ آمریکایی نوسان داشته، چون مدل ارزون گاهی استدلال طولانیتر یا تلاش دوباره لازم داره.
توصیهٔ عملی نویسنده اینه که سه تصمیم رو از هم جدا کنی: تسک، مدل و مسیر استقرار. برای کار حجیم و قابلبازبینی مثل استخراج، دستهبندی یا تولید تست، DeepSeek ارزش تستکردن داره؛ برای کار محلی سراغ مدلهای کوچیک Qwen برو؛ و برای دادهٔ حساس، اول تعیین کن داده کجا میتونه بره. برای قضاوتهای مبهم و پرریسک هم هنوز قویترین مدلهای آمریکایی همون خط پایهان که باید ازشون جلو بزنی.
نکات کلیدی:
- CAISI فاصلهٔ کلی DeepSeek V4 Pro با مدل پیشروی آمریکایی رو حدود هشت ماه برآورد کرده
- قیمت خروجی DeepSeek حدود ۸۷ سنت در هر میلیون توکن، در برابر ۱۵ دلار Kimi K3
- هزینهٔ هر تسکِ درستحلشده بین ۵۳ درصد ارزونتر تا ۴۱ درصد گرونتر از پایهٔ آمریکایی بوده
- «وزنباز» از GLM با لایسنس MIT تا لایسنس سفارشی MiniMax M3 معنیهای خیلی متفاوتی داره
- Kimi K3 متهم به دیستیلکردن از مدلهای آنتروپیک شده و آنتروپیک از استخراج ۱۶ میلیون مکالمه خبر داده




