دیپسیک V4 Pro 0813: نزدیک فرانتیر، با کسری از قیمت
خلاصهٔ کاملتر
دیپسیک نسخهٔ کامل V4 Pro 0813 رو بعد از پیشنمایش آوریل، بدون رویداد و تقریباً بدون مستندات رسمی روی API فعال کرد — که تقریباً همیشه سبک عرضهٔ این شرکته. مشخصاتی که تو جامعهٔ کاربری میچرخه از مدلی با ۱٫۶ تریلیون پارامتر، ۴۹ میلیارد پارامتر فعال و پنجرهٔ کانتکست یکمیلیونتوکنی حرف میزنه، ولی خود دیپسیک این عددها رو تأیید نکرده، پس باید به چشم اطلاعات غیررسمی نگاهشون کرد.
روی Terminal Bench 2.1 نمرهش از ۷۲٫۱ در پیشنمایش به ۸۷٫۹ رسیده و عملاً پابهپای Fable 5 با ۸۸ و Kimi K3 با ۸۸٫۳ حرکت میکنه. تو دو بنچمارک هم صدرنشینه: Cyberjim با ۸۳٫۳ و Automation Bench با ۳۱٫۸. تو HLE بدون ابزار ۴۲٫۷ و با ابزار ۶۰ گرفته که از Fable 5 عقبتره، و تو تسکهای ریپومحور هم Opus 4.8 جلو میمونه. الگوی کلی اینه که تقریباً همهجا چند نمره پایینتر از فرانتیره و جاهایی هم میبره.
چیزی که مدل رو سختقابلچشمپوشی میکنه قیمتشه: حدود ۴۳ سنت برای هر میلیون توکن ورودی و ۸۷ سنت برای خروجی، در برابر ۱۰٫۵ دلار Fable 5 — به روایت تسترهای مستقل نزدیک ۵۷ برابر ارزونتر برای کارایی مشابه. تو یه بنچمارک مستقل هشتسؤالی هم ۶۱ از ۸۰ یعنی ۷۶٫۲۵٪ گرفته؛ درست بالای GLM 5.2 و برادر کوچیکترش V4 Flash و کمی پایینتر از Kimi K3 و Opus 5. پیشنمایش V4 Pro تو همین تست فقط ۲۴٫۸٪ گرفته بود.
تو تستهای دستی، فرانتاند و برنامهریزی تسک نقطهقوت مدل بودن؛ ساعت مچی سهبعدی ۷ از ۱۰ گرفت که بالاترین نمرهٔ ثبتشده روی اون تسته، ولی تصویر SVG پاندا با ۵ از ۱۰ نقطهضعف روشنیه. نویسنده میگه مدل روی مسئلههای ساده بیشازحد فکر میکنه و گاهی همین جواب رو بدتر میکنه، و تمایل داره بیشتر از چیزی که خواستی کد رو بازنویسی کنه؛ برای کارهای روزمره V4 Flash انتخاب بهتریه. یه عادت خوبش هم اینه که وقتی پرامپت مبهمه بهجای حدس زدن سؤال میپرسه.
نکات کلیدی:
- Terminal Bench 2.1 از ۷۲٫۱ به ۸۷٫۹؛ صدرنشین Cyberjim و Automation Bench
- قیمت حدود ۴۳ سنت ورودی و ۸۷ سنت خروجی بهازای هر میلیون توکن
- بنچمارک مستقل: ۶۱ از ۸۰ معادل ۷۶٫۲۵٪، در برابر ۲۴٫۸٪ پیشنمایش آوریل
- مشخصات ۱٫۶ تریلیون پارامتری و کانتکست یکمیلیونی هنوز رسمی تأیید نشده
- ضعفها: زیادهفکری روی تسک ساده و بازنویسی بیشازحد کد




