یکسوم توکنهای پروداکشن دست مدلهای متنباز افتاده
خلاصهٔ کاملتر
ورسل هر ماه از دادهٔ AI Gateway — که دهها تریلیون توکن رو بین اپهای پروداکشن و آزمایشگاههای هوش مصنوعی جابهجا میکنه — یه گزارش منتشر میکنه. نسخهٔ جولای، دادهٔ ژوئن ۲۰۲۶ رو پوشش میده: حجم توکن ۲۹٪ و هزینه ۲۷٪ نسبت به ماه قبل رشد کرده، ولی قیمت هر توکن بعد از جهش تقریباً ۲۰ درصدی ماه مه، این بار ثابت مونده.
تیم ورسل توضیح میده که این ثبات، حاصل خنثیشدن دو نیروی مخالفه: از یه طرف سهم مدلهای ارزون متنباز بالا رفته که باید میانگین رو پایین میکشید، از طرف دیگه قیمت مدلهای فرانتیر بسته حدود ۱۲٪ برای هر توکن بالا رفته. نتیجهش شده الگویی که گزارش ماه قبل هم نشونش داده بود: کار پرحجم میره سراغ مدل ارزون، کار پرریسک روی مدل فرانتیر میمونه.
پررنگترین عدد گزارش مال مدلهای open-weight ـه: ۲۹٪ کل توکنها با کمتر از ۴٪ کل هزینه، یعنی تقریباً یکسوم توکنها با یکبیستوپنجم دلارها. سهم این مدلها از آوریل تا حالا تقریباً سه برابر شده و DeepSeek با ۲۲.۶٪ حالا سومین منبع توکن روی گیتویه، کمتر از دو واحد پشت گوگل. حدود یک نفر از هر هشت مشتری سازمانی، یه مدل متنباز رو تو پروداکشن اجرا میکنه.
تازهوارد این دوره GLM 5.2 از Z.ai بوده؛ یه مدل متنباز با لایسنس MIT که برای کارهای ایجنتیک طولانی ساخته شده و حدود یکپنجم قیمت Opus 4.8 ـه. از ۱۶ ژوئن تا آخر ماه، حجم توکن روزانهش حدود ۵۰ برابر شده و تو هفتهٔ آخر به رتبهٔ یازدهم گیتوی رسیده — سریعترین جابهجایی داخلخانوادگی که ورسل تا حالا ثبت کرده.
در سمت هزینه، تصویر کاملاً برعکسه. چهار آزمایشگاه فرانتیر آمریکایی ۹۵٪ کل خرج ژوئن رو گرفتن و سهم Anthropic بهتنهایی ۶۱٪ هزینه روی ۳۲٪ توکنهاست؛ تو پرمخاطرهترین کاربردها یعنی ایجنتهای کدنویسی، ایجنتهای پشتیبانی داخلی و تولید اپ، این سهم به ۷۲٪ یا بالاتر میرسه. سهم توکن OpenAI از ۱۲.۵٪ به ۱۰.۳٪ افتاده ولی سهم هزینهش بالا رفته، یعنی مشتریها کار کمتر ولی گرونتری بهش میدن.
تو هر مدالیته یه بازیگر متفاوت جلوئه. تو تصویر، خانوادهٔ GPT Image از OpenAI ۵۳٪ تصویرها رو ساخته و Nano Banana گوگل حدود ۳۹٪. تو ویدیو، Grok Imagine از xAI با ۴۲٪ بیشترین تعداد ویدیو رو تولید کرده ولی فقط ۱۹٪ هزینه رو گرفته، در حالی که Seedance از بایتدنس با یکسوم حجم، ۴۹٪ خرج رو برده. رویهمرفته آزمایشگاههای چینی حدود دوسوم دلارهای ویدیو رو گرفتن.
گزارش به ماجرای Claude Fable 5 هم اشاره میکنه: این مدل ۹ ژوئن منتشر شد و تو چهار روز به ۲۲ درخواست بهازای هر ۱۰۰ درخواست Opus 4.8 رسید، ولی ۱۲ ژوئن یه دستور کنترل صادرات آمریکا شاملش شد و Anthropic دسترسی رو برای باقی ماه معلق کرد. این محدودیت ۳۰ ژوئن برداشته شد و دسترسی از اول جولای برگشت.
چند عدد جانبی هم جالبن: ایجنتهای پشتیبانی داخلی گرونترین بار کاری هر توکنان (۵٪ توکنها روی ۱۴٪ هزینه)، کاربردهای B2B ۴۶٪ توکنها ولی ۶۰٪ هزینه رو میگیرن و حجم گوگل بیشتر تو کارهای مصرفی متمرکزه — ۵۷٪ توکنهای دستیار شخصی و ۵۴٪ توکنهای آموزش، ولی کمتر از ۲٪ توکنهای ایجنت کدنویسی.
نکات کلیدی:
- مدلهای متنباز ۲۹٪ توکنها رو با کمتر از ۴٪ هزینه بردن
- DeepSeek با ۲۲.۶٪ سومین منبع توکن شده، کمتر از دو واحد پشت گوگل
- Anthropic ۶۱٪ هزینه رو داره و تو کاربردهای پرریسک بالای ۷۲٪
- هر مدالیته رهبر متفاوتی داره؛ استفاده از بهترینها یعنی روتینگ بین چند آزمایشگاه
- کنترل صادرات آمریکا دسترسی به Claude Fable 5 رو برای بخشی از ژوئن معلق کرد




