Jev فقط تصمیم میگیره، متن نمینویسه
خلاصهٔ کاملتر
تو این مقاله اومده که Jev یه مدل هوش مصنوعیه که اصلاً متن تولید نمیکنه. بهش ورودی میدی و یکی از سه نوع خروجی رو میگیری: یه جواب بله/خیر با درصد اطمینان، انتخاب یکی از دستههای از پیش تعریفشده، یا یه امتیاز عددی روی یه بازه. روش آموزشش RLCD اسم داره (یعنی یادگیری تقویتی برای تصمیمهای کالیبره) و کار شرکت TypeSafe AI ـه. از طریق AI gateway ورسل و OpenRouter هم در دسترسه.
به جای پرامپت آزاد، معیارهای دستهبندی رو صریح براش تعریف میکنی. مثلاً برای یه تیکت پشتیبانی سه تا سوال: فوریه یا نه، کدوم تیم باید برش داره، و مشتری چقدر عصبانیه. Jev برای هر کدوم یه جواب ساختاریافته با درصد اطمینان برمیگردونه، بدون هیچ توضیح اضافه دور و برش. به گفتهٔ سازنده همین کنار گذاشتن تولید توکن باعث میشه برای کارهای دستهبندی ۲۰ تا ۲۰۰ برابر سریعتر و ۴۰ تا ۴۰۰ برابر ارزونتر از مدلهای چت معمولی دربیاد.
عددهای تست مقاله مشخصه: اجرای هفت قانون دستهبندی روی ۱۰۰۰ ایمیل اولش ۷۰ ثانیه و ۹ سنت طول کشید، و بعد از اینکه بکاند برای پردازش موازی بازنویسی شد رسید به حدود ۶ ثانیه با همون ۹ سنت. یه اجرای قابل مقایسه ولی سبکتر روی یه مدل کلاس GPT حدود ۵ دقیقه و ۶۲ سنت خرج برداشت. ۱۰۰۰ کامنت یوتیوب هم حدود ۵ ثانیه و ۵ سنت، و کل یه جلسهٔ تست با نزدیک ۲۰ هزار درخواست زیر یه دلار تموم شد.
چند تا کاربرد بلادرنگ هم تست شده: یه افزونهٔ کروم که پستهای X رو همون لحظهٔ لود شدن برچسب breaking، golden nugget یا AI slop میزنه، و یه ربات معامله که هر یک ثانیه جهت قیمت بیتکوین رو دوباره ارزیابی میکنه. نویسنده خودش میگه این ربات تو ساعت اول تست عملکرد خوبی نداشت، که یادآوری خوبیه: سرعت بالا به معنی تصمیم درست تو بازار نیست.
محدودیتهاش هم واقعیه. Jev نمیتونه بنویسه، خلاصه کنه، ایده بده یا دلیل تصمیمش رو توضیح بده، و پنجرهٔ متنش روی ۶۴ هزار توکن بستهست، خیلی کمتر از پنجرههای حدود یک میلیون توکنی امروزی. به گفتهٔ نویسنده بهترین الگو دو مدلیه: با Jev حجم زیاد رو ارزون غربال یا دستهبندی کن، بعد فقط همون بخش مهم رو بده به GPT یا Claude برای نوشتن و استدلال.
نکات کلیدی:
- سه نوع خروجی: بله/خیر با درصد اطمینان، انتخاب دسته، یا امتیاز عددی، همه به شکل JSON
- ۱۰۰۰ ایمیل با هفت قانون دستهبندی: حدود ۶ ثانیه و ۹ سنت بعد از موازیسازی
- مقایسه: یه مدل کلاس GPT برای کار سبکتر حدود ۵ دقیقه و ۶۲ سنت
- پنجرهٔ متن ۶۴ هزار توکن، بدون توانایی نوشتن، خلاصهسازی یا توضیح استدلال
- دسترسی از راه waitlist خود TypeSafe، AI gateway ورسل و OpenRouter




