Jev از TypeSafe AI: مدلی که بهجای متن، تصمیم تایپدار میده
خلاصهٔ کاملتر
استارتاپ TypeSafe AI که Diogo Almeida راهش انداخته، بعد از دو سال کار مخفیانه اولین System One Model خودش رو منتشر کرده. Almeida قبلاً تو OpenAI روی روشهایی کار کرده که پشت ChatGPT بودن. نویسنده میگه مدلهای چت سالهاست تو گفتوگو از آدم بهترن، ولی خودکارسازی واقعی هنوز راه نیفتاده. جوابشون یه دسته مدل جدیده که تصمیمهای سریع و ساختاریافته میگیره تا نرمافزار بتونه مستقیم ازشون استفاده کنه.
اولین مدل عمومیشون Jev هست که الان تو early access عرضه شده. Jev اصلاً string تولید نمیکنه. یه وضعیت بدون ساختار میگیره و تصمیمهای تایپدار و احتمالاتی برمیگردونه. خودشون میگن بهش مثل یه function call با هوش سطح بالا نگاه کنید. بهجای تولید autoregressive (یعنی توکن به توکن، هر کدوم بعد از قبلی)، همهی احتمالها رو موازی بیرون میده.
برای ساختنش یه معماری جدید، یه sampler موازی و یه روش آموزشی به اسم RLCD (مخفف Reinforcement Learning for Calibrated Decisions) درست کردن. برای سنجش هم یه نوع eval جدید ساختن: همهی مدلها یه workflow یکسان (یعنی یه گراف محاسباتی که تو کد نوشته شده) رو اجرا میکنن و جوابها با میانگین پیشبینی GPT-6 Astra و Fable 5.1 مقایسه میشه.
ادعای ۱۹۳.۶ برابر سریعتر و ۴۴۴.۶ برابر ارزونتر از همین workflow evalها میاد. خود تیم قبول داره که این عددها احتمالاً سقف بهبود واقعی هستن. چون workflowها رو اعضای تیم خودشون ساختن، ممکنه یه کم سوگیری هم داشته باشه. به گفتهی خودشون، مرجع قرار دادن مدلهای OpenAI و Anthropic احتمالاً کارایی Jev رو کمتر از واقع نشون میده.
ادعای مهم دیگه اینه که Jev نمیتونه hallucinate کنه یا خطای تایپ بده، چون خروجی از اول با schema جوره. نویسنده میگه یه tool call خیالی تو یه agent فقط اذیتکنندهست، ولی تو سیستمی که تضمین latency داره یا چند لایه پایینتر تو زنجیرهی وابستگیهاست، کل کار رو خراب میکنه. البته عدد صفر درصد Jev تجربی نیست و آمار LLMها هم از OpenRouter اومده.
دو تا دمو هم نشون دادن: یه ربات که Doom بازی میکنه و ثانیهای ۱۰ درخواست میفرسته (حدود ۷ دلار در ساعت)، و Wikiracing یعنی رسیدن از یه صفحهی ویکیپدیا به صفحهی دیگه فقط با لینکها. Jev تو هر انتخاب تا ۲۵۵ گزینه رو پشتیبانی میکنه. اسم System One از کتاب Thinking, Fast and Slow از Daniel Kahneman اومده و Jev هم از William Stanley Jevons.
نکات کلیدی:
- Jev اولین System One Model شرکت TypeSafe AI هست و الان early access داره.
- خروجی Jev بهجای متن آزاد، تصمیم تایپدار همراه با احتماله.
- ادعای ۱۹۳.۶ برابر سرعت و ۴۴۴.۶ برابر هزینهی کمتر روی workflow evalها، که خود تیم میگه سقف بهبوده.
- مرجع مقایسه میانگین جوابهای GPT-6 Astra و Fable 5.1 بوده.
- حداکثر تعداد گزینه تو هر انتخاب Jev ۲۵۵ تاست.




