Fable 5.1: هوشمند ولی گرون
خلاصهٔ کاملتر
Anthropic از Fable 5.1 رونمایی کرده که همراه یه مدل خواهرخونده به اسم Mythos 5.1 با گاردریل نرمتر اومده. تو ردهبندی Artificial Analysis (یعنی سایتی که مدلهای هوش مصنوعی رو با معیارهای مستقل بنچمارک میکنه) Fable 5.1 با امتیاز ۶۶ صدرنشینه و از Opus 5 با ۶۳ و GPT-5.6 Soul با ۶۱ جلو زده. Anthropic هشت جایگاه از ده جایگاه برتر رو تو دست داره.
به گفتهی نویسنده، ادعای کاهش ۲۵ تا ۴۵ درصدی هزینه گمراهکنندهست. قیمت هر میلیون توکن ورودی و خروجی هیچ فرقی نکرده و کل تخفیف از کاهش ۷۵ درصدی cache read (یعنی وقتی مدل داره یه پرامپت تکراری رو دوباره پردازش میکنه) میاد که حالا ۰.۲۵ دلار به ازای هر میلیون توکنه. این برای کارلود ایجنتیک تکراری خوبه، ولی برای تسکهای یکباره نه.
تحلیل Artificial Analysis عکس این ادعا رو نشون میده. Fable 5.1 حدود ۱.۷ برابر توکن خروجی بیشتری تولید میکنه تا به جواب برسه، پس هزینهی هر تسک تمومشده حدود ۳.۶۹ دلاره. در مقابل، GPT-5.6 Soul با ۰.۴۳ دلار و GLM 5.3 با ۰.۶۸ دلار همون کار رو با کیفیت نزدیک انجام میدن. یعنی برای پروژههای حجمبالا با بودجهی محدود، GPT-5.6 Soul انتخاب معقولتریه.
نویسنده اشاره میکنه که مشکل حریم خصوصی هنوز کامل حل نشده. سامانهی جدید Enterprise Frontier Safeguards داده رو تو زیرساخت خود مشتری نگه میداره، ولی Anthropic هنوز دسترسی خوندن رو برای تشخیص سواستفاده حفظ کرده. تو Terminal Bench Science، Fable 5.1 با تلاش کم ۲۶٪ گرفته که از حداکثر تلاش نسل قبل بهتره؛ تو Cursor Bench هم ۷۳.۴٪ با ۹.۶۴ دلار زده که هم دقت بالاتر و هم هزینهی کمتریه.
نکات کلیدی:
- امتیاز ۶۶ تو Artificial Analysis برای Fable 5.1، در برابر ۶۳ برای Opus 5 و ۶۱ برای GPT-5.6 Soul
- تخفیف ۷۵٪ فقط روی cache read؛ قیمت توکن ورودی و خروجی همون قبلی
- هزینهی هر تسک: Fable 5.1 حدود ۳.۶۹ دلار، GPT-5.6 Soul حدود ۰.۴۳ دلار، GLM 5.3 حدود ۰.۶۸ دلار
- Mythos 5.1 با گاردریل کمتر تو Terminal Bench 4 حدود ۵٪ از Fable 5.1 امتیاز بیشتری گرفته
- سامانهی EFS داده رو تو ابر مشتری نگه میداره، ولی Anthropic دسترسی خوندن رو حفظ کرده




