Fugu-Ultra v1.1 با جهش تا ۷.۹ امتیاز
خلاصهٔ کاملتر
ساکانا AI تو رشتهتوییت تازهاش از انتشار Fugu-Ultra v1.1 خبر داده و گفته از استقبالی که از خانوادهٔ Fugu شده خوشحاله. به گفتهٔ شرکت، این نسخه با تکیه بر جدیدترین مدلهای مرزی بهروزرسانی شده و نتیجهاش عملکرد بهتر در همهٔ بنچمارکهای نشوندادهشده بوده، با بهبودی تا ۷.۹ امتیاز نسبت به نسخهٔ ۱.۰ و نتایج بهویژه قوی در ProgramBench و Terminal Bench 2.1. نکتهٔ مهم برای کاربران اینه که همهٔ اینها با همون قیمت قبلی ارائه میشه.
برای درک اینکه چرا «مدلهای تازهتر» اینجا معنی داره، باید یادآوری کرد Fugu خودش یه مدل معمولی نیست. تو معرفی اولیهاش اومده که Fugu یه سیستم چندایجنتیه که مثل یه مدل واحد رفتار میکنه: خودش یه مدل زبانیه که آموزش دیده مدلهای دیگه رو از یه استخر ایجنت صدا بزنه — حتی بهصورت بازگشتی نسخههایی از خودش رو — و انتخاب مدل، واگذاری کار، راستیآزمایی و ترکیب نتیجه رو خودکار مدیریت کنه. شما فقط به یه اندپوینت سازگار با OpenAI درخواست میفرستین و پیچیدگی چندایجنتی هیچوقت به کد شما نمیرسه.
خانوادهٔ Fugu دو عضو داره: نسخهٔ پایه که تعادل عملکرد و تأخیر کم رو برای کارهای روزمره و ابزارهایی مثل Codex در نظر گرفته، و Fugu Ultra که مدل پرچمدار برای مسائل چندمرحلهای سخته و استخر عمیقتری از ایجنتهای متخصص رو هماهنگ میکنه؛ کارهایی مثل پژوهش هوش مصنوعی، تحلیل امنیت سایبری و بررسی پتنت.
موضع تجاری ساکانا هم در همین معرفی روشنه: به گفتهٔ شرکت، وابستگی یه سازمان یا کشور به مدل یک شرکت خاص یه آسیبپذیری واقعیه و کنترلهای صادراتی اخیر روی مدلهایی مثل Fable و Mythos نشون داده دسترسی میتونه یکشبه قطع شه. استدلالشون اینه که چون Fugu روی استخری از ایجنتهای قابل تعویض کار میکنه، میتونه دور محدودیتهای یه فروشنده بچرخه.
نکات کلیدی:
- بهبود تا ۷.۹ امتیاز نسبت به Fugu-Ultra v1.0 در بنچمارکهای اعلامشده
- بیشترین پیشرفت در ProgramBench و Terminal Bench 2.1
- تقویت در کدنویسی، کارهای ایجنتی و استدلال پیشرفته، بدون تغییر قیمت
- Fugu یه مدل ارکستراسیون چندایجنتی پشت یه اندپوینت سازگار با OpenAI ـه
- روایت شرکت: تعویضپذیری ایجنتها، پوششی در برابر محدودیتهای یه فروشندهٔ خاص




