میوز کد: ایجنت کدنویسی متا رسید
خلاصهٔ کاملتر
به گفتهٔ این مقاله، متا ایجنت کدنویسی ترمینالی خودش رو با اسم Muse Code و در قالب بتا منتشر کرده و خود مارک زاکربرگ خبرش رو داده. الگوی کارش همونیه که یه سال اخیر جا افتاده: نصبش میکنی، داخل پوشهٔ پروژه از خط فرمان اجراش میکنی و میگی چی ساخته یا اصلاح بشه؛ خودش کدبیس رو میخونه، فایلها رو ویرایش میکنه و با بازخورد تو تکرار میکنه، بدون این که از ترمینال بیرون بیای.
کنارش Muse Spark 1.2 هم اومده؛ مدلی که متا مخصوص کد ساخته، نه یه دستیار همهکاره. تفاوتش با Llama همینه: مدل عمومی برای نوشتن و استدلال و گفتگو تربیت میشه، ولی یه مدل کدمحور باریکتر تنظیم میشه و همین میتونه تو کارهای برنامهنویسی جواب بهتری بده، حتی اگه تو بنچمارکهای بیربط ضعیفتر ظاهر بشه. نویسنده میگه این روزها همین استراتژی رایج شده: مدل تخصصی، بهعلاوهٔ ابزاری که دور نقطهقوتش طراحی شده.
عدد اصلی خبر امتیاز ۵۹.۳ درصد تو بنچمارک DeepSWE هست؛ آزمونی که خیلی از توسعهدهندهها الان اون رو شفافترین نشونهٔ توان کدنویسی واقعی میدونن. این امتیاز Muse Spark 1.2 رو کمی پشت Opus 5 و GPT 5.6 Turbo میذاره و از Qwen 3.8 Max با ۵۶.۶ درصد که همون هفته منتشر شد جلو میزنه. نکتهای که نویسنده روش دست میذاره اینه که GPT 5.6 Sol و Fable 5، یعنی صدرنشینهای فعلی، تو نمودارهای مقایسهٔ خود متا نبودن.
جمعبندی نویسنده اینه که اگه معیارت توان خام کدنویسی باشه، مدلهای امتیاز بالاتر احتمالاً خطای کمتری میدن و کارهای پیچیدهتر رو با رفتوبرگشت کمتر جمع میکنن؛ اما قیمت، محدودیت نرخ، تأخیر و جا افتادن ابزار تو جریان کاری هم مهمه و متا هنوز جزئیات قیمت و شرایط دسترسی رو منتشر نکرده. دموهایی هم که نشون داده — یه بازی ساده و یه سایت طراحیشده — از نظر ظاهر قابلمقایسه با خروجی مدلهای GPT و Grok بوده.
نکات کلیدی:
- Muse Code ایجنت کدنویسی ترمینالی متاست و فعلاً در بتاست
- موتورش Muse Spark 1.2 هست؛ یه مدل کدمحور، نه جایگزین Llama
- امتیاز ۵۹.۳ درصد در DeepSWE، کمی پشت Opus 5 و GPT 5.6 Turbo
- جلوتر از Qwen 3.8 Max با ۵۶.۶ درصد، ولی دور از امتیازهای بالای ۷۰
- قیمت و شرایط دسترسی هنوز اعلام نشده




