Laguna XS 2.1؛ مدل کدنویسی محلی پولساید
خلاصهٔ کاملتر
پولساید (poolside) از Laguna XS 2.1 رونمایی کرده؛ نسخهی ارتقاءیافتهی مدل XS.2 خودش. به گفتهی تیم سازنده، این یه مدل Mixture-of-Experts با ۳۳ میلیارد پارامتر کله که فقط ۳ میلیارد پارامترش بهازای هر توکن فعال میشه، و مخصوص کدنویسی agentic و کارهای طولانی روی یه سیستم محلیه. معماریش همون XS.2 هست، ولی رو تسکهای ترمینالی و چندزبانه بهتر شده.
مهمترین پیشرفت رو SWE-bench Multilingual اتفاق افتاده که ۵٫۴ واحد بالا رفته و به ۶۳٫۱٪ رسیده. تو این مقاله اومده که مدل رو چند بنچمارک کدنویسی agentic دیگه—مثل SWE-bench Verified و Terminal-Bench 2.0—هم نسبت به نسخهی قبلی جلو زده. سازنده برای مقایسه چند مدل dense بزرگتر رو هم آورده تا نشون بده مدلهای MoE از نظر بازده چقدر بهتر کار میکنن.
برای اجرای محلی، XS 2.1 از vLLM، SGLang، TensorRT-LLM، HF transformers و Ollama پشتیبانی میکنه و پشتیبانی llama.cpp هم قراره بهزودی اضافه شه. سه نسخهی کوانتایزشده هم منتشر شده—FP8، INT4 و NVFP4—که مدل رو رو سیستمهایی با VRAM و بودجهی محاسباتی کمتر قابلاجرا میکنه.
یه نکتهی جالب اینه که برای هر checkpoint، مدلهای speculator با نام DFlash هم بهصورت open-weight منتشر شدن. به گفتهی سازنده این speculatorها تو تستهاشون سرعت تولید توکن (tok/s) رو دو برابر کردن و اجرای محلی رو سریعتر میکنن. مدل روی API خودشون و OpenRouter با کانتکست ۲۵۶K هم سرو میشه.
قیمت نسخهی پولی مثل XS.2 مونده: هر یک میلیون توکن ورودی، خروجی و cache-read بهترتیب ۰٫۱۰، ۰٫۲۰ و ۰٫۰۵ دلار. لایسنس هم به OpenMDW-1.1 تغییر کرده که یه لایسنس کاملاً permissive مخصوص مدلهاست؛ نویسنده میگه این کار برای کمکردن اصطکاک لایسنسی تو انتشار مدلهای بازه. ضمناً XS.2 یه هفته بعد از API کنار گذاشته میشه.
نکات کلیدی:
- مدل MoE با ۳۳B پارامتر کل و ۳B فعال، مخصوص کدنویسی agentic محلی
- پیشرفت ۵٫۴ واحدی رو SWE-bench Multilingual و رسیدن به ۶۳٫۱٪
- سه نسخهی کوانتایز FP8، INT4 و NVFP4 برای سختافزار سبکتر
- مدلهای speculator با نام DFlash که سرعت تولید توکن رو دو برابر میکنن
- لایسنس بازتر OpenMDW-1.1 و کانتکست ۲۵۶K




